{"as_of":"2026-08-22T21:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c7f21f806212df1aca9ecea0903cf411fbdc7e3c664c5b6c3a418c865df30557","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:45:09.010258Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:45:08.923631Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:45:09.075130Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"cited_work":{"arxiv_id":"2506.12073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12073","snapshot_observed_at":"2026-08-07T10:45:09.075130Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","venue":"eess.AS","work_id":"14aa48ab-323d-4f0b-b647-1990cddb3d66","year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.923631Z"},"links":{"cited_paper":"/paper/2506.12073","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:c3e10d07564eeb82a57a142b83e1155fc85322a8bef3315a9dd53f100a8b5d3b","observation_id":"0626fe6b-8ebf-4dac-a866-b5c548728cd0","resolution":{"observed_at":"2026-08-07T10:45:09.077476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12073/citation-record","integrity":"/paper/2506.12073/integrity","json":"/paper/2506.12073/citation-record.json","paper":"/paper/2506.12073"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"cited_work":{"arxiv_id":"2506.12073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12073","snapshot_observed_at":"2026-08-07T10:45:09.075130Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","venue":"eess.AS","work_id":"14aa48ab-323d-4f0b-b647-1990cddb3d66","year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.923631Z"},"links":{"cited_paper":"/paper/2506.12073","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:c3e10d07564eeb82a57a142b83e1155fc85322a8bef3315a9dd53f100a8b5d3b","observation_id":"0626fe6b-8ebf-4dac-a866-b5c548728cd0","resolution":{"observed_at":"2026-08-07T10:45:09.077476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.397273Z","title":null,"venue":null,"work_id":"52495712-5ce0-4235-9133-8866f67b460d","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.926900Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:b0770566d4323ae06162d150d4d0cf1979d5d4c4aa2cde7dd94494a6f841fd8f","observation_id":"5aeb66e8-2053-4d50-9cfb-f1574426a8e0","resolution":{"observed_at":"2026-08-07T10:45:09.399362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.383302Z","title":"Dataset (1) VCTK [19]:it includes 109 native English speakers with accented speech","venue":null,"work_id":"fe19a0ce-acfd-4029-b35f-90ebcf03491d","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.931342Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:2b8ea1961ef1cf45a9b7e353b142bc60c8331205a0b6b14c97c341c0df3c6337","observation_id":"148e33da-6b8b-4cbe-a024-20b0f689f2b5","resolution":{"observed_at":"2026-08-07T10:45:09.385574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.376982Z","title":null,"venue":null,"work_id":"622fac9f-74df-4c8d-907f-d6d52c7b17a6","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.933416Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:f7846e2919219b8151e769fcd737fc073892f6e3fe7c09cc94a0163d605bc878","observation_id":"cecf35da-21e8-4a27-a723-87dd0f154e9d","resolution":{"observed_at":"2026-08-07T10:45:09.379062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.935436Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.935436Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:97034d58694ca6ad5cd2c3632c78bc6dccfdce2016a2cc801d236393c3da4d9f","observation_id":"984bc769-3a80-4875-a56f-f402c2b411e4","resolution":{"observed_at":"2026-08-07T10:45:08.935436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00265","last_updated":"2024-11-29T21:39:21Z","snapshot_observed_at":"2026-08-19T17:29:40.142615Z","submitted_at":"2024-11-29T21:39:21Z","title":"SSDM 2.0: Time-Accurate Speech Rich Transcription with Non-Fluencies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00265","snapshot_observed_at":"2026-08-07T10:45:08.947796Z","title":"Ssdm 2.0: Time-accurate speech rich transcription with non-fluencies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.947796Z"},"links":{"cited_paper":"/paper/2412.00265","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:6305cbf31461c76d79814b06cd363d2b3e37d1d2dec25f0fdb0a1cd29610b4de","observation_id":"ee6b3803-d98a-488f-8356-8ee8afb308da","resolution":{"observed_at":"2026-08-07T10:45:08.947796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.366323Z","title":"Unconstrained dysfluency modeling for dysfluent speech transcription and de- tection,","venue":null,"work_id":"a76b95a7-0681-4d34-a6c7-ec86ffd70cc1","year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.937852Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:e3b9f0f653584b46f2166137e11f45d0516578cc16e7075e6ce907e3dc5d1725","observation_id":"c3d7d71a-5a08-4599-b35f-6ec842ea5e00","resolution":{"observed_at":"2026-08-07T10:45:09.368453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.357958Z","title":"Towards hierarchical spoken lan- guage disfluency modeling,","venue":null,"work_id":"9f30ab54-6343-474b-9d3d-6bc0cc3ec7ab","year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.940227Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:a6a8a0eac946f90014374d854e28bb28f46a961640dba7daadaaaf478d31cbdb","observation_id":"2297a862-dc55-4cca-a3fb-ea3448247f59","resolution":{"observed_at":"2026-08-07T10:45:09.360997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.350908Z","title":"Pattern search in dysfluent speech,","venue":null,"work_id":"c656e68f-cd17-421f-8795-173e8dbef4e6","year":2012},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.942097Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:28e587780cd0c3c066df47213b906fceee209ddbb3953bcb0c49909f511f6198","observation_id":"cacd5227-e424-438d-8a1c-eaca5181e99d","resolution":{"observed_at":"2026-08-07T10:45:09.353235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.343571Z","title":"Weakly-supervised forced alignment of disfluent speech using phoneme-level modeling,","venue":null,"work_id":"0bfe5b10-7f3a-41de-a778-b6062cc4440c","year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.943866Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:b0fdbcb51d9b66390c22c062cc2d053b4d9c0df88c842e0728c84416ebc1e1d4","observation_id":"897b72d4-502b-4a56-b00c-ee62e9c358fc","resolution":{"observed_at":"2026-08-07T10:45:09.345831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.336961Z","title":"Ssdm: Scalable speech dysfluency modeling,","venue":null,"work_id":"445f1980-9aa9-47d8-a500-37c0c4b42d81","year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.945620Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:393819ed0d81ec0962e583fbc1b965606f46787f3bee32e91b52e078452f89ef","observation_id":"a1a8b990-31fc-4807-981e-693cd0d81d33","resolution":{"observed_at":"2026-08-07T10:45:09.339239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.305413Z","title":"Articulatory representation learning via joint factor analysis and neural matrix factorization,","venue":null,"work_id":"8ab909c6-6ac8-494b-a015-303238a5cf84","year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.959870Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:48c327bc8df3c9b5e16a273c4ec4652fdf6ea56157099608039e9da02e4cc91a","observation_id":"eb288181-9245-469f-a209-01436460b5fa","resolution":{"observed_at":"2026-08-07T10:45:09.307552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.330517Z","title":"Longest common subsequence","venue":null,"work_id":"585b39c5-a73c-41ed-82d3-d612fa9f16da","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.949800Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:b32ac0970cfe9f931c76232b961764db0617eee7f07f0879cd80719cebc6075b","observation_id":"6dcc0924-71d2-4e5a-853b-8405f46c09ec","resolution":{"observed_at":"2026-08-07T10:45:09.332597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.324112Z","title":"Yolo-stutter: End-to-end region-wise speech dys- fluency detection,","venue":null,"work_id":"86640688-3797-4708-a710-9378cb3055d0","year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.951958Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:354898cd67ae7c228b8a74005be7eb939373c7dad903c17ae28c3c2b91befda3","observation_id":"efb3a4e1-37d0-474a-9fca-48ac3f206657","resolution":{"observed_at":"2026-08-07T10:45:09.326166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.317152Z","title":"Stutter-solver: End-to-end multi-lingual dysfluency detection,","venue":null,"work_id":"094d0eac-ebce-47ce-9163-cd9f725c3943","year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.954004Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:8cf4a6792baaff28fb2fd49529d9488b7719cd8b9f3dba33c3d56b77a6df534c","observation_id":"e90c0406-9864-43e4-8999-2362051369a9","resolution":{"observed_at":"2026-08-07T10:45:09.319747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.955698Z","title":"Montreal forced aligner: Trainable text-speech align- ment using kaldi","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.955698Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:0e623fb9431a4e662ecff112f1c19e00bc50b6ace34a78b10679425a7101ac0a","observation_id":"d249e89d-5615-4004-8040-f1efd329f23a","resolution":{"observed_at":"2026-08-07T10:45:08.955698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13582","last_updated":"2024-09-20T15:35:32Z","snapshot_observed_at":"2026-08-18T03:33:41.966114Z","submitted_at":"2024-09-20T15:35:32Z","title":"Time and Tokens: Benchmarking End-to-End Speech Dysfluency Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13582","snapshot_observed_at":"2026-08-07T10:45:08.957472Z","title":"Time and tokens: Benchmarking end- to-end speech dysfluency detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.957472Z"},"links":{"cited_paper":"/paper/2409.13582","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:74b663bf6261f9e7f6dbbcfa5ab4c4c1495162b7a64dbf99a9007399049ca64c","observation_id":"76a04c93-4106-43da-ba70-05350a97d860","resolution":{"observed_at":"2026-08-07T10:45:08.957472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.971347Z","title":"Coding speech through vocal tract kinematics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.971347Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:be5c827f8a0f25bab6cb14a21cc0e4896b434cff970d74d93dff6ed0c437005e","observation_id":"c29495d3-80c5-4286-80fe-c92cf3dd7809","resolution":{"observed_at":"2026-08-07T10:45:08.971347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.961788Z","title":"Deep Neural Convolutive Matrix Factorization for Articulatory Representation Decomposition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.961788Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:2239e980ff731bfe2e8f07358eb11621fd2f8eba358e6a5190eee90932d3239d","observation_id":"547327a3-b299-413b-b494-64141f9dcfc0","resolution":{"observed_at":"2026-08-07T10:45:08.961788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.293460Z","title":"Deep Speech Synthesis from MRI-Based Articulatory Representations,","venue":null,"work_id":"327bdb46-02df-4b48-9845-45cadd9cab6f","year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.964115Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:5602e692625d66ec02674140281ff54d3ab7e98ef174f3a3916630176f35da44","observation_id":"2300932d-2901-44bf-bb18-b579508388ea","resolution":{"observed_at":"2026-08-07T10:45:09.295520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-08-16T15:06:35.991757Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-07T10:45:08.965856Z","title":"Seamlessm4t-massively multilingual & multimodal ma- chine translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.965856Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:19b14833c2d317e3778005b09c1a9dca7a80aa366349f8ae629e3490a5271998","observation_id":"52e2970f-b64e-4f19-a991-b6320b6bde47","resolution":{"observed_at":"2026-08-07T10:45:08.965856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.967733Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.967733Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:e6b751ec6344b35e8ff5914316367c239fcc06ef9cfba7212ee839789983023a","observation_id":"cbeb41bd-61a8-43af-a5ad-751f7e41c603","resolution":{"observed_at":"2026-08-07T10:45:08.967733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.281760Z","title":"Bayes risk ctc: Controllable ctc alignment in sequence-to-sequence tasks,","venue":null,"work_id":"488fe464-cd0c-4d52-8383-b5636e4be7cc","year":2022},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.969636Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:5a24ffffd1def286c0f0a19d217c5017540541dc817054ddf9debd79776dbc79","observation_id":"3191cace-e7ba-4dee-888e-8f215dff3ce8","resolution":{"observed_at":"2026-08-07T10:45:09.283952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.242139Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":"84c5fbaf-fb20-4239-be65-ad6a8f85c622","year":2022},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.981938Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:56b1a49205438a901463858823e19069da04475806e7efd8a2dd040db36a96ee","observation_id":"ca6ca2b3-935e-4395-bbd4-5023973bb370","resolution":{"observed_at":"2026-08-07T10:45:09.244028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.271185Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit (ver- sion 0.92),","venue":null,"work_id":"7684556f-2e79-4281-acb5-6b76bf0de06a","year":2019},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.973078Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:f24d7ada1928032ff7116b157931fc0f31d6fc7fc9134d3ad1417b482afe2c77","observation_id":"6eff9d8b-8f8f-4cca-8f82-d3edbe6c95d8","resolution":{"observed_at":"2026-08-07T10:45:09.273433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.264692Z","title":"Phone-to-audio alignment without text: A semi-supervised approach,","venue":null,"work_id":"b4bfe306-021f-4e27-8d67-7911fbd0d03f","year":2022},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.974847Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:92310b92f9bfab009c98428c73302529e5d19fcd508450153ad5aa522b88bd77","observation_id":"968b542f-c701-4431-b35b-45bf6cd1512c","resolution":{"observed_at":"2026-08-07T10:45:09.266996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:08.976753Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.976753Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:968d9eebdb8e160979af31abd865ccd1cefed27f6dbccbf46a214b61c0ae88b2","observation_id":"586ccfb6-6ea3-4ab4-9eca-9d758c38cc95","resolution":{"observed_at":"2026-08-07T10:45:08.976753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.253441Z","title":"Classification of primary progressive aphasia and its variants,","venue":null,"work_id":"80c2e675-a407-45b8-9d8d-83d36490414d","year":2011},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.978576Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:4d1b2ec53daeabd3a0bee9726730e938d884e106dd44cd03828a6ef94e6eb1f6","observation_id":"a17aa570-a850-463b-9b9a-1e253c7692fb","resolution":{"observed_at":"2026-08-07T10:45:09.255588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.247813Z","title":"Wavlm-ctc-hugginface,","venue":null,"work_id":"925729e6-ba9d-4268-989b-3415dadd8d2b","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.980180Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:284086fa9d833903feaf970394317716550cba9fbbe25434ba275f513029b51a","observation_id":"374045ba-eacf-46c4-b88e-8bbd914a98d7","resolution":{"observed_at":"2026-08-07T10:45:09.249818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.112561Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":"3702a3a2-3496-46da-a16e-b36e010bc7e9","year":2021},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.991744Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:f0d58adfe2c1a6785747e929655ff44103fb1812a5e6946efaae75ab12c6fe70","observation_id":"410622eb-695e-4c2d-a3af-e7aa686f2ee0","resolution":{"observed_at":"2026-08-07T10:45:09.114819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.236678Z","title":"Univer- sal phone recognition with a multilingual allophone system,","venue":null,"work_id":"c7fcdff0-2de4-421c-a9b6-49c1eae1da4a","year":2020},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.983524Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:b6ea9a099a148a4c69341a3085a50cdb3c41dc5a7ab4fd389dfdeb79bbcc7c28","observation_id":"0ee89ca0-50cc-4702-b20b-0d4b28e8efca","resolution":{"observed_at":"2026-08-07T10:45:09.238728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.230892Z","title":"Algorithms for the longest common subse- quence problem,","venue":null,"work_id":"d3f5a0e5-f552-4440-bbb5-9f369ba616d8","year":1977},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.984942Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:a72b172cc468c12a4ad48711d1ac8b0e52bc2baffe59e81952b6f8325a5bb6e1","observation_id":"cefef550-a31a-47ff-be01-96cd1ca7f2ff","resolution":{"observed_at":"2026-08-07T10:45:09.233042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.225111Z","title":"Dynamic-programming approach to continuous speech recognition,","venue":null,"work_id":"85191c1b-5e6e-43c7-9626-f8985b3c74d5","year":1971},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.986841Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:158aa3893be1127c8951334a2a4d38202a0808202c70f6571df38b3b864aa57a","observation_id":"9ff9bd76-43b1-4728-be1a-233e77fd11ea","resolution":{"observed_at":"2026-08-07T10:45:09.227232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.218814Z","title":"Cmu phoneme dictionary","venue":null,"work_id":"5323db61-4ccc-480d-b953-9bb2f19fbaa0","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.988414Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:91f0a53dd049bd1bc3d3d8ecd73b4b9bed78f963fa699a0661ef62a9db6bd13e","observation_id":"467e7ca6-bff1-4eac-aee4-4dd4fb92be9e","resolution":{"observed_at":"2026-08-07T10:45:09.220775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.390113Z","title":"During inference, we apply greedy decoding on CTC emis- sion matrix","venue":null,"work_id":"091fa6e5-8074-4a8a-9f46-12f8e2378138","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.929137Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:e35a3b5184e47e37278bd1da2ce0db1d15cfeedd8e5aa31b15ecda8811641708","observation_id":"b14e6252-9ac1-4ffb-a330-66a3295a51fa","resolution":{"observed_at":"2026-08-07T10:45:09.392695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.118473Z","title":"Model card addendum: Claude 3.5 haiku and upgraded claude 3.5 sonnet,","venue":null,"work_id":"2e7a6872-05eb-4284-b94f-0ebe67e54157","year":2024},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.990048Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:803694318a29573b7e3ce16e6b63c263ac5e8f1cf93ee70f6edbcbb99e985a86","observation_id":"775cfacd-603d-4f5d-9991-23a4663d2894","resolution":{"observed_at":"2026-08-07T10:45:09.120436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.105805Z","title":"Sig- nature verification using a Siamese time delay neural network,","venue":null,"work_id":"e7f7e97f-27de-4c59-a301-e43e5306f8cd","year":1994},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.993368Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:53ff2d18d31097610d755bf50b5f5d3ecbf9291838c9280a4e5d273f3639ae7d","observation_id":"a6e1e794-3059-437c-a0ff-d49baf82fc2e","resolution":{"observed_at":"2026-08-07T10:45:09.108267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.098583Z","title":"A survey on siamese network: Methodologies, applications, and opportunities,","venue":null,"work_id":"b65aac77-f79f-4fd1-97c7-4baba509d046","year":2022},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.995306Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:a145e6e251121a3101dcfddcc548d4a7e7910cfeb5ba46f1dd9867d609c3151d","observation_id":"c0c9318d-de44-4b0e-8f76-eef335c13d72","resolution":{"observed_at":"2026-08-07T10:45:09.100947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-08-14T16:16:21.567225Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-07T10:45:08.996982Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.996982Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:fda3a7cbaec70116ee3b4849a1bc1300b8333745e79ada9e1a290cfefbc5abb4","observation_id":"c28d4c31-242b-4662-aeb8-a4a7a2cd3307","resolution":{"observed_at":"2026-08-07T10:45:08.996982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-08-17T00:09:26.216715Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-07T10:45:08.998933Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:08.998933Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:ccf40e6d78e7917eeec64d94d691818175eba113fce6a6ce894119f6f6700e48","observation_id":"70043c42-3cb1-4895-aa3a-d22d325c62ec","resolution":{"observed_at":"2026-08-07T10:45:08.998933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.092730Z","title":"wav2vec: Unsupervised pre-training for speech recognition,","venue":null,"work_id":"ea8a6d09-7291-4092-8bf5-bd44e117e617","year":null},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.001613Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:bcb1baa349b901b8b1d1a2ddb1bfdde2c3af35107ace48bad7907f1234d0ca8c","observation_id":"f75176fb-0637-4f42-9562-e40e8c14bc8b","resolution":{"observed_at":"2026-08-07T10:45:09.094958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.005143Z","title":"The im- pact of allophony versus contrast on speech perception,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.005143Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:27bea42516250de6c6474dd0ecc21ef697cb35e645aff65cf3dba58b527d448d","observation_id":"9fe2ddf6-85b1-457b-8806-cdbf218551d5","resolution":{"observed_at":"2026-08-07T10:45:09.005143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:09.081907Z","title":"Leveraging allophony in self-supervised speech models for atyp- ical pronunciation assessment,","venue":null,"work_id":"533ab6ec-d39b-42f1-bbc9-faf537cd3fa8","year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.006777Z"},"links":{"citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:3a0103efc91ec1ac00006c222b5c0771a4cfb0add110f52ebd68d7dd5494d31d","observation_id":"22ef01bf-1df7-4b68-843a-084ac3c553ea","resolution":{"observed_at":"2026-08-07T10:45:09.084075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22029","last_updated":"2025-06-22T18:20:44Z","snapshot_observed_at":"2026-08-15T16:45:09.158446Z","submitted_at":"2025-05-28T06:52:10Z","title":"Analysis and Evaluation of Synthetic Data Generation in Speech Dysfluency Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22029","snapshot_observed_at":"2026-08-07T10:45:09.008441Z","title":"Analysis and evaluation of synthetic data generation in speech dysfluency detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.008441Z"},"links":{"cited_paper":"/paper/2505.22029","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:12956f990f1b265d08407c51565c5962255fbfd866b0fc59cd0293b9110aa18e","observation_id":"8d8cf98b-09a6-487b-b985-7e888fc4e36e","resolution":{"observed_at":"2026-08-07T10:45:09.008441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16351","last_updated":"2025-05-25T01:02:29Z","snapshot_observed_at":"2026-08-19T17:30:11.247202Z","submitted_at":"2025-05-22T08:02:50Z","title":"Dysfluent WFST: A Framework for Zero-Shot Speech Dysfluency Transcription and Detection","version":2},"cited_work":{"arxiv_id":"2505.16351","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16351","snapshot_observed_at":"2026-08-07T10:45:09.028250Z","title":"Dysfluent WFST: A Framework for Zero-Shot Speech Dysfluency Transcription and Detection","venue":"eess.AS","work_id":"c337d68b-5a05-4a8d-a06b-70ed18090a68","year":2025},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.010258Z"},"links":{"cited_paper":"/paper/2505.16351","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:304ea662526dca41fd793bf28532bd1dcee6979c82b958bec088c3eab26fa0ea","observation_id":"9315c54a-853e-4030-8bff-d6114c017b72","resolution":{"observed_at":"2026-08-07T10:45:09.032558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-17T12:28:40.241678Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-07T10:45:09.003341Z","title":"Available: https://arxiv.org/abs/1904.05862","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:09.003341Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2506.12073"},"observation_digest":"sha256:0a8238f9cca2e4958e2207f148b1e1944bffe59649dd2dda27a2bfcf8638b8bc","observation_id":"b41b945c-92e7-4dce-9c77-ab82425a6e3f","resolution":{"observed_at":"2026-08-07T10:45:09.003341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12073","last_updated":"2025-06-05T03:06:37Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T07:52:10.001777Z","submitted_at":"2025-06-05T03:06:37Z","title":"Seamless Dysfluent Speech Text Alignment for Disordered Speech Analysis"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2506.12073."}