{"as_of":"2026-08-08T04:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b32ccb6935da8fb48bcd07144220efd365cab71e7370d49221800ff1ec0a3d21","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:21:55.953111Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:21:51.628157Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:21:57.046523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"cited_work":{"arxiv_id":"2505.22005","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22005","snapshot_observed_at":"2026-08-07T13:21:57.046523Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","venue":"cs.SD","work_id":"db5f0165-8812-4a66-866a-e041cb628fbe","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.628157Z"},"links":{"cited_paper":"/paper/2505.22005","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:802394df4c7bb649b2132611625f187bb4bcf16d7e4d7447c1a6a8e3a1d59db1","observation_id":"9fe746d9-93ce-4cf3-b975-99589304441e","resolution":{"observed_at":"2026-08-07T13:21:57.116469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22005/citation-record","integrity":"/paper/2505.22005/integrity","json":"/paper/2505.22005/citation-record.json","paper":"/paper/2505.22005"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"cited_work":{"arxiv_id":"2505.22005","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22005","snapshot_observed_at":"2026-08-07T13:21:57.046523Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","venue":"cs.SD","work_id":"db5f0165-8812-4a66-866a-e041cb628fbe","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.628157Z"},"links":{"cited_paper":"/paper/2505.22005","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:802394df4c7bb649b2132611625f187bb4bcf16d7e4d7447c1a6a8e3a1d59db1","observation_id":"9fe746d9-93ce-4cf3-b975-99589304441e","resolution":{"observed_at":"2026-08-07T13:21:57.116469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:00.233772Z","title":"Framework Overview As shown in Figure 1 (a), the proposed LLM-driven ASR- SED multi-task learning framework comprised two parallel branches: the ASR branch and the SED branch","venue":null,"work_id":"6b404f48-9177-483a-ba20-b6cf4a70d91d","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.771744Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:b5af4ab5478a2d987e04475721bac6502a555f06a478ad99b14649e2f41fc0ca","observation_id":"f8b4865f-98f5-4824-bce9-aefe3f698475","resolution":{"observed_at":"2026-08-07T13:22:00.340060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:00.018450Z","title":"<|im_start|>user<S><D><C ><P><|im_end|><|im_start|>assistant< T><|im_end|>|","venue":null,"work_id":"05893bf5-5db1-4d55-b6cc-8aa91cd3a866","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:51.872461Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:eb87d4284d27bb5e4bf2c1eb3d35dadecd0630066463fe04831368b9463139b2","observation_id":"7283768c-b3c5-4731-aba4-67e6cec66d4a","resolution":{"observed_at":"2026-08-07T13:22:00.144386Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.859066Z","title":null,"venue":null,"work_id":"7db63330-0f87-4374-a61d-a4a7b3304f7f","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.015369Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:554b150ee9c543d123f363fae1c6ee66c1ceaac86db590b45cbe047cb9d2094c","observation_id":"ab2ee8f0-80c9-4213-bae4-f8be2ad39216","resolution":{"observed_at":"2026-08-07T13:21:59.932773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.676546Z","title":null,"venue":null,"work_id":"0f5b7724-51a4-49e4-b99b-acfdd3265725","year":null},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.157747Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:ed11d92579a94b8f1b70b39b734edf4978968b80e8877dd339f37852c9173617","observation_id":"1ad68827-f6e7-4481-be73-2d0cea040adc","resolution":{"observed_at":"2026-08-07T13:21:59.776733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.483796Z","title":"“the world is designed for fluent people","venue":null,"work_id":"99ef7343-591a-4612-89c8-90d2b9839739","year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.298893Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f6f36e6860cf7743638a69434179cd4d4b9bbb36e975d8b7904167d21733d44f","observation_id":"e46e9522-0176-4f7a-9245-5d58e254f889","resolution":{"observed_at":"2026-08-07T13:21:59.575083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.278850Z","title":"Microaggression and the adult stuttering experience,","venue":null,"work_id":"4795daf5-93f7-440c-9deb-b406466f35be","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.407492Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:37d0e6a01d08e91f4776cd7cb6999a6aa7507ee2bcc9a1cb0cb62efa8f882869","observation_id":"cd6985fd-335b-4633-8890-34a6f485847d","resolution":{"observed_at":"2026-08-07T13:21:59.364553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:59.078199Z","title":"Enhanced asr for stuttering speech: Combining adversarial and signal-based data augmentation,","venue":null,"work_id":"7b06a642-3ef1-46df-96fc-6f7d654a6baa","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.509373Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:4cc26af64e989d6df24a12d4e120f82454db207294b78bf7977ae0d696d698a4","observation_id":"0c7645df-e6f1-4765-b6f2-a4b33f9d47fb","resolution":{"observed_at":"2026-08-07T13:21:59.199713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.846477Z","title":"The fos- afer system for the chime-8 mmcsg challenge,","venue":null,"work_id":"32dcbb55-f24b-4b80-883d-85c15e184af6","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.667668Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:a7443cdcc54a44a60a1a56e71fa1df9325aaa23f38aa1d4d17f3169c5a3339d2","observation_id":"2566b13d-7681-41f3-a450-89af52746feb","resolution":{"observed_at":"2026-08-07T13:21:58.967000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07256","last_updated":"2024-06-11T13:35:50Z","snapshot_observed_at":"2026-08-07T05:21:54.175230Z","submitted_at":"2024-06-11T13:35:50Z","title":"AS-70: A Mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07256","snapshot_observed_at":"2026-08-07T13:21:52.781241Z","title":"As-70: A mandarin stuttered speech dataset for automatic speech recognition and stuttering event detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.781241Z"},"links":{"cited_paper":"/paper/2406.07256","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:2df482b9841c82dd9f3e1fec8ed894fa77da1941569289ae5556445b420ab633","observation_id":"937da8a8-bc10-487d-9776-2642dd5dcd3e","resolution":{"observed_at":"2026-08-07T13:21:52.781241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.670212Z","title":"Findings of the 2024 mandarin stuttering event detection and automatic speech recognition chal- lenge,","venue":null,"work_id":"afa03471-7ed5-434d-ba24-79d712f5a926","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:52.901510Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:0c7dc71eab3ace61ebdaba89e2d66869b60d713837f019f87ef5d6b51adf6f0e","observation_id":"26ee585e-9103-4093-97ea-26f6aa3f9deb","resolution":{"observed_at":"2026-08-07T13:21:58.735853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.03209","last_updated":"2016-04-12T02:34:00Z","snapshot_observed_at":"2026-08-02T09:58:25.765651Z","submitted_at":"2016-04-12T02:34:00Z","title":"Disfluency Detection using a Bidirectional LSTM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.03209","snapshot_observed_at":"2026-08-07T13:21:53.124971Z","title":"Disfluency detec- tion using a bidirectional lstm,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.124971Z"},"links":{"cited_paper":"/paper/1604.03209","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:9af6f72673cbf10a673bd877fd9ca9a81c7e1cfd29f0af403a6ebb9c5c4f3d92","observation_id":"d4295314-a2fb-476d-9c21-ca5c6c3eac94","resolution":{"observed_at":"2026-08-07T13:21:53.124971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05396","last_updated":"2022-02-08T19:55:23Z","snapshot_observed_at":"2026-07-06T12:36:41.820948Z","submitted_at":"2022-02-08T19:55:23Z","title":"Enhancing ASR for Stuttered Speech with Limited Data Using Detect and Pass","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05396","snapshot_observed_at":"2026-08-07T13:21:53.285721Z","title":"Enhancing asr for stuttered speech with limited data using detect and pass,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.285721Z"},"links":{"cited_paper":"/paper/2202.05396","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:e22a79914855851a5debaede7bb547f095ca01c8f5b168b1cfb2a3dd383d1733","observation_id":"17ddf87c-da67-4fcf-a5ee-b3d32ecd1c40","resolution":{"observed_at":"2026-08-07T13:21:53.285721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:53.391511Z","title":"From user percep- tions to technical improvement: Enabling people who stutter to better use speech recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.391511Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:6f3100614d4218b20a0f40d00892b7fd9efb08f378b07c8266181414ca33def4","observation_id":"1162c1fb-cce4-4a37-9bfd-a91cad9ef6e4","resolution":{"observed_at":"2026-08-07T13:21:53.391511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11759","last_updated":"2021-06-18T20:58:34Z","snapshot_observed_at":"2026-07-06T11:21:44.767735Z","submitted_at":"2021-06-18T20:58:34Z","title":"Analysis and Tuning of a Voice Assistant System for Dysfluent Speech","version":1},"cited_work":{"arxiv_id":"2106.11759","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.11759","snapshot_observed_at":"2026-08-07T13:21:56.874046Z","title":"Analysis and Tuning of a Voice Assistant System for Dysfluent Speech","venue":"eess.AS","work_id":"a46ab85a-6b52-4a63-9260-799e83a48c99","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.527444Z"},"links":{"cited_paper":"/paper/2106.11759","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:396c6fd014e96b5162030adb5608ef1f99d22c2dd982e6e9ae334ee7a6325d00","observation_id":"b89b2d1f-52c0-4493-b28b-52bb54a09f75","resolution":{"observed_at":"2026-08-07T13:21:56.935159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09731","last_updated":"2022-11-04T23:45:31Z","snapshot_observed_at":"2026-08-06T16:26:00.584647Z","submitted_at":"2022-11-04T23:45:31Z","title":"Stutter-TTS: Controlled Synthesis and Improved Recognition of Stuttered Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09731","snapshot_observed_at":"2026-08-07T13:21:53.625995Z","title":"Stutter-tts: Con- trolled synthesis and improved recognition of stuttered speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.625995Z"},"links":{"cited_paper":"/paper/2211.09731","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:917c805f72a59050665b7d2bf73e633c657ddf24da743b3a23e36ce6a75e2f21","observation_id":"4bade08d-f3be-4584-9c9e-837ee4c91450","resolution":{"observed_at":"2026-08-07T13:21:53.625995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.504921Z","title":"Stutter- net: Stuttering detection using time delay neural network,","venue":null,"work_id":"39be1d73-d0d7-4896-9bfb-860142410981","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.766639Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:7adc4bebbb38f0a09b4924b06bd99ce7d88342d1281158427ff9fc9b63ba704b","observation_id":"68ce1fc8-a4a6-4642-8539-73a548394b3d","resolution":{"observed_at":"2026-08-07T13:21:58.600453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:58.258211Z","title":"Stuttering detec- tion using atrous convolutional neural networks,","venue":null,"work_id":"60e26330-faf5-4c60-b840-e0f8305f37a7","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:53.964388Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f5669b863d7a91e7c1612de2ab57f49b01edce51b76dba5ddc3d75bbdd4dc431","observation_id":"cd03bd9d-42d5-4a92-ad09-4c3b6c416598","resolution":{"observed_at":"2026-08-07T13:21:58.368116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11394","last_updated":"2020-09-23T21:51:29Z","snapshot_observed_at":"2026-07-06T09:58:15.721426Z","submitted_at":"2020-09-23T21:51:29Z","title":"FluentNet: End-to-End Detection of Speech Disfluency with Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11394","snapshot_observed_at":"2026-08-07T13:21:54.091638Z","title":"Fluentnet: end- to-end detection of speech disfluency with deep learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.091638Z"},"links":{"cited_paper":"/paper/2009.11394","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f837a112c3df26bf340ed72b5bd1010dad722e4f3ed135dffd6a782deab53010","observation_id":"4bdc8cea-344b-4190-af65-0e1f01f84ba5","resolution":{"observed_at":"2026-08-07T13:21:54.091638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09479","last_updated":"2024-11-14T14:35:40Z","snapshot_observed_at":"2026-08-07T03:58:50.832697Z","submitted_at":"2024-11-14T14:35:40Z","title":"An End-To-End Stuttering Detection Method Based On Conformer And BILSTM","version":1},"cited_work":{"arxiv_id":"2411.09479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09479","snapshot_observed_at":"2026-08-07T13:21:56.719978Z","title":"An End-To-End Stuttering Detection Method Based On Conformer And BILSTM","venue":"eess.AS","work_id":"9c76531d-f326-4949-b38e-3020c930f369","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.233333Z"},"links":{"cited_paper":"/paper/2411.09479","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:3b1f0bac3080dedaad278c082ad41561fc3409660cd4fd7b071021786ff729e0","observation_id":"5b76ea21-dd3f-49a9-8b87-edbca8a24e0b","resolution":{"observed_at":"2026-08-07T13:21:56.775542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:54.408021Z","title":"Momentum con- trast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.408021Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:11282b52dfccd7fc7996eb75da1f639270a382f2af2b4cf5b72a524a0ec8a747","observation_id":"f42f06a5-3f69-4ac6-9b00-8aa6ec256350","resolution":{"observed_at":"2026-08-07T13:21:54.408021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.961927Z","title":"Cola: Weakly- supervised temporal action localization with snippet contrastive learning,","venue":null,"work_id":"7e2abd58-7e4c-4cf0-ae77-291c1bee7758","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.508611Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:e8b27dc4557c7ffeebf981e83695ee99f72d88585300c300ecd4b2981bdaad95","observation_id":"6f379ebe-217b-47ea-8c01-2323cc01e8cf","resolution":{"observed_at":"2026-08-07T13:21:58.120139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03152","last_updated":"2024-05-06T04:05:19Z","snapshot_observed_at":"2026-08-01T12:07:56.351929Z","submitted_at":"2024-05-06T04:05:19Z","title":"MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition","version":1},"cited_work":{"arxiv_id":"2405.03152","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.03152","snapshot_observed_at":"2026-08-07T13:21:56.578317Z","title":"MMGER: Multi-modal and Multi-granularity Generative Error Correction with LLM for Joint Accent and Speech Recognition","venue":"eess.AS","work_id":"ffe5880f-a158-401b-8875-361b090994cd","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.670984Z"},"links":{"cited_paper":"/paper/2405.03152","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:086335b38228749cbd7ebac6d589424ba570e1b8c7e6aa2a9d0dc66dac9ff59e","observation_id":"d65b85c7-26d4-4e4a-bc6e-80396ec46e77","resolution":{"observed_at":"2026-08-07T13:21:56.622044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.730220Z","title":"Speech recognition meets large language model: Benchmarking, models, and exploration,","venue":null,"work_id":"91dab00d-d977-437c-993a-9686b8b92bf3","year":2025},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.769858Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:f274b2c4a1a52be2b9d0a947a90ea37b380bc31b4fc87d417fa397423c62466f","observation_id":"8660c956-47f3-45c2-9194-a573bca74fe5","resolution":{"observed_at":"2026-08-07T13:21:57.884832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09491","last_updated":"2024-08-18T14:10:35Z","snapshot_observed_at":"2026-08-05T20:02:44.497508Z","submitted_at":"2024-08-18T14:10:35Z","title":"A Transcription Prompt-based Efficient Audio Large Language Model for Robust Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09491","snapshot_observed_at":"2026-08-07T13:21:54.905684Z","title":"A transcrip- tion prompt-based efficient audio large language model for robust speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:54.905684Z"},"links":{"cited_paper":"/paper/2408.09491","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:aaed6ce228c86ff8f47a34732bcf310decce333d62111716b7d9c12e714c48da","observation_id":"07cf5247-7ee5-4ad4-aa3b-fdcba432b5e1","resolution":{"observed_at":"2026-08-07T13:21:54.905684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04673","last_updated":"2024-07-03T02:38:03Z","snapshot_observed_at":"2026-08-02T08:46:39.076208Z","submitted_at":"2023-10-07T03:17:59Z","title":"LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04673","snapshot_observed_at":"2026-08-07T13:21:55.024547Z","title":"Lauragpt: Listen, attend, understand, and re- generate audio with gpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.024547Z"},"links":{"cited_paper":"/paper/2310.04673","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:739f1710fe74dcee47c94c5f991be71db1ada4b1916d5d6c6aeba0c2ed216071","observation_id":"5ffb8d62-ec18-4574-8387-0ea3b3aaf67b","resolution":{"observed_at":"2026-08-07T13:21:55.024547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-07T13:21:55.108083Z","title":"Speechgpt: Empowering large language models with intrinsic cross-modal conversational abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.108083Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:80ab2d814788fff38a0af8392107f4bee5b82c3999c945217f90434f3b72557c","observation_id":"64d3a285-54b7-435d-a867-d5ce1688ceed","resolution":{"observed_at":"2026-08-07T13:21:55.108083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T13:21:55.142440Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.142440Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:b292dfab17ba2a3834a1590ec64c6d344e2e3346504ce7d7df204889df95e1ad","observation_id":"dce6e421-5b96-4fca-8bd1-220eb73cb159","resolution":{"observed_at":"2026-08-07T13:21:55.142440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-07T13:21:55.228659Z","title":"Salmonn: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.228659Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:45821619620d40583995072f8a53235e4efd28ef270089a1f51c577ed2144e77","observation_id":"bf6972d5-35c7-4815-98af-6ff6f7bea28f","resolution":{"observed_at":"2026-08-07T13:21:55.228659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10446","last_updated":"2024-01-19T01:29:27Z","snapshot_observed_at":"2026-07-06T17:17:39.686362Z","submitted_at":"2024-01-19T01:29:27Z","title":"Large Language Models are Efficient Learners of Noise-Robust Speech Recognition","version":1},"cited_work":{"arxiv_id":"2401.10446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10446","snapshot_observed_at":"2026-08-07T13:21:56.367062Z","title":"Large Language Models are Efficient Learners of Noise-Robust Speech Recognition","venue":"cs.CL","work_id":"ee77e287-b65e-4a65-8ac1-9cfe2cfca479","year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.297768Z"},"links":{"cited_paper":"/paper/2401.10446","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:5674b8b64b14d06b657e47228d230a450e25f21c018fe8763e6804c836e9c652","observation_id":"a57deff4-d3cb-43a9-84bc-d3e5a4572d49","resolution":{"observed_at":"2026-08-07T13:21:56.442307Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:55.410096Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.410096Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:b076e8c1fe8a3467e1f7456b5613cb7ce32573a4e31ff558bd82cfa0c1f5330d","observation_id":"df3cda09-c93d-4542-b72f-358a475d131f","resolution":{"observed_at":"2026-08-07T13:21:55.410096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.519249Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"be1bd5dc-9c6f-4fa1-80fa-3e99a28a8fa6","year":2017},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.512503Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:559170e76c5822424c853ca2f2ed206909f9ebf557ccff06e8e86842a54b148d","observation_id":"18d76233-6b98-4f60-9ddc-9d63fcecd696","resolution":{"observed_at":"2026-08-07T13:21:57.610902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:21:55.624992Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.624992Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:382e638b04887d24acb924cb541697bfcfa9600aa5dd84ac82c6a37c87b8fe41","observation_id":"c35e9cc8-1456-46a2-ba53-d2ad84fada4e","resolution":{"observed_at":"2026-08-07T13:21:55.624992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-06T00:42:36.144034Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-07T13:21:55.701464Z","title":"Funaudiollm: V oice understanding and gen- eration foundation models for natural interaction between humans and llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.701464Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:e8e9796641d4ef81073b612187473d8191d856931ce16871f4e7bab379fe9dd0","observation_id":"34ac81e1-f341-4ee5-9e05-db94371956fc","resolution":{"observed_at":"2026-08-07T13:21:55.701464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.365729Z","title":"Advanc- ing stuttering detection via data augmentation, class-balanced loss and multi-contextual deep learning,","venue":null,"work_id":"03dfa1ee-5f60-41e2-9506-35fdae5b4290","year":2023},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.742878Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:67c2a8fe0c438f3ce84355206589bdaf96da74fbdc587a3ef8d28306ca274df5","observation_id":"33cd1905-2201-4417-b11e-011407ae6963","resolution":{"observed_at":"2026-08-07T13:21:57.433262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-07-06T09:20:55.416309Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-07T13:21:55.806950Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.806950Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:7bc453e2081f281711d794fd12cdd716f74702a9c8b7a96f328741ba477c93c4","observation_id":"823371dd-2fe8-497f-bf8c-80c1fb16fbab","resolution":{"observed_at":"2026-08-07T13:21:55.806950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:57.209374Z","title":"Sep-28k: A dataset for stuttering event detection from podcasts with people who stutter,","venue":null,"work_id":"fb94ed80-a440-41d4-a66e-d2586ed5ab02","year":2021},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.864302Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:6b78e7afee583dab4a76fd0b46a9d77487f1c150cbb590903271be36b3ea5b3c","observation_id":"1d6768a8-2688-4c1f-a76c-3f61f9617ed7","resolution":{"observed_at":"2026-08-07T13:21:57.279130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2204.03417","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:21:56.153725Z","title":"Detect- ing dysfluencies in stuttering therapy using wav2vec 2.0,","venue":null,"work_id":"0889d60a-1afa-4e86-ab5e-d735c74d05fd","year":2022},"citing_paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:55.953111Z"},"links":{"citing_paper":"/paper/2505.22005"},"observation_digest":"sha256:74cb22454386deca7b971a83573c393f0bc8d6fc20d502363ab413921acffae7","observation_id":"c652d8c5-0f7e-43b7-9f6f-74e4e714713f","resolution":{"observed_at":"2026-08-07T13:21:56.258641Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22005","last_updated":"2025-05-28T06:12:19Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T13:15:19.844451Z","submitted_at":"2025-05-28T06:12:19Z","title":"Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":5,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.22005."}