{"as_of":"2026-08-23T21:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e780b66ca201e281fc76e86b8d1642c2587aaf249cff6358858119cc8f279be0","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:11:27.706804Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:11:23.363233Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T16:11:27.887446Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"cited_work":{"arxiv_id":"2507.14346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.14346","snapshot_observed_at":"2026-08-06T16:11:27.887446Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","venue":"eess.AS","work_id":"8db25337-6179-44ab-a2e7-a94569e0ec54","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.363233Z"},"links":{"cited_paper":"/paper/2507.14346","citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:b669b468ba088db937981b374fd0895c747ed135d9d6d3a34bf2a50a32d4a21e","observation_id":"b57a0b26-1b00-4841-bd3b-a7e7986a89eb","resolution":{"observed_at":"2026-08-06T16:11:27.995366Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14346/citation-record","integrity":"/paper/2507.14346/integrity","json":"/paper/2507.14346/citation-record.json","paper":"/paper/2507.14346"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"cited_work":{"arxiv_id":"2507.14346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.14346","snapshot_observed_at":"2026-08-06T16:11:27.887446Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","venue":"eess.AS","work_id":"8db25337-6179-44ab-a2e7-a94569e0ec54","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.363233Z"},"links":{"cited_paper":"/paper/2507.14346","citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:b669b468ba088db937981b374fd0895c747ed135d9d6d3a34bf2a50a32d4a21e","observation_id":"b57a0b26-1b00-4841-bd3b-a7e7986a89eb","resolution":{"observed_at":"2026-08-06T16:11:27.995366Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:36.531727Z","title":"IY\" -> EY","venue":null,"work_id":"5ddce5d8-7cb5-4065-9d94-7db74bac8701","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.486227Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:61b80c2ea550b4c5c2a1d701036cb1fba8850f9a3989d2bc57d0ea25facc60da","observation_id":"5830f874-a55f-442b-b5d6-59e865314753","resolution":{"observed_at":"2026-08-06T16:11:36.696419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:36.224291Z","title":null,"venue":null,"work_id":"a9682d89-5214-4d23-abc9-87914b631848","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.513222Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:1965a597e603867a40449d42ee4da9a44122863c97f877a519c04d700f4f78f2","observation_id":"38a57385-bd05-450b-8502-7491dd6528ea","resolution":{"observed_at":"2026-08-06T16:11:36.342379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.896548Z","title":null,"venue":null,"work_id":"a4711c48-5371-4da1-869d-c3c515e926d7","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.616074Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d0696a4dcddc2d172adb87a2928a74768d23666c780f7aa35ad36af4ab533246","observation_id":"2b655271-ac77-4785-ad4c-ba366eb7c910","resolution":{"observed_at":"2026-08-06T16:11:36.023868Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.681947Z","title":"Results show that modeling similarity significantly improves transcrip- tion accuracy and sets a new benchmark for phonetic error de- tection","venue":null,"work_id":"e8893b0e-66b0-43c8-985e-54a37d4aad02","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.720646Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:ffbb0cfbac239dc8490b64898e6370ae4d2196664c5a3368ae6b153b8f7934b4","observation_id":"afd95ea0-b772-4047-92c4-4467a9d811fe","resolution":{"observed_at":"2026-08-06T16:11:35.758305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.500250Z","title":null,"venue":null,"work_id":"19933d1b-20dd-48d3-a109-842d0de7816f","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.787342Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:f9527fb0428ca05dd2bd6e049344f7b32c15480feff90cc199210cafa9bccad6","observation_id":"a875ab72-21ae-4514-9ddc-5c3bfbd54e86","resolution":{"observed_at":"2026-08-06T16:11:35.586845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.307829Z","title":"Automatic pronun- ciation assessment - a review,","venue":null,"work_id":"12af0e09-0418-4a77-b978-5022cea0dc6d","year":2023},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.862641Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d2cf674513759eb7b01ded3f04f4b60a69ce7c1955979cf5c66d4255733e8dfb","observation_id":"1ef68f02-7df0-42f2-a5cf-42eea1d5b01c","resolution":{"observed_at":"2026-08-06T16:11:35.393881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.158104Z","title":"Automatic pronunciation error detection: an acoustic-phonetic approach,","venue":null,"work_id":"b004e2aa-ca01-4efe-9b8e-e60c8eacd43c","year":2004},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:23.962092Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:fba8c92773687a74b6935c70f40e293632cee361b35ee3b160cc4bad5580b51d","observation_id":"792d09a7-5227-4c52-ae5f-0d1d706f4a34","resolution":{"observed_at":"2026-08-06T16:11:35.223248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:35.002859Z","title":"Ssdm: Scalable speech dysfluency modeling,","venue":null,"work_id":"677d92e0-e0d7-4fbf-8007-05be1daa0e7d","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.046097Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:ffc0bffffd26d4b18e9594e196c78a6dbf4c5751098e0972fbfd72552a48c2d3","observation_id":"89effc48-9aad-422d-8e07-85ab0b696c4f","resolution":{"observed_at":"2026-08-06T16:11:35.064619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:34.833254Z","title":"Language-independent methods for computer- assisted pronunciation training,","venue":null,"work_id":"9c9fe264-3498-4b6b-991d-cb09b04a5d00","year":2016},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.117580Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:eeac542ddb057c07194e09297e012cf82544945eab3d80d89bae97cd468b4d2b","observation_id":"3b9426fb-a46d-4ded-b78e-93dd77344946","resolution":{"observed_at":"2026-08-06T16:11:34.922351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:34.619926Z","title":"Chatgpt,","venue":null,"work_id":"9bbbc365-5bbe-48c1-a3f0-82f5002e251a","year":2022},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.209218Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:bed8765db3c13693127afa8d177133deac9f9d2f4b9b22f3c3f0480ca3bc7178","observation_id":"040f7061-0455-4646-8476-355be2538b1f","resolution":{"observed_at":"2026-08-06T16:11:34.706827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-20T13:09:54.981053Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13577","snapshot_observed_at":"2026-08-06T16:11:24.285128Z","title":"Wavchat: A survey of spoken dialogue models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.285128Z"},"links":{"cited_paper":"/paper/2411.13577","citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:580a61f9aca04f4c2493413e0ec6f595c4621d0625afde6e9d78dbd34a93445f","observation_id":"f140ba98-4637-4a27-b434-b70b112dc254","resolution":{"observed_at":"2026-08-06T16:11:24.285128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:34.448784Z","title":"Dynamic- superb phase-2: A collaboratively expanding benchmark for mea- suring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":"80544e66-9863-4087-8d1a-eb774044f48b","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.411569Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:2d6b4635b6f57091ff57b854d13d4e30732cdf559b717e366fdd9ccf3a5f37b6","observation_id":"a2254d64-3e53-4886-ab35-c0585e8bb024","resolution":{"observed_at":"2026-08-06T16:11:34.543016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:34.272360Z","title":"The im- pact of allophony versus contrast on speech perception,","venue":null,"work_id":"6a187b80-0b0a-4fcb-8ade-7abad250ba74","year":2008},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.503966Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d57ef95bb6bb1e691de67e419306275ef798e3a6b340e467eb70d14e29547e99","observation_id":"bf4a0c0b-574e-425f-9af2-04eacde5aeea","resolution":{"observed_at":"2026-08-06T16:11:34.336906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:34.077058Z","title":"Duolingo: Language learning app,","venue":null,"work_id":"f152c104-0f31-44d0-9e64-20eb7d766cab","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.619542Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:79c5cc3ce7e4c98952f75cdc25b95b64f1302d91e3a04e83ef896757bfd16e1e","observation_id":"e6518053-541c-4d43-8157-7f661e2e85c9","resolution":{"observed_at":"2026-08-06T16:11:34.166229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.927693Z","title":"Speak: Ai-powered language learning,","venue":null,"work_id":"845a9e16-c548-4179-8a43-3ffb88bc101e","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.706284Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:2656408711a7a170947fff80d5400d8aeaa5e7761211fc24235b90fa187dbe07","observation_id":"27465e18-0bf5-401d-a4ef-bbb67ad43e23","resolution":{"observed_at":"2026-08-06T16:11:34.000032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.754221Z","title":"Gpt-4o real time,","venue":null,"work_id":"d37fcb4f-b369-4160-9139-4a9324324f4e","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.781025Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:83ea881ec2537cc63c017592953cfe0d160760e6c5eb6d98dce6956cf7d210ad","observation_id":"5d9b0048-3c7c-4810-a193-b6189b8ef8c3","resolution":{"observed_at":"2026-08-06T16:11:33.828592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.577332Z","title":"Improving mispronunciation detection with wav2vec2- based momentum pseudo-labeling for accentedness and intelligi- bility assessment,","venue":null,"work_id":"3b062df7-86a3-45d1-b426-5aa64ee6c7d3","year":2022},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.817307Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:c67df5af29cfd0d284d908696f9d05581ff5bc6517de49d4140ff420c4dadf0a","observation_id":"0c405a6d-7280-47b8-852b-5dc12fb248d4","resolution":{"observed_at":"2026-08-06T16:11:33.650158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.407048Z","title":"Unconstrained dysfluency modeling for dysfluent speech transcription and de- tection,","venue":null,"work_id":"0abb4509-cdb5-4f3b-b1c3-c5988b794002","year":2023},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:24.917861Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:ca3b06d3bc8e411fa9a508435750ac6892b29af9f67f24737c21aeb3808c4945","observation_id":"461fe418-7ae1-4ef5-98d8-10099a9ca1c2","resolution":{"observed_at":"2026-08-06T16:11:33.492553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.215643Z","title":"Towards hierarchical spoken lan- guage disfluency modeling,","venue":null,"work_id":"96f11116-3c38-4311-9b7a-34bf9c228650","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.034748Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:74f8c6bc6e2c045f64d4b9af2f4ae51647833cefde3bc98558c8521487179ac3","observation_id":"1ea51f34-0d18-4138-b38b-36e552a79891","resolution":{"observed_at":"2026-08-06T16:11:33.311826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00265","last_updated":"2024-11-29T21:39:21Z","snapshot_observed_at":"2026-08-19T17:29:40.142615Z","submitted_at":"2024-11-29T21:39:21Z","title":"SSDM 2.0: Time-Accurate Speech Rich Transcription with Non-Fluencies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00265","snapshot_observed_at":"2026-08-06T16:11:25.165013Z","title":"Ssdm 2.0: Time-accurate speech rich transcription with non-fluencies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.165013Z"},"links":{"cited_paper":"/paper/2412.00265","citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:3a55f9044327a8af0293925d090acf42494921b07d5baa87b24b6b98f30eca23","observation_id":"02cb38b8-b50b-4f95-954f-51845d3705e2","resolution":{"observed_at":"2026-08-06T16:11:25.165013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:33.025850Z","title":"Yolo-stutter: End-to-end region-wise speech dys- fluency detection,","venue":null,"work_id":"6cd3ade1-d4fb-4240-a89d-dec66ab6a4be","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.277599Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:809485a5df6ce85ad737cfa8bc623a87694746354ff5d132d6cea2f420c0e479","observation_id":"ac8335a9-fb6c-4666-9ef8-081545776fc4","resolution":{"observed_at":"2026-08-06T16:11:33.110131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:32.847867Z","title":"Stutter-solver: End-to-end multi-lingual dysfluency detection,","venue":null,"work_id":"35a06b42-7e55-417e-b641-5c4ac99589d9","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.390532Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:2f7f7f029d74cfb5530aa9331eaa3a1b2f648fd5054f2ed3e93c2eeead882884","observation_id":"155ccc52-53b8-4f2c-80ac-7d5d24befa0d","resolution":{"observed_at":"2026-08-06T16:11:32.934363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13582","last_updated":"2024-09-20T15:35:32Z","snapshot_observed_at":"2026-08-18T03:33:41.966114Z","submitted_at":"2024-09-20T15:35:32Z","title":"Time and Tokens: Benchmarking End-to-End Speech Dysfluency Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13582","snapshot_observed_at":"2026-08-06T16:11:25.462128Z","title":"Time and tokens: Benchmarking end- to-end speech dysfluency detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.462128Z"},"links":{"cited_paper":"/paper/2409.13582","citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:1d682b305bba660531e575b22e6165cd5b376b0268ffde3c825bdc3379b255bf","observation_id":"3ed2b57a-8054-4940-9497-98eab39e7f61","resolution":{"observed_at":"2026-08-06T16:11:25.462128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:32.679972Z","title":"Analysis and evaluation of synthetic data generation in speech dysfluency detection,","venue":null,"work_id":"533df42a-e027-4eab-bb35-3c1b42f5d447","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.532345Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:cd9758721c4dff9c1591271c9c07cedb86dc1077302007343c2e6be9889d5233","observation_id":"43d54441-6100-4d1a-8b79-2a4a3decb31f","resolution":{"observed_at":"2026-08-06T16:11:32.760483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:32.527389Z","title":"Dysfluent wfst: A framework for zero-shot speech dysfluency transcription and de- tection,","venue":null,"work_id":"c89d7ab8-dedf-41dc-a08b-d3283a6ffa30","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.605821Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:24d0622fb55a563ae713a795de7de57ce184ba12099de374e067cbb0024eb57c","observation_id":"21de2cbb-b063-4964-b5c8-2fe56e03293e","resolution":{"observed_at":"2026-08-06T16:11:32.603613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:25.704480Z","title":"Seamless dysfluent speech text alignment for disordered speech analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.704480Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:2b09847f38965fd13910e42d110f6474e3c819a8dd3878a02d526d22db406518","observation_id":"1fe8ad07-eed6-46f6-9e77-9c634034eeb5","resolution":{"observed_at":"2026-08-06T16:11:25.704480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:32.322116Z","title":"Automatic detection of articulatory-based disfluen- cies in primary progressive aphasia,","venue":null,"work_id":"026d7dca-c3cb-4a1a-a7a5-835fefa637cb","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.786383Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:960005ac9ffa5e9a9555631b3817b58e65b9ffec2bbcdf0c574226b9aa8b3d3d","observation_id":"d4282bf0-e167-4399-a60c-60be0d16b175","resolution":{"observed_at":"2026-08-06T16:11:32.417138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:32.169301Z","title":"Dypcl: Dy- namic phoneme-level contrastive learning for dysarthric speech recognition,","venue":null,"work_id":"f0becd86-9365-4153-b30d-cfc1053dddda","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.860672Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:a305444d19c2af696a53e9bccd13a135cf2aa2a30d7ff07ebe773127bf6c3ea2","observation_id":"a555352d-8b0f-4078-bcb0-338499a603cf","resolution":{"observed_at":"2026-08-06T16:11:32.235835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.981680Z","title":"Leveraging allophony in self-supervised speech models for atyp- ical pronunciation assessment,","venue":null,"work_id":"bf467c08-25f2-4eab-acc1-20dd2703c5d0","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:25.935313Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:7b912e2564d809dcc891723470b61e59d76fbba7d87c8a20a0483a35338e9aa7","observation_id":"7223b6db-4667-4f8d-9249-addcd1dd3d06","resolution":{"observed_at":"2026-08-06T16:11:32.069096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.849062Z","title":"Coding speech through vocal tract kinematics,","venue":null,"work_id":"2780c6c5-512a-454a-9b8e-6203c610405a","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.018828Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:1b9542addf1f66d0505350708d637bb58674b9bae96bf9da93fa2f1a22fb7ce4","observation_id":"22f09750-5d6a-44c9-930d-2d3ab90ac137","resolution":{"observed_at":"2026-08-06T16:11:31.909225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.699613Z","title":"Multi-task learning with deep neural networks: A survey,","venue":null,"work_id":"23f6d05d-3380-4696-b91f-9e84595e487d","year":2020},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.119132Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:598fe9fd1dd9f2eb3cafa9fdbbd4a791803c2a825c66d13bade54072b01f0f7a","observation_id":"4ba13d7f-60b3-4c8b-9e42-1aad925673bb","resolution":{"observed_at":"2026-08-06T16:11:31.766763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.501361Z","title":"Sylber: Syllabic embedding repre- sentation of speech from raw audio,","venue":null,"work_id":"03b080a5-e58c-431c-84ea-76c9c319cd59","year":2025},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.213886Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d8d675ee836c68207d7c6a611bad9a98284049d98a9d5843f80d899e9117196b","observation_id":"b3248c0b-0dff-4f56-ab81-111be59624f7","resolution":{"observed_at":"2026-08-06T16:11:31.590517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.316753Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit (ver- sion 0.92),","venue":null,"work_id":"63e71715-9be2-40aa-bb65-e7a7ec5db27b","year":2019},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.314141Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:f09b114ff75ad4c64548dfad853d61ce5b9a14e370ce5cd338f5c9ad7c213d8a","observation_id":"c0de4a18-a3c1-4405-9831-57cefaa0db5b","resolution":{"observed_at":"2026-08-06T16:11:31.402105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:31.125771Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":"7b0aabec-51da-400a-bb8f-3fcf863277f8","year":2021},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.407459Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:3c5effda08e9f54084353eadb1709b8864999703a309e0d604119a718ee82a00","observation_id":"06c8fea9-bd03-42dc-86aa-5d9c0dfe422e","resolution":{"observed_at":"2026-08-06T16:11:31.215634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:30.932976Z","title":"PanPhon: A resource for mapping IPA segments to articulatory feature vectors,","venue":null,"work_id":"05e57184-206c-49f9-a29d-7870dae2668e","year":2016},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.511949Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:3ea6d8dbc131b92631ab0e80593b7db6d01aa539b9e131a60c8437d3698cafa4","observation_id":"453fe2fc-aa7f-4c84-a0c0-54e5d38a15aa","resolution":{"observed_at":"2026-08-06T16:11:31.018600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:30.675828Z","title":"Anderson, Essentials of linguistics","venue":null,"work_id":"caaa08cd-586c-4563-bf51-879c6d0ffe3e","year":2018},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.618613Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:6dbaa9d3af60ce55f7d172407bd82a57dcf645fee7fd644ea492c52cff06f598","observation_id":"324a8270-7702-4041-a9b7-70c57103b215","resolution":{"observed_at":"2026-08-06T16:11:30.801940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:30.409854Z","title":"Wavlm: Large- scale self-supervised pre-training for full stack speech process- ing,","venue":null,"work_id":"30bb7f14-393b-4144-b004-ecf4ed08997b","year":2022},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.752781Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d856d0ce036ceb2c874aa425a18d73785d8191ad20f658503c4bd93f1cc484bd","observation_id":"f56ecf2d-4263-4e44-a9b3-6e8bd560894c","resolution":{"observed_at":"2026-08-06T16:11:30.526764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:30.100624Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"7a377dea-6cc7-4c59-a3e2-8b898d100ffe","year":2020},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.850509Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:42917ca01da57ae57c76d5d80fb9c8f38de2b85d4f902b2d6552c6bbf7dbb773","observation_id":"b17cbaf4-cb9b-4eb7-b438-e4349bfd152b","resolution":{"observed_at":"2026-08-06T16:11:30.279123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:29.872264Z","title":"L2-arctic: A non- native english speech corpus,","venue":null,"work_id":"b3b7194e-fb1b-44a5-9c09-138169799de9","year":2018},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:26.955801Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:893fd9ba137c53c16a4b4b9c95339c66f04645e49c0c6f5829859cb713347804","observation_id":"b2cd2863-79f1-4ea9-840f-e50ffab5772a","resolution":{"observed_at":"2026-08-06T16:11:29.962413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:29.622456Z","title":"speechocean762: An open-source non- native english speech corpus for pronunciation assessment,","venue":null,"work_id":"8eafca01-7024-40d3-a61f-7d9365599f38","year":2021},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.049314Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:d725d99410c1543f9bd8c411bd48b3c6b41f4c2bbd4bb8be85c0b2446649aba7","observation_id":"49aa4750-27fd-40dc-bce6-1b3336d49c77","resolution":{"observed_at":"2026-08-06T16:11:29.741251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:29.357166Z","title":"Multipa: A multi-task speech pronunciation assessment model for open response sce- narios,","venue":null,"work_id":"67783fe2-ca66-431a-82b7-00ceeef9fcb5","year":2024},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.159728Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:f112cdd025eb92e3273291f690c7e70a615bc8e6efb3ba57f797d1d3a56a42d7","observation_id":"c97d5e30-60a1-4cd9-98a8-29fe6b34270a","resolution":{"observed_at":"2026-08-06T16:11:29.482384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:29.118342Z","title":"Classification of primary progressive aphasia and its variants,","venue":null,"work_id":"661af986-c32a-4581-a33f-1b6e86cecec9","year":2011},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.244746Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:a26722826ac33968c917da00bab13370427c7cd6d6cdefcb3406960bd5a186a0","observation_id":"e8fba48b-d3ea-4281-9073-bca6b5a93796","resolution":{"observed_at":"2026-08-06T16:11:29.218501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:28.908588Z","title":"International phonetic alphabet","venue":null,"work_id":"61caba89-bbac-4a4f-b1f5-e60c7b5276b6","year":null},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.315706Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:887dbf28441dce06b0d738bb708765e5b85f225cb5fc8e80b6e9d282a0e5d8fe","observation_id":"ae14752b-0482-4cf3-89b5-18de6f7199aa","resolution":{"observed_at":"2026-08-06T16:11:29.002749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:28.656599Z","title":"Deep Neural Convolutive Matrix Factorization for Articulatory Representation Decomposition,","venue":null,"work_id":"8a319227-bde6-473b-886d-6ce7891abfc0","year":2022},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.396156Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:f98f53587a1895b43e4b271ca0f04a39ec99b6d5d134c386cde238735fdd2c40","observation_id":"aed0d88a-05bf-4f8c-8a8b-bd7d8b9bf25a","resolution":{"observed_at":"2026-08-06T16:11:28.770630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:27.482426Z","title":"Articulatory representation learning via joint factor analysis and neural matrix factorization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.482426Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:6174e431f70f96019d68ec70ce237c13dbdae19652e98ae0c4155117b5d0e441","observation_id":"56781ae3-2761-4a87-8786-c8278b3d4b0f","resolution":{"observed_at":"2026-08-06T16:11:27.482426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:28.380348Z","title":"Deep Speech Synthesis from MRI-Based Articulatory Representations,","venue":null,"work_id":"e142f821-4826-443a-9f89-a955b69aff88","year":2023},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.614720Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:39f11c1aded16303c1cb75efe6f4465afe0e24c71f9408c3f78cbdee316a790e","observation_id":"78f5cef0-c460-4d63-9516-046e0b931abb","resolution":{"observed_at":"2026-08-06T16:11:28.506170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:11:28.117298Z","title":"Av-data2vec: Self-supervised learning of audio-visual speech representations with contextualized target representations,","venue":null,"work_id":"4d37a3fd-b82d-4a5d-8e3e-22e983c194d6","year":2023},"citing_paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:27.706804Z"},"links":{"citing_paper":"/paper/2507.14346"},"observation_digest":"sha256:b43eb6f0b985500e1735d052f0e31eff8f6428bd093c4d42e37ca57b8fc7c1bc","observation_id":"cd7a5999-386f-4d1b-b61f-cbc746c740e2","resolution":{"observed_at":"2026-08-06T16:11:28.242006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14346","last_updated":"2025-07-18T19:51:56Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-17T01:53:21.808406Z","submitted_at":"2025-07-18T19:51:56Z","title":"Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2507.14346."}