{"as_of":"2026-08-07T08:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e040d79e54ad9819af464b5bb99ca0649b297fb57a2a0d100a0a2e92d713416c","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:11:17.778258Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.10116/citation-record","integrity":"/paper/2509.10116/integrity","json":"/paper/2509.10116/citation-record.json","paper":"/paper/2509.10116"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-04T18:11:15.997955Z","title":"Unsupervised Cross-Lingual Representation Learning for Speech Recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:15.997955Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:208de21e125e04be7aea852e8dd71e53aa82f369c71a95bd5eb19d55c1aba834","observation_id":"28d5c376-de19-43ae-80aa-0fbd64522cbc","resolution":{"observed_at":"2026-08-04T18:11:15.997955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.063751Z","title":"Materials and Methods 2.1.1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.063751Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:fd48356b7d7b4fb45c9a0e3de588ecd98e1d53906c283773f05294d5ab5e8d74","observation_id":"d96c1d31-8c3b-4f38-bf1b-22039dff1699","resolution":{"observed_at":"2026-08-04T18:11:16.063751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.166797Z","title":"Materials and Methods 3.1.1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.166797Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:6a70c4e72418539ba4915a3947039d11609b66d9c0f292778d79e00eb8e441c3","observation_id":"308094a1-df7f-4ebc-8426-4258e4575a4b","resolution":{"observed_at":"2026-08-04T18:11:16.166797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.237830Z","title":"Table 3: Concept of character-based prominence-aware ASR training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.237830Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:9a7d74de7d949d37799e5f6d3b3199188a4c96e7e8bd46207a32f43d19b69e9c","observation_id":"e3a41006-4476-409f-8255-1ba779f93943","resolution":{"observed_at":"2026-08-04T18:11:16.237830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.55776/p32700","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:14:06.526545Z","title":null,"venue":null,"work_id":"a923cc78-cc60-435e-8c3d-ceedd3d53a29","year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.290039Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:3948ebefa190c51bec250e5bb254fc221d2b770d819aef60e583ea27f9bacdaf","observation_id":"4e9febed-2f0b-4d8c-b6b7-cff560251965","resolution":{"observed_at":"2026-08-04T18:14:06.601897Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.375193Z","title":"Great expectations - introspective vs. perc eptual prominence ratings and their acoustic correlates,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.375193Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:cf99ef0219eb1bf66958a060ba5a4bc202e5bae9fe18463de9facb466d0caae2","observation_id":"6d0deed7-0bf6-4b40-902d-a9ac84dce6e1","resolution":{"observed_at":"2026-08-04T18:11:16.375193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.435766Z","title":"ANALOR . A tool for semi-automatic annotation of French prosodic stru cture,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.435766Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:e84928b71218ad76daa61fa08272d700b85acc10080dd966dbe3455fe700e662","observation_id":"273e4e96-4044-4613-88bb-3c8325bb649f","resolution":{"observed_at":"2026-08-04T18:11:16.435766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.494907Z","title":"Automatic pros odic event detection using acoustic, lexical, and syntactic evi dence,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.494907Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:9f725f842197fefd3ba45dc0a2e5b53f3a7b95160c18495b764bc1a49cd6e6a0","observation_id":"8933b4b9-b74d-4004-a783-9e7912c960d5","resolution":{"observed_at":"2026-08-04T18:11:16.494907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.581159Z","title":"Automat ic labelling of prosodic prominence, phrasing and disﬂuencie s in French speech by simulating the perception of na¨ ıve and exp ert listeners,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.581159Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:a9b4cb0ae44f27deb95b03f7e76371d1835f5ede9ab7e026f4b9bedbc76b37fc","observation_id":"00659999-336c-465b-bffd-c540294688ef","resolution":{"observed_at":"2026-08-04T18:11:16.581159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.658116Z","title":"Using word-level f eatures for prosodic prominence detection in conversational speec h,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.658116Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:66076edef7cecd65eca7de450d0edd665c5571a35a97c8253041d6e9c81b4165","observation_id":"885c5367-ccc0-42bb-8fa5-028bab01a64e","resolution":{"observed_at":"2026-08-04T18:11:16.658116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.706923Z","title":"A corpus of r ead and conversational Austrian German,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.706923Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:52f7d56449fb5902d09ecc974e612bd192f2d0486f8f58e9cf2eb6b7aeeecd75","observation_id":"933f9211-6078-4be4-9810-5a65df1c94ce","resolution":{"observed_at":"2026-08-04T18:11:16.706923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.792268Z","title":"Wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.792268Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:a153fd8c0fd47a6dac1555592cdb574b08170b5f857a5d87d11b2717038bcb38","observation_id":"8737e2c7-935b-439b-8fc0-3d638b737fd3","resolution":{"observed_at":"2026-08-04T18:11:16.792268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.863528Z","title":"Phonemic competit ion in end-to-end ASR models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.863528Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:0cdf34e73972fc45434c311731167c18958d408ddf283bef421f940f9fe3a0d7","observation_id":"93205761-73be-4022-a3a8-2726bcf65814","resolution":{"observed_at":"2026-08-04T18:11:16.863528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.933525Z","title":"The processing of s tress in end-to-end automatic speech recognition models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.933525Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:96d1cb36adaee66d30974e902e7541c2f1a8d9369a93001987941ba18d5cdfac","observation_id":"92b3a8b1-aa0f-41d5-860d-703eb3d3bdea","resolution":{"observed_at":"2026-08-04T18:11:16.933525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.006074Z","title":"Detection of prosodic boundaries in speech using wav2vec 2.0,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.006074Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:db06f7edaa457aa2fccac139d4ce4496021104d7f55e28ad1be8521e789079dd","observation_id":"a277c3f8-09ea-4953-9a7f-ce11769fd8d7","resolution":{"observed_at":"2026-08-04T18:11:17.006074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.070603Z","title":"Unsupervised Cross-Lingual Representation Lear ning for Speech Recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.070603Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:4986285b596131e4d917895daa3c371b94e1bee6bdfa9dbe00b64f9de1ce4719","observation_id":"d25f4b1c-ebca-4877-bbf5-f253bb49e159","resolution":{"observed_at":"2026-08-04T18:11:17.070603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.128990Z","title":"What do self-supervised speech representat ions encode? An analysis of languages, varieties, speaking styl es and speakers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.128990Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:8aaef15bb7434bf59b1b01bc69e94d099ad3068276a89cf0a3276f55d8e96878","observation_id":"f82001dd-4532-4d8d-bbe5-33a02686b676","resolution":{"observed_at":"2026-08-04T18:11:17.128990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.199231Z","title":"What’s so complex about conversational spee ch? prosodic prominence and speech recognition challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.199231Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:9dc3608bd78dbc948e1de3ce61a8bd8aa2703d27f246c5208e235b5c5f7b20e9","observation_id":"4024b342-e859-44ba-a0b0-11be9f2c5a95","resolution":{"observed_at":"2026-08-04T18:11:17.199231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.301842Z","title":"GRASS: The Graz corpus of Read And Spon- taneous Speech,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.301842Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:bc887eee96d61bf4dfa2cbb7333cd629484cf240e8e3ecfb1936e37f61d52cc4","observation_id":"7b63d54f-70ad-42af-83da-c15af39fec09","resolution":{"observed_at":"2026-08-04T18:11:17.301842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.393065Z","title":"A corpus ofread and conversational Austrian German,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.393065Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:a1c1278b84626bf208b930e4c259b6f2cebc82246fa79f6e413e34f66326d26b","observation_id":"3ff1bd49-23ec-4c8c-a7c0-90d7d8d1a663","resolution":{"observed_at":"2026-08-04T18:11:17.393065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/10413.003.0011","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Kiel Intonation Model – KIM,","venue":"The MIT Press eBooks","work_id":"79dfebd3-f739-4a4d-887d-b1a15289c579","year":2022},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.450054Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:8e063f00d18b124968f3b67c0339a46457a9ab3d665f95dec0c079b08b142d46","observation_id":"123aa144-9dd1-49ba-a9df-c35b5f3f6f41","resolution":{"observed_at":"2026-08-04T18:14:06.505438Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.529695Z","title":"Con- nectionist temporal classiﬁcation: Labelling unsegmente d se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.529695Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:45687b8b0c1c8945e4a3c47e957f5f4e88d80c1af7ae597dde864dbd23c79e0f","observation_id":"8a348ad4-9572-4d1a-a656-abeb7ac539a9","resolution":{"observed_at":"2026-08-04T18:11:17.529695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06475","last_updated":"2023-01-16T15:28:28Z","snapshot_observed_at":"2026-07-06T14:41:44.663737Z","submitted_at":"2023-01-16T15:28:28Z","title":"Using Kaldi for Automatic Speech Recognition of Conversational Austrian German","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.06475","snapshot_observed_at":"2026-08-04T18:11:17.615170Z","title":"Using K aldi for automatic speech recognition of conversational Austri an Ger- man,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.615170Z"},"links":{"cited_paper":"/paper/2301.06475","citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:2d3ed222b106d6107a5dd2a5be4081f0c16af1f009b3aa301c6ab7c93c341901","observation_id":"9d1c5d41-ff8b-4f44-b819-b67f64260cc2","resolution":{"observed_at":"2026-08-04T18:11:17.615170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.695788Z","title":"KenLM: Faster and smaller language model queries,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.695788Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:097f2921f4386269c8a48235c097f5a4d48a6c28a68837771e79742c66264323","observation_id":"b6328641-e2ea-47d1-9858-3f43888e5020","resolution":{"observed_at":"2026-08-04T18:11:17.695788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.778258Z","title":"The impact of wo rd alignment accuracy on audio-visual word prominence detect ion,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.778258Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:76c6a9eba84b8eba975428ccb31ce354542e4ccea813b54385b0af5b0b238ffc","observation_id":"62d573f7-20b8-4fb8-be94-815464d72c2c","resolution":{"observed_at":"2026-08-04T18:11:17.778258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T08:32:45.373984Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2509.10116."}