{"as_of":"2026-08-07T15:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45343d1ed7477274db9e0a2b52147ed3377fcdc1e1175dfafc09b3df4e138237","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T09:25:37.858857Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T09:25:37.858857Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05060","snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Direct observation of articulation provides the most reliable evidence of language-specific temporal patterns","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"cited_paper":"/paper/2607.05060","citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:dc6550feb9d42419ee29b6cc3d29d412a1e353b580e9e1c7d5322b9d0a059e90","observation_id":"8e465409-4a66-4b1a-99d5-e416cca9234e","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.05060/citation-record","integrity":"/paper/2607.05060/integrity","json":"/paper/2607.05060/citation-record.json","paper":"/paper/2607.05060"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05060","snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Direct observation of articulation provides the most reliable evidence of language-specific temporal patterns","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"cited_paper":"/paper/2607.05060","citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:dc6550feb9d42419ee29b6cc3d29d412a1e353b580e9e1c7d5322b9d0a059e90","observation_id":"8e465409-4a66-4b1a-99d5-e416cca9234e","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Dataset description and pre-processing 2.1.1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:4072e3dbc04763d6bb9c74050de2eb29d1c8a897444196f466d10757b932a3f5","observation_id":"ffdb0acc-7d61-459c-8d34-3b81b6ca9398","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"It’s seam ore Sid","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:1cb134d731ac5ecdc3c9322366811083d88f63236e459abac9dcc9ef1cdf47dc","observation_id":"90932b2e-aaa2-46ef-9fc2-485a1ceab97d","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"We developed an SI system capable of simultaneously estimating oral tract variables and three source features, and evaluated its performance on both English and non-English speech","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:7affb14c368506f9fe770028c32ff2b043418db1e175a3a64b5c77692025d1f5","observation_id":"fc83a8ed-36f4-43d2-bf49-b403b3fa4589","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:97562415f32db40fc4e467731407ab04dd01e0344e70c1cd83a1f93c1855aa4f","observation_id":"2de90b4e-fb3b-4039-a324-98702024ef72","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:15b154824ede5af2a2992e65716f5f9c28df4cdea3afd4efa902138be0af9c62","observation_id":"0684dbd2-8f96-4588-9dc0-183c5428f4b0","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Inver- sion of articulatory-to-acoustic transformation in the vocal tract by a computer-sorting technique,","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:e6887467747630bb912b2e04244c1dec5efe9013ac17741326e18b57f81a93fb","observation_id":"ed63d173-7097-481a-8986-7fdcba46d7a6","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"A cross-language study of voicing in initial stops: Acoustical measurements,","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:2cfe4d85f56c0bc814f426b9ac1f771faa7ce7cccb2d432dd1e48cd5985e36ea","observation_id":"a68ba0af-3a00-419f-8d0d-5c4fcd01bb67","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Towards an articulatory phonology,","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:7da4788bbbd26ebe02ff27c66364c7b5afa6befe725702407faa28bbf2e3ccc9","observation_id":"c01b32da-97a6-48d6-8a30-51d6a18e28a9","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"A dynamical approach to gestural patterning in speech production,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:0ff8a14ef378b78ce909b340b700a28af917bdbbc9cf629bcd25181b6145070d","observation_id":"02667a47-cc15-4390-bab1-4c2f35d0ade5","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Phonics: A large phoneme-grapheme frequency count revised,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:6cc15bc887386abf4e5551083c3464552dee21e98b3155543f320a592298b44a","observation_id":"aa2d0a25-d075-4574-b85f-b4374e598097","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Speaker-independent speech inversion for recovery of velopharyngeal port constriction de- gree,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:54c2ef07d5d9fae1447218779ee5b7c4e7537b34450ec28746e5000e3348965f","observation_id":"2b162086-9367-42c0-b4f6-937725450f13","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Enhancing Acoustic-to-Articulatory Speech Inversion by Incor- porating Nasality,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:af788a951c773ad11e94dd932427d297c195de459e7e11b3e9f9942ac03384bf","observation_id":"2bdf1b17-ca7e-4cc1-ab26-4cefe58217da","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"The secret source: In- corporating source features to improve acoustic-to-articulatory speech inversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:4f2a39e72c90901cf7213dd51bafdf3cb8214c8ccfe3a3faf71c76d7d0d7b1b6","observation_id":"d16d2245-91f0-4aa8-9625-3d3a9aa58679","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:ff7fe9fbd812a62e6f89b692d94c980e84815277ced9b83ff6ec708dc3f60739","observation_id":"a1580ea0-6068-4e00-a443-248225f7702d","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:f1e8924f44a8091e9bba69542d4f851befc7d73b10ce07dbf5020bf4609bc037","observation_id":"5ece7ed0-880c-4c20-b057-1e1151a78066","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:9ffe1f6a7a97589f50f4ac1c334b4fda68e664ef90c692febe055423fd9755e6","observation_id":"cbe4d814-6bdf-4d58-9e58-2fcee79e482b","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Exploring self-supervised speech representa- tions for cross-lingual acoustic-to-articulatory inversion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:4e3f1cdbfe82031fa6b951d20187887960d7e2b50ed4a02f8aaed17fed8db19a","observation_id":"f8e577ec-79c3-4ff4-921a-a7e7445e42ec","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Ev- idence of vocal tract articulation in self-supervised learning of speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:53b1eb5762491fd03bc383bfafaa6a1fafc05044b1a96569264914fb67a49475","observation_id":"e6f5372c-7189-4751-90a1-f84c6995e1cc","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09489","last_updated":"2025-09-11T14:24:40Z","snapshot_observed_at":"2026-08-07T07:24:50.770532Z","submitted_at":"2025-09-11T14:24:40Z","title":"Acoustic to Articulatory Speech Inversion for Children with Velopharyngeal Insufficiency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09489","snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Acoustic to articulatory speech inversion for children with velopharyngeal insufficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"cited_paper":"/paper/2509.09489","citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:d978992756c2012083561ddc309e21946803154f9a1194581d140a4c446455ea","observation_id":"5b4025aa-d007-4d71-b2b4-0cf5d61e5845","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Unsuper- vised acoustic-to-articulatory inversion with variable vocal tract anatomy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:85afe82126b1f4594264af714db91fc025fae40129f0c3573f19250d0cbe4f2e","observation_id":"9f0a9d15-8165-43cc-a395-2736f028896e","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Speaker-independent acoustic-to-articulatory speech inversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:ed46a4e208e6801d11e5f0c8b945273fa860c80615a990efb03445194b8fa033","observation_id":"493a99ca-5924-442a-adfc-f12acb5933c5","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Towards noise-robust speech inversion through multi-task learning with speech enhancement,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:b235aa2d65e7e5890b814e8db299c24a1f6c14f4a3e79eeba734ca7e2969daea","observation_id":"c0af621f-bf63-4f88-9c21-b12d0b923001","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Analysis of acoustic-to-articulatory speech inversion across different accents and languages,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:6843c467d90b258334e24059f1e4cf2d3657f988fc847d2a87e3a0f3b75c0a87","observation_id":"2ad87304-7f56-4c13-9092-379c2c1d5eac","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Speech production database user’s handbook,","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:5e3960bd9aa88df28f5bf06947204cca907ebc74064b8ac338dd3f773586866c","observation_id":"795fa331-6ac9-4354-839c-2ca5e25d1ff5","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Improv- ing speech inversion through self-supervised embeddings and en- hanced tract variables,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:267a35feb716941a450bff0bef7d82a36bb39866c665babd7f47b79b4f9c5906","observation_id":"a9c2c0b1-2392-477b-b18e-32905ce94662","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:25:37.858857Z","title":"Use of temporal information: Detection of periodicity, aperiodicity, and pitch in speech,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T09:25:37.858857Z"},"links":{"citing_paper":"/paper/2607.05060"},"observation_digest":"sha256:c30f857fbef3b33cc5223ff0f430899385bfb991faae2779484b5a26a24374da","observation_id":"b1f0f962-d361-4e9e-8e41-43fa3810b264","resolution":{"observed_at":"2026-07-11T09:25:37.858857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.05060","last_updated":"2026-07-06T13:31:43Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-04T12:35:51.065260Z","submitted_at":"2026-07-06T13:31:43Z","title":"Towards Language-Agnostic Speech Inversion"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2607.05060."}