{"as_of":"2026-08-23T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a886175fdc7511ed27e202fa29184a220a0f7d56cd0675e9b46f44f256873ca5","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:14:48.470534Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.03538/citation-record","integrity":"/paper/1908.03538/integrity","json":"/paper/1908.03538/citation-record.json","paper":"/paper/1908.03538"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.779539Z","title":"English conversational telephone speech recognition by humans and machines,","venue":null,"work_id":"ae1fd4cf-ec24-49ad-a158-07c36b7a02b2","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.767500Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:ccdbcbbebb6bf56b7a04fd3b6067281822c1cdf8c94abc7d46b81513142c4e36","observation_id":"60454f41-090e-425c-a649-77ad97fddd4f","resolution":{"observed_at":"2026-08-14T14:14:50.787131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.739781Z","title":"Advances in joint CTC- attention based end-to-end speech recognition with a deep CNN encoder and RNN-LM,","venue":null,"work_id":"08273ea5-528d-47b1-a64c-6bac3e5c231b","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.775141Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:1c6b975e0af85f72b254aa8ad9df63fec8999359efd74eb896a9a83b346cb7ad","observation_id":"4bd8464f-e0e1-45ce-bb96-231cd7264821","resolution":{"observed_at":"2026-08-14T14:14:50.747821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.689996Z","title":"Deep neural networks for acoustic modeling in speech recognition: The shared views of four research groups,","venue":null,"work_id":"ae18fd55-2619-4843-a952-600a1312571c","year":2012},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.794625Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:6f9609640f43eade2dff7b9b16c44c61589989f4236c1dc804d9353f23936f87","observation_id":"43229997-a51e-463f-9818-64cc8dfd18cc","resolution":{"observed_at":"2026-08-14T14:14:50.704334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.657773Z","title":"Multi- language neural network language models","venue":null,"work_id":"0dbaef7a-06c0-4e37-bc8e-9a16b1056785","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.804962Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:b157ae3f8e76492fdc5c09c7c66d70d05cb8a249b4cc26188de59c2b633aef88","observation_id":"02e621d9-2cd4-42e2-8d6e-d19de3729050","resolution":{"observed_at":"2026-08-14T14:14:50.668554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.614352Z","title":"Composite em- bedding systems for zerospeech2017 track 1,","venue":null,"work_id":"53ada6eb-d8b6-4993-b166-3e8f4a834377","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.816098Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:7a3cbc7e4074ef0e041dac3149f17cbd050af7432070835c59d1c73ba73e4923","observation_id":"1d56cfaa-b6e0-41aa-b489-116f1a083a81","resolution":{"observed_at":"2026-08-14T14:14:50.633178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.583626Z","title":"The zero resource speech challenge 2017,","venue":null,"work_id":"6bc66c5e-3ef9-4b44-b166-b2c4cdd3f339","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.826392Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:940985989a7fac3aa88b3c15893bc81bb26f21256a8975585c5b66f14465a067","observation_id":"46da4dae-9119-4834-9e29-6c5dabf1f0f9","resolution":{"observed_at":"2026-08-14T14:14:50.593131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.542733Z","title":"Towards unsupervised speech processing,","venue":null,"work_id":"76795a3a-fc75-4971-9e43-3cfc11ea6f74","year":2012},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.837477Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:74ce39cf5e45196c4b318056a7d790388693396786942f1498aa7ee5bb5d0d0e","observation_id":"e4958f91-ca03-42e0-8f67-e018b04444c7","resolution":{"observed_at":"2026-08-14T14:14:50.552183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.508206Z","title":"Fully unsupervised small- vocabulary speech recognition using a segmental bayesian model,","venue":null,"work_id":"8cefd0d6-53e1-44c8-a1ac-9d575fe394e5","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.844788Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:48538cc246790315b8ecef7cfacb54563cd5621fee543ed2c4726ce2e6a22416","observation_id":"37009dd0-05cc-484c-9308-3427c22754d1","resolution":{"observed_at":"2026-08-14T14:14:50.516160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.477866Z","title":"The zero resource speech challenge 2015","venue":null,"work_id":"01f8d133-9700-42d6-971b-7906d83c11a0","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.857093Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:6fc1562613b3f954693d58c297b5cd4a5da1270b34c5fdf4fc2b7268c6e23f3f","observation_id":"d37c9f40-6d82-4b0f-a924-1cd3aa325db4","resolution":{"observed_at":"2026-08-14T14:14:50.484883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.441723Z","title":"Unsupervised bottleneck features for low-resource query-by-example spoken term detection,","venue":null,"work_id":"cc2777ee-76d7-403e-816b-01a93a963c28","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.869064Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:d6edc68c15761eef84812e7617bbccc57ba4ff38a295ddc3fd229ef45f25f9ed","observation_id":"2206a41a-08a2-4c23-aad8-ce3d3330f6eb","resolution":{"observed_at":"2026-08-14T14:14:50.453146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.393733Z","title":"Pairwise learning using multi-lingual bottleneck features for low-resource query- by-example spoken term detection,","venue":null,"work_id":"820e58a5-0372-4f28-9e1e-532fc5757a8f","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.880798Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:763b1a0481f1abeae5fb24b31e584e19023e596212fd0346231f8b8dfe8ee87e","observation_id":"c2849ebb-c96e-4ca7-a184-c0a8b5547bcd","resolution":{"observed_at":"2026-08-14T14:14:50.408108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.359268Z","title":"Multilingual bottle- neck feature learning from untranscribed speech,","venue":null,"work_id":"951d2044-e948-4d48-a498-45ea9d907ae4","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.893463Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:080fc484f1e10e989a152a2d9776ef48d75f37a22fa707ac9e6e59971b7ebdf5","observation_id":"244f66cd-beaa-4a6d-acfd-a92ccf5f75e5","resolution":{"observed_at":"2026-08-14T14:14:50.372792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.312677Z","title":"Deep learning methods for unsupervised acoustic modeling - LEAP submission to zerospeech challenge 2017,","venue":null,"work_id":"5ac94fc8-9668-41a3-9123-bc5f84733755","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.903213Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:644d841c4d33be7c27e376ef0bce42b5529b7f8bfa64f220c2209ae68790655e","observation_id":"28a69fcb-ba50-4824-83da-5d2f04864f78","resolution":{"observed_at":"2026-08-14T14:14:50.332208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.284154Z","title":"Exploiting speaker and phonetic diversity of mismatched language resources for unsupervised subword modeling,","venue":null,"work_id":"f022b54d-a206-4a5a-9867-643b2f7e563a","year":2018},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.912192Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:6240fcdaeecedce59d4a511f5af984c17569ce0a786c0c71e6d234257012a383","observation_id":"e64599de-9d98-432e-9f67-41ee5775d184","resolution":{"observed_at":"2026-08-14T14:14:50.291497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6645","last_updated":"2015-04-20T12:35:32Z","snapshot_observed_at":"2026-08-14T23:06:39.442698Z","submitted_at":"2014-12-20T11:54:41Z","title":"Weakly Supervised Multi-Embeddings Learning of Acoustic Models","version":3},"cited_work":{"arxiv_id":"1412.6645","doi":null,"metadata_source":"pith","pith_arxiv_id":"1412.6645","snapshot_observed_at":"2026-08-14T14:14:48.676557Z","title":"Weakly Supervised Multi-Embeddings Learning of Acoustic Models","venue":"cs.SD","work_id":"7f9188f7-8a03-4957-94ad-48c7cac454d3","year":2014},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.926439Z"},"links":{"cited_paper":"/paper/1412.6645","citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f3de213326bdea0ccfa96e1f0b321c96f361bb7b30a2d19abdc2d10aef87c4f6","observation_id":"bfc8f3f6-5aa9-455f-9fee-e2a79fefd291","resolution":{"observed_at":"2026-08-14T14:14:48.682751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.240995Z","title":"Unsupervised neu- ral network based feature extraction using weak top-down constraints,","venue":null,"work_id":"6a1b9930-ac8c-4054-820f-5279aa225f9a","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.936710Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f09bee5a55dde22c6d24b6ef8e91c68245d79372c67e319944d93267fdc1809b","observation_id":"6414fa87-9e68-4a71-8c77-ec19064c8721","resolution":{"observed_at":"2026-08-14T14:14:50.253387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.04791","last_updated":"2020-04-07T20:15:54Z","snapshot_observed_at":"2026-08-14T18:01:42.558047Z","submitted_at":"2018-11-09T11:04:40Z","title":"Multilingual and Unsupervised Subword Modeling for Zero-Resource Languages","version":2},"cited_work":{"arxiv_id":"1811.04791","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.04791","snapshot_observed_at":"2026-08-14T14:14:48.618280Z","title":"Multilingual and Unsupervised Subword Modeling for Zero-Resource Languages","venue":"eess.AS","work_id":"b088da32-a005-430b-9599-61fef74541a0","year":2018},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.949659Z"},"links":{"cited_paper":"/paper/1811.04791","citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:0b37007fdd885adda9853d9c05f5ba9e82b4c52c0eaa75520046e2b0516d1590","observation_id":"9275d0f5-1af1-4457-a4d4-1609692ece24","resolution":{"observed_at":"2026-08-14T14:14:48.632093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.193678Z","title":"Parallel sampling of DP mixture models using sub-cluster splits,","venue":null,"work_id":"a8b3bca6-0aac-49e2-83f5-1b4565462576","year":2013},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.958388Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:330a389b229470c7719136dd4e67ecb88f333699eb350731c131e85488bb7d97","observation_id":"c54d43f8-306c-4b34-b980-cf366934daa9","resolution":{"observed_at":"2026-08-14T14:14:50.207708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.150106Z","title":"Parallel inference of Dirichlet process Gaussian mixture models for unsupervised acoustic modeling: A feasibility study,","venue":null,"work_id":"3453dee4-2b05-4f4a-997b-7dfef5de4771","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.973236Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:6f8cae567ede8b03789664b758dba8c3dff2ad1aea5a4beca3d7f5a76a48c00b","observation_id":"67524ff6-cf0b-41ed-b681-f0340428fedb","resolution":{"observed_at":"2026-08-14T14:14:50.168491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.088641Z","title":"Feature optimized DPGMM clus- tering for unsupervised subword modeling: A contribution to zerospeech 2017,","venue":null,"work_id":"1d311cc5-4184-407c-bf81-c55018869c4d","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.979397Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:3f705585d7aa2535b52c11594c262f9dccd8197a72f152f01c7a154b68efbf12","observation_id":"0e520354-c476-40c8-8440-1117efebca78","resolution":{"observed_at":"2026-08-14T14:14:50.101750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:50.047962Z","title":"Unsupervised speech unit discovery using k-means and neural networks,","venue":null,"work_id":"5b76cc3f-5d8b-4f56-a524-02b0fdcb253e","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:47.986968Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:34c2e3414a6a22bdb1f43f92e9f962a09b172a14aea0d52f9c53547faa710d40","observation_id":"6d28dd58-e3e9-4007-bee3-4dae51ba17e6","resolution":{"observed_at":"2026-08-14T14:14:50.057008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.996359Z","title":"Iterative training of a DPGMM- HMM acoustic unit recognizer in a zero resource scenario,","venue":null,"work_id":"25334ccb-f38d-469d-b76a-b9bf0afd3215","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.005404Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:28f17c5f6a341ecb717745958453a97a525e684311e235f085be4b3245ecf9a0","observation_id":"3dafe4a0-e13b-4775-84f1-67858f2a4d2e","resolution":{"observed_at":"2026-08-14T14:14:50.018400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.959266Z","title":"Dirichlet process mixture of mixtures model for unsupervised subword modeling,","venue":null,"work_id":"eadc0135-6713-4d41-a27a-3e20f522d76f","year":2027},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.011714Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:26c4d7371f68c75112dc3fcc6a6fba9b9cea0cf00003cb54358a9dbfb318195d","observation_id":"9d700954-c8e6-47f1-9567-8a982f210ad7","resolution":{"observed_at":"2026-08-14T14:14:49.966204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.925393Z","title":"Optimizing DPGMM clustering in zero-resource setting based on functional load,","venue":null,"work_id":"3ff97e94-d164-4ee8-bb2b-aa75f7e74252","year":2018},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.021273Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:83c5c73485b1b26f8a27b9858b071724f4f17fa34e562e2ed23283e65aa2242f","observation_id":"e4566ac2-10d5-4276-8d67-748a15dbe3d2","resolution":{"observed_at":"2026-08-14T14:14:49.934355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.029463Z","title":"Multitask learning,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.029463Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f751dbe2852b480512fb3155554c71c1d677d027085637bcdfe98d4764c7df0f","observation_id":"81a942fe-24b7-4b87-9985-311b0077a275","resolution":{"observed_at":"2026-08-14T14:14:48.029463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.866252Z","title":"Supervised learning of acoustic models in a zero resource setting to improve DPGMM clustering,","venue":null,"work_id":"3ae6210d-cc9c-486e-956d-446d146fe51b","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.047671Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f5fc46f4b7045820335995cf222bc6b7a85e6f132e8bbd032ff1f54c3a4addc9","observation_id":"1b16843a-c703-417b-b9c2-117388562327","resolution":{"observed_at":"2026-08-14T14:14:49.874572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.836171Z","title":"A comparison of neural network methods for unsupervised representation learning on the zero resource speech challenge,","venue":null,"work_id":"34fa3cf4-baa0-4f56-84e1-041f10e0b9f4","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.063841Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f2eae8d3e4a16f199c71ff15d1ff04ddd78000d35f2541fbb4e9419b9cac8d8e","observation_id":"be8cee7e-e053-4ca6-96d4-ec7737926881","resolution":{"observed_at":"2026-08-14T14:14:49.844901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08810","last_updated":"2019-09-11T08:31:08Z","snapshot_observed_at":"2026-08-14T17:26:01.114750Z","submitted_at":"2019-01-25T10:10:12Z","title":"Unsupervised speech representation learning using WaveNet autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.08810","snapshot_observed_at":"2026-08-14T14:14:48.076184Z","title":"Unsuper- vised speech representation learning using wavenet autoencoders,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.076184Z"},"links":{"cited_paper":"/paper/1901.08810","citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:7c80d0f35596275fba96e4e9941854bad42b178dbb9cd02bab1d297e04f52c88","observation_id":"553e01f0-9429-4114-9638-3dc954b0afdc","resolution":{"observed_at":"2026-08-14T14:14:48.076184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.793373Z","title":"Extracting bottleneck features and word-like pairs from untranscribed speech for feature representations,","venue":null,"work_id":"f478b523-e7f2-4885-919f-c2b7d5312211","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.093366Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:ead9034a6731526e0a2756a6cde604fff3fbd2e86508adad5344c9c7b83eedfb","observation_id":"9af17fc6-06d3-4210-aafa-dd6b5a5721c8","resolution":{"observed_at":"2026-08-14T14:14:49.805340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.758047Z","title":"Multitask feature learning for low-resource query-by-example spoken term detection,","venue":null,"work_id":"5200c055-2c3e-4c59-9646-21de91ed3190","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.113076Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:7afe538c1f9cf9548733a7994463a0bb80e2a95cf13e1d45eb41cbd0e084692c","observation_id":"5801e005-e111-4917-ad9b-07df0f2f85ae","resolution":{"observed_at":"2026-08-14T14:14:49.770204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.716684Z","title":"Speaker invariant feature extraction for zero-resource languages with adversarial learning,","venue":null,"work_id":"cb6cb9b8-52c2-41c3-bb38-dab3aabae8c1","year":2018},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.131579Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:4d7cb6fdecbc98a4c9a67cad80ec523f4e5d3157ab1903245d09456593b0d49a","observation_id":"39fd7743-a238-4044-a729-7294f7c8a335","resolution":{"observed_at":"2026-08-14T14:14:49.728511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.665499Z","title":"Unsuper- vised HMM posteriograms for language independent acoustic modeling in zero resource conditions,","venue":null,"work_id":"80750f85-76a7-4ba4-ac1f-02794d65d4d9","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.153939Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:fd5a6d0630570bc598465970439c2a02353266ec4d9f47e2e4a9478fc083485a","observation_id":"ae305bf1-8995-4a23-8299-9a84ffe4249a","resolution":{"observed_at":"2026-08-14T14:14:49.674650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.609965Z","title":"Unsupervised optimal phoneme segmentation: Objectives, algorithm and comparisons,","venue":null,"work_id":"cfe384c3-83ea-4e07-90c6-553378407973","year":2008},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.175372Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:8db888e8db9cbba6dd02411e94ea818a33451a7a85c89abca50a2bc39270daa1","observation_id":"27497a6a-02d6-4678-87db-ec17ef1da139","resolution":{"observed_at":"2026-08-14T14:14:49.627045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.567513Z","title":"Exploiting language-mismatched phoneme recognizers for unsupervised acoustic modeling,","venue":null,"work_id":"c9e4e8f3-5cba-4f3c-a075-bcd5e726ef43","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.189383Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:e5bc67def94b0dcbd032a07fe775eb1711addcbfbccefe73455626842553d8d9","observation_id":"90e77e77-3be3-4e32-ad6d-ce1c6b36416c","resolution":{"observed_at":"2026-08-14T14:14:49.582126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.525757Z","title":"Unsupervised pattern discovery from thematic speech archives based on multilingual bottleneck features,","venue":null,"work_id":"dc99e134-7d7c-4e60-b5c1-06bc83f283e9","year":2018},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.199175Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:a9df3f5c1e86dcb5973b415c9e6c64356306203e9a8498afe280594a7efa4a18","observation_id":"e42ebaeb-7a2d-4f24-b93b-d2f8857d2852","resolution":{"observed_at":"2026-08-14T14:14:49.542495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.494452Z","title":"A segment model based approach to speech recognition,","venue":null,"work_id":"4c7f9bb6-c726-4004-8996-fd4059b4f8c7","year":1988},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.213312Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:f003499f896277c204142af2f2e4db8d6bb221a2344387390b43c82ccd871109","observation_id":"8b478dbf-cb35-4f2b-a021-a20167ab3e70","resolution":{"observed_at":"2026-08-14T14:14:49.504907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.453597Z","title":"A segmental speech model with applications to word spotting,","venue":null,"work_id":"64766055-5cc3-4b59-b27a-01f24ad48577","year":1993},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.220353Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:126f11145c2f30731d11591f6350c0dd013a00b3f4ac49ed1525d5a9d2f732ce","observation_id":"01db069f-b743-4add-85aa-c4186d6a81ad","resolution":{"observed_at":"2026-08-14T14:14:49.460878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.405178Z","title":"Acoustic segment modeling with spectral clustering methods,","venue":null,"work_id":"c1c64729-2092-4721-800a-81784594d1cb","year":2015},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.226821Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:8e33e42f59629f6654fbd25eddfecb24e06ba6498dba512fb12c2a580ad6eeaf","observation_id":"c16d779e-4495-449e-87f8-9023ad773f0b","resolution":{"observed_at":"2026-08-14T14:14:49.416917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.354468Z","title":"Unsupervised speech signal to symbol transformation for zero resource speech applications,","venue":null,"work_id":"bf4d9ad3-b9b5-47d3-a2ba-00437f496b7b","year":2017},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.233380Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:cd2dde82a5b7552ce603a76b8c25bc6426fd11702bf2ddbfa2235bba3b3061b0","observation_id":"00d6d7de-d26e-4782-8c01-7dd100151ec1","resolution":{"observed_at":"2026-08-14T14:14:49.379285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.306966Z","title":"Unsupervised word segmenta- tion and lexicon discovery using acoustic word embeddings,","venue":null,"work_id":"1afd733f-9a79-4679-a0c4-8d8a8231b464","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.251280Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:55242f7787869209ef01a86f448e2e7d66b949e8d5b69e5eb68d0fa3dc4697fe","observation_id":"d713f791-ceb0-471b-a421-4c8b2236be36","resolution":{"observed_at":"2026-08-14T14:14:49.318084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.265864Z","title":"Economie des changements phonétiques,","venue":null,"work_id":"65defe12-b3e5-48b8-ab61-64364e476cfe","year":1970},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.265757Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:5de2dcdbc2acb1624ad7daace3a74dd91749f52552c373e1bef192d8b142a85b","observation_id":"ff93fa8f-822c-4ccc-a1d7-7e45a412312c","resolution":{"observed_at":"2026-08-14T14:14:49.277072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.231452Z","title":null,"venue":null,"work_id":"c93aacb2-d3dc-4f6a-9ad8-d9d87ab13fc8","year":1955},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.274311Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:dcb30dbbb86e3c7e1ca3e646344911a4547ab5dc8d89e5c422353c6bc656dd8f","observation_id":"6a4dcbd5-79b2-4c33-beae-1917320e975e","resolution":{"observed_at":"2026-08-14T14:14:49.244790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.187334Z","title":"Unsupervised linear discrimi- nant analysis for supporting DPGMM clustering in the zero resource scenario,","venue":null,"work_id":"cc0bb58d-a910-4b21-ac41-e7986fbfd848","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.285168Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:c101f337fdc10566e868c52538391a54d3de786c10a50918aa06d05964c3bce3","observation_id":"2c9d04e5-e523-4e3e-82ca-918660c8a5b8","resolution":{"observed_at":"2026-08-14T14:14:49.199120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.147197Z","title":"Investigation into bottle-neck features for meeting speech recognition,","venue":null,"work_id":"b46fe73f-4520-4df0-bd9c-39a422fefdc6","year":2009},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.305268Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:9be0ce5347820ed373a4c0192b6136176e900129bbcbdddd8db8887bf8d8b409","observation_id":"18cac076-6b78-432c-bc41-d92af7d324ce","resolution":{"observed_at":"2026-08-14T14:14:49.161754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.111069Z","title":"Long short-term memory recurrent neural network architectures for large scale acoustic modeling","venue":null,"work_id":"8f1d8009-f96b-449d-9392-439bc51d37f4","year":2014},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.343439Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:1ff30d2abce733c37bd9a4dfc495db398d5c9310415f63e6e8597d3ed84ae5d9","observation_id":"7b76183a-7197-40f4-a85c-10e67c8ccdb8","resolution":{"observed_at":"2026-08-14T14:14:49.119035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.064525Z","title":"Hybrid speech recognition with deep bidirectional LSTM,","venue":null,"work_id":"33571e3a-9db3-44b3-8758-31a412202332","year":2013},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.357643Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:95dfc8511f9aa12738cb33026de290afdfa38e786bab3d9d0577e61baac0de22","observation_id":"56eeaa0c-4bee-4536-a754-50a3577a8e91","resolution":{"observed_at":"2026-08-14T14:14:49.073129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:49.025094Z","title":"Unsupervised cross-lingual knowledge transfer in DNN-based LVCSR,","venue":null,"work_id":"7b1c7163-904f-4ccc-a8a3-81436a2d1132","year":2012},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.372712Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:3744f5ddc27a5a2a9725eb678eff7e28933fb83562bbb5e7453f58408d15d6c7","observation_id":"57b66d74-0aa2-4b09-86e8-5000b2fcc75f","resolution":{"observed_at":"2026-08-14T14:14:49.037579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.984124Z","title":"A deep scattering spectrum-deep siamese network pipeline for unsupervised acoustic modeling,","venue":null,"work_id":"70273e2a-2783-4261-ae51-864b5effb623","year":2016},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.379547Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:2ea4f1da466cdc5a1adcc6cb34419774a1559a1b9ea747788ea3885f309c060a","observation_id":"c2296650-d9f1-4638-9871-260348b4be37","resolution":{"observed_at":"2026-08-14T14:14:48.997746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.943347Z","title":"Spoken language resources for Cantonese speech processing,","venue":null,"work_id":"26d3f32c-c415-4c54-8f84-ea6aadc8e0b7","year":2002},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.400734Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:76c390d5d1dfa011dbadbb3056d6a366d3f6fd0e9da14f93ea368504009692b3","observation_id":"1e58dae3-5d6a-4345-9a51-6b5725ab714e","resolution":{"observed_at":"2026-08-14T14:14:48.956323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.904965Z","title":"The Kaldi speech recognition toolkit,","venue":null,"work_id":"e1e31c5b-5bb9-43fb-8550-9653b0b417b2","year":2011},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.412041Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:4a89ae76cc4648cd9daeb1772bed2fbc3d56e95fb0f20a47f0cea42539934dce","observation_id":"efeda8f3-240e-4a76-b0af-c71f815f5d00","resolution":{"observed_at":"2026-08-14T14:14:48.912278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.863228Z","title":"SRILM – an extensible language modeling toolkit,","venue":null,"work_id":"7487c3ea-78fd-44e4-86a0-2cd6bb859f89","year":2002},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.428702Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:ca87abe6b4f3200cde878564095b16c133641bf85ba241cbcd402d99eade9371","observation_id":"4fef218e-5c69-44ee-b7ac-7c7eeb472a12","resolution":{"observed_at":"2026-08-14T14:14:48.875894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.817474Z","title":"Phoneme recognition based on long temporal context,","venue":null,"work_id":"6d7014ce-da6d-456a-9007-5ae4a8842bdb","year":2009},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.441387Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:af8f2a8847cc165eac2c9db92bf558c0264dbcd1e6553ee9e448e1666a6e1ba2","observation_id":"730adb89-f116-4558-9e59-cbecb485b02d","resolution":{"observed_at":"2026-08-14T14:14:48.829386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.755606Z","title":"SpeechDat- E: Five eastern european speech databases for voice-operated teleser- vices completed,","venue":null,"work_id":"59ab140f-7620-4cf7-bf63-db14045fe712","year":2001},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.452296Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:b3ab84692c2e50b544f557be0cef8738798f7595bb0584a8262ac970ec9dc823","observation_id":"88cb5a0c-36d0-4e7d-ac9f-8aef35cbec1a","resolution":{"observed_at":"2026-08-14T14:14:48.777392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:14:48.716954Z","title":"An efﬁcient gradient-based algorithm for on-line training of recurrent network trajectories,","venue":null,"work_id":"873cd086-ba46-4757-92b6-39ae31c7fc52","year":1990},"citing_paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T14:14:48.470534Z"},"links":{"citing_paper":"/paper/1908.03538"},"observation_digest":"sha256:c2034148b9c0e3c2eb6d88d92e400581d430967e57c69e2d1a53a9b72db22a7d","observation_id":"2524e276-058a-48e6-a2aa-333ea20eac69","resolution":{"observed_at":"2026-08-14T14:14:48.725796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.03538","last_updated":"2019-09-29T09:36:37Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T10:30:11.781093Z","submitted_at":"2019-08-09T16:57:04Z","title":"Exploiting Cross-Lingual Speaker and Phonetic Diversity for Unsupervised Subword Modeling"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:1908.03538."}