{"as_of":"2026-08-12T14:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d0264efcb446a157f83d5d3980999ece85b68c1e7c7f6e1a9083260fd4e83aa","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:52:36.789445Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02164/citation-record","integrity":"/paper/2412.02164/integrity","json":"/paper/2412.02164/citation-record.json","paper":"/paper/2412.02164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.861500Z","title":"Word embeddings for speech recognition,","venue":null,"work_id":"4f2c75dd-8903-4a3b-b7e3-69bfd98d7456","year":2014},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.517888Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:523f8ebca7d034e5ea90a82e84611a028c1267c5792e96236a040e5f05e0b45b","observation_id":"8e58e571-ad2e-4867-aec6-ba09744806e5","resolution":{"observed_at":"2026-08-11T23:52:37.866465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.845650Z","title":"Fixed-dimensional acoustic embeddings of variable-length segments in low-resource set- tings,","venue":null,"work_id":"3c9c1d44-e70f-408c-bada-66b0044b9cfc","year":2013},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.523124Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:07720909bcf4c09cd7d17b2bb65774ff7dbb74496d4cd33acbe1698f8df6988e","observation_id":"c5d26830-de4f-4a34-9e81-baba78c9854a","resolution":{"observed_at":"2026-08-11T23:52:37.850610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.829742Z","title":"Query-by-Example Search with Discriminative Neural Acoustic Word Embeddings,","venue":null,"work_id":"ef29e532-48ac-470c-b2ac-ce16694d7804","year":2017},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.528047Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:7c583ce336454bf325465e8308b0bd04fce2dbe30e9d8127657154d4b0c9ac63","observation_id":"961dbc2b-c940-46c3-860d-6638d3c5531e","resolution":{"observed_at":"2026-08-11T23:52:37.835217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.813850Z","title":"Query-by-example keyword spotting using long short-term memory networks,","venue":null,"work_id":"5ab399a0-5669-4733-a8ab-8d52ee2af572","year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.533230Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:ea1b2d39f1e32da46222d40a2b7891f0e5ba8df229c7f59d48f0cc486b27aab5","observation_id":"96f1df78-65e6-4f3e-a30e-356c0bfed557","resolution":{"observed_at":"2026-08-11T23:52:37.818911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.798380Z","title":"Learned in speech recognition: Contextual acoustic word embeddings,","venue":null,"work_id":"be804a6c-7ddf-427e-bb54-bd6a9a6e687c","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.538322Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:15b8746683f7067e86fa6fd59e8eafa21f155567ee220a07053620b8ebaa67fc","observation_id":"7981b7a0-470e-4946-80e5-2e7035eeed02","resolution":{"observed_at":"2026-08-11T23:52:37.803379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.782414Z","title":"Deep convolutional acoustic word embeddings using word-pair side information,","venue":null,"work_id":"4032f59e-91b9-4785-a822-7ce097664808","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.543188Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:64465685acda5acc3ef7695974ea7a3f0c6a9111c966041417dada8380b32e15","observation_id":"47208d4b-6579-44cc-962d-27d0813e7f5a","resolution":{"observed_at":"2026-08-11T23:52:37.787541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.766403Z","title":"Discriminative acoustic word embeddings: Recurrent neural network-based approaches,","venue":null,"work_id":"94da610b-0f23-473a-a439-d450d3070f9c","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.548610Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:2a9bf13daf077c02480c83f8df9e1a49d056b6718e9d83b233278ee68a070453","observation_id":"c273ef37-0b4f-483c-9bf2-6bc9718ae852","resolution":{"observed_at":"2026-08-11T23:52:37.771720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.750240Z","title":"Audio word2vec: Sequence-to-sequence autoencoding for unsupervised learn- ing of audio segmentation and representation,","venue":null,"work_id":"b64aa56d-25d5-473f-be99-b2fe0511d369","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.553280Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5e5b47414858b163f21dd06db57a746fb45ea68a5da1c3321898525c3af743f7","observation_id":"a5a1ab38-d468-466f-b197-07bd0772a408","resolution":{"observed_at":"2026-08-11T23:52:37.755568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.733408Z","title":"Improved acoustic word embeddings for zero-resource languages using multilingual transfer,","venue":null,"work_id":"414aef58-bf3f-4446-ad7c-346d1638ffc0","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.557980Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:e41ef8ed3d936d9c8ed4b4da53d1e3a6cb4a65acf95a2af0718e2a4897be1e63","observation_id":"793ba21b-ce00-41dc-96d0-40bfbfa8655f","resolution":{"observed_at":"2026-08-11T23:52:37.738533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.717035Z","title":"Multi-view recurrent neural acoustic word embeddings,","venue":null,"work_id":"9e4a4c91-e410-44c8-8337-f066bd97faf6","year":2017},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.562656Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:8b9c668c09eb387930f40de25fd82f2bb7a85c8fe585e11bea25d527a85fc5bc","observation_id":"3981c89d-3aa3-4ead-b264-820dccb73646","resolution":{"observed_at":"2026-08-11T23:52:37.721902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.701174Z","title":"The measurement of phonetic similarity,","venue":null,"work_id":"049d4334-35ea-401d-a591-422fd2b143f0","year":1969},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.567303Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d9172e4bee66f66f97e9fbd129f03179b678c880b9543ebe8c79154cb39f903e","observation_id":"932c178b-1a84-4ba1-8a26-7d0607bde6a1","resolution":{"observed_at":"2026-08-11T23:52:37.706258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.685307Z","title":"Predicting the judged “similarity of sound","venue":null,"work_id":"9f327f79-a864-4e7c-b7f2-aaba83e0952e","year":1973},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.572487Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:0a44b82f9287e2cf02cf3f75ddac8ad97aac7f13e84627e86889b250ff6e70c0","observation_id":"0f5276f8-4eba-41be-9049-b0e81b81e549","resolution":{"observed_at":"2026-08-11T23:52:37.690159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00153","last_updated":"2020-05-10T08:29:28Z","snapshot_observed_at":"2026-07-06T09:16:45.827004Z","submitted_at":"2020-05-01T00:18:31Z","title":"Enriching Documents with Compact, Representative, Relevant Knowledge Graphs","version":2},"cited_work":{"arxiv_id":"2005.00153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.00153","snapshot_observed_at":"2026-08-11T23:52:37.094921Z","title":"Enriching Documents with Compact, Representative, Relevant Knowledge Graphs","venue":"cs.AI","work_id":"7a69479b-9118-49cb-a293-f3b40ff5b19b","year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.577375Z"},"links":{"cited_paper":"/paper/2005.00153","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:693855922c1b08c9f780cf16b5e7a9a59358987d8abd6d4b238474cf6ad9b0e6","observation_id":"52456f0f-3818-4b86-8258-cd8aa91d265d","resolution":{"observed_at":"2026-08-11T23:52:37.100792Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.670139Z","title":"What makes words sound similar?","venue":null,"work_id":"396750be-eb7f-47cc-9a74-7cd6242ae9e9","year":2005},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.582542Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:64b650aa012485d7c246096a4eb69b8255cea608ca4aabb6c4a812da9842343f","observation_id":"91497763-8264-438b-b699-d07a7abef8ac","resolution":{"observed_at":"2026-08-11T23:52:37.675237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.10329","last_updated":"2022-01-06T23:14:11Z","snapshot_observed_at":"2026-08-01T16:40:42.588891Z","submitted_at":"2020-07-20T05:33:07Z","title":"Acoustic Neighbor Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.10329","snapshot_observed_at":"2026-08-11T23:52:36.587221Z","title":"Acoustic neighbor embeddings,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.587221Z"},"links":{"cited_paper":"/paper/2007.10329","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:4c156efb924f0d915188481c64bee15fc383ff5dbc6fd199c1258253c87b8ec8","observation_id":"678be2cb-fcad-4301-9b27-c5d8236397b3","resolution":{"observed_at":"2026-08-11T23:52:36.587221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.654403Z","title":"Stochastic neighbor embedding,","venue":null,"work_id":"f81eba6d-3c1a-4b4e-8217-08d98ed4386c","year":2003},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.592494Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a6fbb1872728bd8aef7da6eed319aa0e397b29c77f3b5810b7d2e6c69763f0af","observation_id":"fd3eb34a-465d-4f16-8687-bc9299c4fa02","resolution":{"observed_at":"2026-08-11T23:52:37.659233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.638537Z","title":"User-Initiated Repetition-Based Recovery in Multi-Utterance Dialogue Systems,","venue":null,"work_id":"6f068743-8b5b-4a7c-80c8-07504e8514c0","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.597937Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:3bc227aca9bd19972203c50fc1247e007e1a29400b7897c90975de14d609e949","observation_id":"89dfb86f-5994-4681-a2f5-628b39153506","resolution":{"observed_at":"2026-08-11T23:52:37.643581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16726","last_updated":"2023-02-19T21:10:18Z","snapshot_observed_at":"2026-07-06T14:12:06.667084Z","submitted_at":"2022-10-30T02:37:55Z","title":"Improvements to Embedding-Matching Acoustic-to-Word ASR Using Multiple-Hypothesis Pronunciation-Based Embeddings","version":2},"cited_work":{"arxiv_id":"2210.16726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16726","snapshot_observed_at":"2026-08-11T23:52:37.053298Z","title":"Improvements to Embedding-Matching Acoustic-to-Word ASR Using Multiple-Hypothesis Pronunciation-Based Embeddings","venue":"eess.AS","work_id":"78289de9-e420-469f-b150-de399251caba","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.602492Z"},"links":{"cited_paper":"/paper/2210.16726","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:ad5eb6a68ba13a893037676a016627d3a04ca7a64b6468c958c5ffd4a76d7581","observation_id":"ff5a68f8-5f50-4ff4-8d0d-464e85e14d30","resolution":{"observed_at":"2026-08-11T23:52:37.059385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06062","last_updated":"2024-09-09T20:52:25Z","snapshot_observed_at":"2026-08-12T11:46:01.798902Z","submitted_at":"2024-09-09T20:52:25Z","title":"Retrieval Augmented Correction of Named Entity Speech Recognition Errors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06062","snapshot_observed_at":"2026-08-11T23:52:36.607512Z","title":"Retrieval augmented correction of named entity speech recognition errors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.607512Z"},"links":{"cited_paper":"/paper/2409.06062","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:411167515c5bbbb373b84750e8aba59832714f64591f05796ee85b9da595f05c","observation_id":"26843d59-2e2c-48fb-8daf-955c640ff8c5","resolution":{"observed_at":"2026-08-11T23:52:36.607512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.622034Z","title":"Libriheavy: a 50,000 hours ASR corpus with punctuation casing and context,","venue":null,"work_id":"f3174126-3d8b-496a-81c4-8159fa7283f2","year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.612520Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:3b090a9677804affc86ed12088f32a98e64af56e8bbc23467a330f46beb61fe4","observation_id":"9d9803a7-14d5-441f-90a0-fcdca64d710e","resolution":{"observed_at":"2026-08-11T23:52:37.627352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.605735Z","title":null,"venue":null,"work_id":"607fb4e5-a8ee-46a8-819a-31551471087d","year":2000},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.617449Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:cbc4fc707d0526ddb3a33a727b3de156c2647c29043ffc9d5161735e20ab61d7","observation_id":"52cd61b4-f27a-40af-813b-941693d5559a","resolution":{"observed_at":"2026-08-11T23:52:37.610588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.589563Z","title":"A derivation of minimum classification error from the theoretical classification risk using parzen estimation,","venue":null,"work_id":"67c55e49-dd51-4e30-a5e7-ce2b81568879","year":2004},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.622252Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:c17b517373c9506871869e6cb4d38926d403d372f0c750a12bdeec985cafd4ee","observation_id":"a28205c9-d954-4eda-a3bc-b0723bad0af6","resolution":{"observed_at":"2026-08-11T23:52:37.594391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.574213Z","title":"An analysis of perceptual confusions among some english consonants,","venue":null,"work_id":"0dbb7d52-d0fc-45a4-80f2-75bbd4d933c0","year":1955},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.627036Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:ce7cf2e9f7fed57015d05ed8671523ac32b646e916e8ba40af1016c577271f57","observation_id":"91824249-cac4-4467-8ef8-62ed874a22a4","resolution":{"observed_at":"2026-08-11T23:52:37.579516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.631797Z","title":"Low dimensional measurement of vowels using machine perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.631797Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:3b803d00646f9691ec928bf69b159c3e016d12de21f2ce24ae9853754496c016","observation_id":"6c859e2b-b47e-479a-94c7-072a18b7d764","resolution":{"observed_at":"2026-08-11T23:52:36.631797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5508.34555","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.005004Z","title":"Phonetic confusion matrix based spoken document retrieval,","venue":null,"work_id":"4f4a1a4f-4ca8-41f4-847d-862bafcab975","year":2000},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.636637Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:e88126ea93450f7858965ba407fb5f2c0a2fe97e76f98e1d1798bd7a168b0958","observation_id":"e0f3d21b-f857-4073-b1ab-fb512821e0d6","resolution":{"observed_at":"2026-08-11T23:52:37.015291Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.557958Z","title":"Comparison of parametric representations for monosyllabic word recognition in continuously spoken sentences,","venue":null,"work_id":"1137b19d-d7f8-48a0-89a3-2ba0fb912485","year":1980},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.641225Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:6584d0039eb460abcfa010032a5be9a0008b7f51a26c3350abbf2eb281ae8f71","observation_id":"d91d41b4-3912-48ac-9fcb-535e6af8c1be","resolution":{"observed_at":"2026-08-11T23:52:37.563568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.541772Z","title":"Query-by-example spoken term detection using phonetic posteriorgram templates,","venue":null,"work_id":"c2dc215c-7c0a-412d-b4b6-e375caf8081b","year":2009},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.645983Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:e2601d71a9dac8d95cecaab2c7279a2ebffa4fa08c75592e93fabff5e519f7fe","observation_id":"27a96e3d-4a45-4592-8b4d-b1d57b52655f","resolution":{"observed_at":"2026-08-11T23:52:37.546735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.651053Z","title":"Approximate nearest neighbors: towards removing the curse of dimensionality,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.651053Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:bff26936d2882d30087f2e1c55aa3132fbd157bf5cc999e1456aa2d987023a6c","observation_id":"e9888fb4-eb80-49c9-b329-8cf8feab246f","resolution":{"observed_at":"2026-08-11T23:52:36.651053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.526189Z","title":"Fast k nearest neighbor search using gpu,","venue":null,"work_id":"8c2f867c-979a-4a2b-a8f8-f14a1e8b1d68","year":2008},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.655807Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:91485a6e85da51b011dcb50dc6401b5e01aac1ce186a9ed7c0f8de5080051daa","observation_id":"b50770be-2dba-4bd4-8f24-845848250a64","resolution":{"observed_at":"2026-08-11T23:52:37.531159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.510561Z","title":"Soar: improved indexing for approximate nearest neighbor search,","venue":null,"work_id":"a7a9e88f-4232-4b8c-bb1e-5a3cebb28213","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.660615Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:ea940e9b9f839af79ca7a6e31bb4bf08d7952931f32ae3cb327155d4842018e9","observation_id":"74e1d5fa-6026-45ed-a12e-508dac367d4e","resolution":{"observed_at":"2026-08-11T23:52:37.515599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.494852Z","title":"Isotropy, clusters, and classifiers,","venue":null,"work_id":"43f60530-145d-41b2-9e48-7256be15705b","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.665386Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:f7a83bcfe4557280337661c9db34bab7d008f92af3f700382bcd34f789bb23b4","observation_id":"d6809453-8cbc-4a49-984b-f0a5cf284003","resolution":{"observed_at":"2026-08-11T23:52:37.499705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.479130Z","title":"The kaldi speech recognition toolkit,","venue":null,"work_id":"5a5423ff-5628-4f1e-9722-48dd08bd42be","year":2011},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.670128Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d4762d4d83869599681c0fd1cecbb40d88992a5601e6139c14cde202b4d10b50","observation_id":"09189140-f7e8-46b3-8695-77fa6fb8b9e1","resolution":{"observed_at":"2026-08-11T23:52:37.483921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.674981Z","title":"Paszke, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.674981Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:3dbb29d35727b3a7a72de642cc698d503b3231c2163d5e33bf40bc06cc041a9d","observation_id":"66b4722e-14af-45d5-8a54-7a4470b2760c","resolution":{"observed_at":"2026-08-11T23:52:36.674981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.450513Z","title":"The CMU Pronouncing Dictionary,","venue":null,"work_id":"5aeae121-6184-4956-9ee0-42a7c25cb6db","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.679731Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5200a80facd06ed0d20272f15a0735f1532031593b566c4ebab1e187f3e6e956","observation_id":"5f5bb6ba-329f-452b-88b3-dbb29e5ccce2","resolution":{"observed_at":"2026-08-11T23:52:37.456567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.684548Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.684548Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:62e86402265a8c6aba9e8e4ddcb6f40dec08d4ad3ff143a92b1272289bcd807b","observation_id":"4945e593-96c4-4f3f-88fe-24031bb8c7ba","resolution":{"observed_at":"2026-08-11T23:52:36.684548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.423834Z","title":"Librispeech language models, vocabulary and G2P models,","venue":null,"work_id":"9f9d3a92-56b1-4c46-bbb0-d22f09c4cbd9","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.689594Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:72abf94d04e2b29b48efc836f8e727c4a01c5e0f9693805afc5447b7d56f4de6","observation_id":"50f37b09-f190-4529-bb57-c2cd0405926e","resolution":{"observed_at":"2026-08-11T23:52:37.428995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.694469Z","title":"Conformer: Convolution- augmented Transformer for Speech Recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.694469Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a2dcfe02f6b66777bb4bbf812a3dcc83cb85c0733fb926618551f6481f6e183a","observation_id":"b9e49f12-5fc9-417d-95c9-46b7050f3526","resolution":{"observed_at":"2026-08-11T23:52:36.694469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.398719Z","title":"Bourlard and N","venue":null,"work_id":"c358947e-8934-4b63-ad56-6007b9a5df4b","year":1994},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.699124Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:990648fbdd3fb7bfc94bccbf5180a9f62daf294d34aa10a82f615ce4b620b6ce","observation_id":"13998a7a-3916-432c-bcb2-aaa22f225bea","resolution":{"observed_at":"2026-08-11T23:52:37.403549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.703871Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.703871Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:6bae21d7febd1c58ade2a94fd24a8362ad7a9cdffa650a193376e3ef3413dd57","observation_id":"ee3a65f9-ae49-4a74-98e3-43ed2e7f5b7a","resolution":{"observed_at":"2026-08-11T23:52:36.703871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.372989Z","title":"Contextual Recovery of Out-of-Lattice Named Entities in Automatic Speech Recog- nition,","venue":null,"work_id":"f45f3c3a-3612-4ad1-b201-49986a103b54","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.708660Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:6c4c67caaadd160603493b0cf15386e0daf5eec25a64734836b2d64885e74e3f","observation_id":"12ae23da-006d-4aa7-bd3d-e904434b4cd5","resolution":{"observed_at":"2026-08-11T23:52:37.377821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.357936Z","title":"Phonetic Embedding for ASR Robustness in Entity Resolution,","venue":null,"work_id":"ee55d6fd-4a1a-4514-83b1-a31e61d6972e","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.713372Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:0be019883bfd6c346e8965cc4e15fcf1db565983626005c9a1d7c8a9c81970ec","observation_id":"f293368f-5a64-4b8e-bde6-e662bd11e41b","resolution":{"observed_at":"2026-08-11T23:52:37.362875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.342242Z","title":"Computational dialectology in Irish Gaelic,","venue":null,"work_id":"c2117733-5e80-4ef1-9c38-ead07f3a41ab","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.717965Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a0187266d5cb7e4db8269b85f125ee8cf9023414fd6425698f1fcb34c1202386","observation_id":"f1409a86-b81f-476d-b93e-5f701242c7ed","resolution":{"observed_at":"2026-08-11T23:52:37.347765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.310578Z","title":"Evaluation of acoustic word embeddings,","venue":null,"work_id":"80a58321-c750-431f-b5b9-a42547e62d9c","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.727916Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a9800132a262778e8e5097e09fbc150f147a460e7aae49332789013d59821e5b","observation_id":"ed7067dc-ed27-4f18-9f63-5c28d333ee14","resolution":{"observed_at":"2026-08-11T23:52:37.315628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.294524Z","title":"Do Acoustic Word Embeddings Capture Phonological Similarity? An Empirical Study,","venue":null,"work_id":"6fea6f34-56d7-43e9-bc62-5d42b75edcec","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.732795Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:fe0d93512a7f07a021104468aa288cf38c970f8152253fd557e2662357832e26","observation_id":"e7392e12-896c-4590-adeb-7dacaad581a5","resolution":{"observed_at":"2026-08-11T23:52:37.299695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.278904Z","title":"Keyword search using modified minimum edit distance measure,","venue":null,"work_id":"ff9f40f7-4df8-44e7-b8af-1ce1a2c169cd","year":2007},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.737588Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:1f9b850771d09ac5fdd8f1d04e7ea36add33aa6b1c2370d00862dbecf0aed03f","observation_id":"535cf6ae-e44c-4f81-bd27-5311c769f4aa","resolution":{"observed_at":"2026-08-11T23:52:37.283918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.261388Z","title":"Coarticulation in recent speech production models,","venue":null,"work_id":"7135e46f-e529-472a-a08f-d54e81521a65","year":1977},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.742033Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:88261899bc178f54a143ab0eed02ab2fe2e807d3c6dd0f5b6890ecafa165761f","observation_id":"0a1a3e04-db13-482a-9547-6f70246e00b0","resolution":{"observed_at":"2026-08-11T23:52:37.268106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.244641Z","title":"ADDTREE/P: A pascal program for fitting additive trees based on Sattath and Tversky’s ADDTREE algorithm","venue":null,"work_id":"7581cd51-821f-4fd2-931d-f28332f1e88c","year":1982},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.746630Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:be24d37b4ac12d524fc99f3cd5c9a4d3fea4f1f733764f4efd3e60c0fdf66368","observation_id":"b733605f-30ec-4fc2-a5e6-043fd71f06eb","resolution":{"observed_at":"2026-08-11T23:52:37.249895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.228291Z","title":"Some acoustic cues for the perceptual categorization of american english regional dialects,","venue":null,"work_id":"7ec384d1-c144-4087-816c-1b902eec9f02","year":2004},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.751266Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:0147207ad6cefc70f07a1f4eb000569bdcba660bfc065c722f92d54a3a147b6d","observation_id":"009ac071-363f-410b-a077-d722ac2f624b","resolution":{"observed_at":"2026-08-11T23:52:37.233630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.212220Z","title":"TIMIT acoustic-phonetic continuous speech corpus,","venue":null,"work_id":"4f427a22-dafa-4ed3-ac4b-7772fed01507","year":1992},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.756189Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:625c0ef577d0a9257976a9be1e5f076aacee6f0c55d3c19055ef9ef6101e908e","observation_id":"142e6680-50f7-4a5a-9b2f-9004cbfa2cf1","resolution":{"observed_at":"2026-08-11T23:52:37.217488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.196642Z","title":"ADDTREE/P version 1.5,","venue":null,"work_id":"865f70d7-dbcd-490f-aa70-ac8f7de80731","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.760747Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:613f476b5bcda8e9134bcac5c73506ddce2c655b9f81fc6356e8e42072e7dcbe","observation_id":"15aa9e90-4783-4136-b803-07c89b1d148e","resolution":{"observed_at":"2026-08-11T23:52:37.201540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.178322Z","title":"Hey siri: An on-device DNN-powered voice trigger for apple’s per- sonal assistant,","venue":null,"work_id":"5bdc1652-8acf-41fb-a005-65bf77ba55b2","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.765570Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:80efa3c746c98f33680ef62288285d7640b7b06d029aae46e6b61c01abfec0fd","observation_id":"20708201-1ecb-438d-8bb1-9e2785b3ae6c","resolution":{"observed_at":"2026-08-11T23:52:37.184442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.161854Z","title":"Exploring accidental triggers of smart speakers,","venue":null,"work_id":"572fb3eb-6ba0-4f2b-add8-48e116f71564","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.770048Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:7d18a37277ef4ff56961088a92165a83c99a9de1129099f5ed97d0817d7d7332","observation_id":"6ea3d6f6-6342-4e5a-821e-3715f7a95ada","resolution":{"observed_at":"2026-08-11T23:52:37.166943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.145573Z","title":"Generating TTS Based Adversarial Samples for Training Wake-Up Word Detection Systems Against Confusing Words,","venue":null,"work_id":"addc4657-02f8-46ab-a367-d95655d39c16","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.774731Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:94bbda238ad88802d76b9f549c182308f60e8007cd50358146e46efc7f00a3bf","observation_id":"6ae75610-b913-42e0-9df5-7d5c82fefb2a","resolution":{"observed_at":"2026-08-11T23:52:37.150895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-11T23:52:36.779532Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.779532Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a6dee329f33935a9264993c0d7854a6bad554af27cb5c558d02047b3184fa16e","observation_id":"5da36a91-2707-4d71-9020-b9a09d291d01","resolution":{"observed_at":"2026-08-11T23:52:36.779532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.128910Z","title":"IsoScore: Measuring the uniformity of embedding space utilization,","venue":null,"work_id":"72fb3ee8-9424-4727-88e6-ace110e41428","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.784619Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5ac3ee6b658aa60def00363e438cfa4b8acd4c0ccafd8dc6c0e741da670fb8d9","observation_id":"e3c34b63-7ff4-4437-a0bd-565b41ad4862","resolution":{"observed_at":"2026-08-11T23:52:37.133960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.112403Z","title":"Analyzing the representational geometry of acoustic word embeddings,","venue":null,"work_id":"a07d0268-25db-493c-9e6d-0cd8f2820201","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.789445Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5e023ed37c4aa19a5bcc344311c44a20c8b3b70f029c006fd73da3ab4b692a3e","observation_id":"4a1e47cd-900e-476d-b939-e1312376126f","resolution":{"observed_at":"2026-08-11T23:52:37.117586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.326398Z","title":"Available: https://aclanthology.org/E95-1009","venue":null,"work_id":"4ff85aad-1585-4494-9af5-4a081256f299","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.722668Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:b8be8cc5918f092fd0a83632f9dd8d4c20c1323795fe3e64f6ffe05989c1ac46","observation_id":"ed0cd0cd-24bd-42ab-b57d-401314e9e247","resolution":{"observed_at":"2026-08-11T23:52:37.331643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-11T23:44:01.814752Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2412.02164."}