{"as_of":"2026-08-11T08:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:99e2ce7f3f2fd2f66e6636bcfe7c90f080fb085cf12700cc000cde53a91832ca","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:02:02.635185Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T14:49:22.776209Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"cited_work":{"arxiv_id":"2501.06562","doi":"10.48550/arxiv.2501.06562","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.06562","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discrete","venue":"arXiv (Cornell University)","work_id":"5668d699-c985-412f-ae2f-fc164889cbfd","year":null},"citing_paper":{"arxiv_id":"2605.01381","last_updated":"2026-05-02T11:08:10Z","snapshot_observed_at":"2026-08-09T00:23:18.733056Z","submitted_at":"2026-05-02T11:08:10Z","title":"A framework for analyzing concept representations in neural models","version":1},"reference_index":177,"source":"arxiv_source","source_observed_at":"2026-05-09T14:49:22.776209Z"},"links":{"cited_paper":"/paper/2501.06562","citing_paper":"/paper/2605.01381"},"observation_digest":"sha256:7acfb055f2ec83290551c31d922dc3845205f37743cd383218acfc3ebd706ccd","observation_id":"882b1881-ea33-4024-8f84-1f53e32f7341","resolution":{"observed_at":"2026-05-09T22:18:59.149801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.06562/citation-record","integrity":"/paper/2501.06562/integrity","json":"/paper/2501.06562/citation-record.json","paper":"/paper/2501.06562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.643993Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"0294911c-4b4c-44bb-9bba-61ac04ceda22","year":2020},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.378837Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:2d06c8fa972ed750e309a39a22b8f7829d0e92cf8aec465aee04eba8c836a3be","observation_id":"c0364648-137c-453a-b774-6ea0557c6984","resolution":{"observed_at":"2026-08-10T21:02:03.649492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.628789Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":"b01dc69b-400c-4d6f-8ddd-f3a62c7a16a6","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.385435Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:1bd7c724c775624a9ad6c1fbf0025e41b9dad3295777f32d6f945ad58effced3","observation_id":"2d45a6be-3c8f-429a-8a13-49015854e918","resolution":{"observed_at":"2026-08-10T21:02:03.633585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.613380Z","title":"WavLM: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"5a427172-b4fc-4fd6-8318-17e7d888d546","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.392226Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:04c7616620ec9e26816317ba568d39669f3e9da040858bb3866162c811a23c3b","observation_id":"a805ba30-5422-4c3a-b5ad-60983e452fd9","resolution":{"observed_at":"2026-08-10T21:02:03.618603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.597652Z","title":"XLS-R: Self-supervised cross- lingual speech representation learning at scale,","venue":null,"work_id":"4429b6bd-2a48-4873-b8e6-50d645e89693","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.398817Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:6de864e386aac4c2fa200ea35573f6f62d86e721499fccb12df159d663dcd45e","observation_id":"4d9fe0a9-0143-4a3c-9257-63b8c60adf85","resolution":{"observed_at":"2026-08-10T21:02:03.603057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.581796Z","title":"SUPERB: Speech processing universal performance benchmark,","venue":null,"work_id":"d8ca4fee-879b-47b9-a625-5e1a40064e94","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.404775Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:f02bb17da60cad64b7180ae01c0dc7e7f7bdb54071f4b119d354b8a5a62c596c","observation_id":"fdeb3a42-74a3-41e2-bc4a-a905361d6af3","resolution":{"observed_at":"2026-08-10T21:02:03.587094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.565071Z","title":"SUPERB-SG: Enhanced speech processing universal performance benchmark for semantic and genera- tive capabilities,","venue":null,"work_id":"89b7b5f2-d58c-4feb-896b-5be9cfae32b1","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.411047Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:65b5de0b7c3ac49a0ccbfde31589f0035d239b8d896da3c6b8014fb4e75c9e65","observation_id":"4e7f53ad-0390-4b99-bc1e-dbdfec208951","resolution":{"observed_at":"2026-08-10T21:02:03.570508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.337547Z","title":"ML-SUPERB: Multilingual speech universal performance benchmark,","venue":null,"work_id":"27a90a14-4b7b-48c8-843b-e50d8e9ab26f","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.417013Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:c6023addc99052ecb6cd7ec9ad817c390d7681dd48b5ff3c77141176ae63d27f","observation_id":"af822a98-a8ef-4559-8ea3-25d3d9a9eff4","resolution":{"observed_at":"2026-08-10T21:02:03.342903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.321676Z","title":"Dynamic-SUPERB: Towards a dy- namic, collaborative, and comprehensive instruction-tuning benchmark for speech,","venue":null,"work_id":"19040a06-58a9-4b11-a52a-9ec708b2b5e5","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.421938Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:0c1755567934c0a1ff189fc305503a803b63bdcc540f3652e4a716e750644f17","observation_id":"d9c1e40a-15cc-40f0-a4ff-70740b10ebe2","resolution":{"observed_at":"2026-08-10T21:02:03.327481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.307071Z","title":"Layer-wise analysis of a self- supervised speech representation model,","venue":null,"work_id":"b7097e42-9d84-4f01-a5bf-15d643bb5665","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.427379Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:4b2f68349e0e2c78475b4c05b82a710c0d3e9646e065a964a38dfd23afde6bee","observation_id":"02a97dc6-ced7-4a8d-b5cb-710926c21c69","resolution":{"observed_at":"2026-08-10T21:02:03.311553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.290474Z","title":"Comparative layer-wise analysis of self-supervised speech models,","venue":null,"work_id":"8d82b648-b20b-4719-a084-ef795757d5ed","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.432009Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:ece2973abbb169f11494b4f5ab0ed007ddf7b416b424705d6eed013262ad9aca","observation_id":"a702590c-8884-417d-8733-a2c50a485f3e","resolution":{"observed_at":"2026-08-10T21:02:03.295683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.272920Z","title":"Understanding probe behaviors through variational bounds of mutual information,","venue":null,"work_id":"bdf8699a-1ff3-4ec9-9c22-c29caf471444","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.438041Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:09799a035f8cee36d4c0af75e2a7b5b68b075b308b79b00b9841628769c93319","observation_id":"cf5ea463-ded3-4c58-8034-686ed94fa5f0","resolution":{"observed_at":"2026-08-10T21:02:03.278864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15386","last_updated":"2022-10-27T12:47:35Z","snapshot_observed_at":"2026-08-07T03:34:40.754359Z","submitted_at":"2022-10-27T12:47:35Z","title":"Opening the Black Box of wav2vec Feature Encoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15386","snapshot_observed_at":"2026-08-10T21:02:02.443267Z","title":"Opening the black box of wav2vec feature encoder,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.443267Z"},"links":{"cited_paper":"/paper/2210.15386","citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:09437c0b2fa176478b0df809b7fc93ab853046bad6ad6269997ac7e5696382a5","observation_id":"0f3ba215-a710-4e1a-a203-2bd306a7ee96","resolution":{"observed_at":"2026-08-10T21:02:02.443267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.257712Z","title":"Self-supervised speech repre- sentations are more phonetic than semantic,","venue":null,"work_id":"bd5d4803-d161-4754-9f72-17ac927a8cf5","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.449432Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:554e7ff39d146e8e4f34c9fea1d8e20012a7a1713f4a063dd9ac0f3550f1422d","observation_id":"2af6915c-0df7-4f25-b7e3-c9e0d141f1bf","resolution":{"observed_at":"2026-08-10T21:02:03.262348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.241991Z","title":"The Interspeech 2024 challenge on speech processing using discrete units,","venue":null,"work_id":"11978696-7130-4510-ae96-3302af5ded36","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.454391Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:5978edc76912e3c585f01d2850a94663f07343efdc8db84a3db12a2a47c68793","observation_id":"96a18a02-598c-4511-9de0-f5605251fc3d","resolution":{"observed_at":"2026-08-10T21:02:03.247062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.225769Z","title":"Exploring speech recognition, translation, and understanding with discrete speech units: A comparative study,","venue":null,"work_id":"1a0e89a8-7bcb-41f4-b2db-d28be32e8558","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.459790Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:8e84adb911894154847f996b98bbb87a5357eb98419e34f325f88c471954c686","observation_id":"381a870c-783c-42ea-a353-4ade5126f2d6","resolution":{"observed_at":"2026-08-10T21:02:03.231080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.208612Z","title":"AudioLM: A language modeling approach to audio generation,","venue":null,"work_id":"d2e89def-d6fb-4da2-9f96-81281cb65e9e","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.465726Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:ad36734ee978daaf5db7dc49e26d07b7fef27dd0bac3e7c2034f5092ce3b89d3","observation_id":"b544d778-34b4-4a04-a9cf-9e4b0ea2388b","resolution":{"observed_at":"2026-08-10T21:02:03.214384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.193239Z","title":"Direct speech-to-speech translation with discrete units,","venue":null,"work_id":"65f7f895-e6b6-4b6e-a4ce-8ee14df9e3e4","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.470129Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:dbd598c3e71abf62d252253bb0f82cd11ab6021c6b570a1f9070044200ef38d3","observation_id":"eddb564b-fbb1-4258-943e-c0ccc6876899","resolution":{"observed_at":"2026-08-10T21:02:03.197886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.177672Z","title":"UnitY: Two-pass direct speech-to-speech translation with discrete units,","venue":null,"work_id":"63572535-aa5e-4fd6-aec0-94196fa7bfd4","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.474416Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:8dd4f7d7699c3acfec9c1f27f6d70d4d8655533db98bf5c29807292f9d21c145","observation_id":"f03f7834-4851-4af0-8761-941619f99174","resolution":{"observed_at":"2026-08-10T21:02:03.182823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-07T01:18:02.068918Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12925","snapshot_observed_at":"2026-08-10T21:02:02.479922Z","title":"Au- dioPaLM: A large language model that can speak and listen,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.479922Z"},"links":{"cited_paper":"/paper/2306.12925","citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:22f0f8dcd38d782a7df0766f47a9f6e1f19cbb12c0cafeac1284be487ba886be","observation_id":"00eb9dcd-94a7-45f6-bbbb-ca63039a3139","resolution":{"observed_at":"2026-08-10T21:02:02.479922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.161773Z","title":"V oxtLM: Unified decoder-only models for consolidating speech recognition, synthesis and speech, text continuation tasks,","venue":null,"work_id":"905e4f4a-7562-41c8-9f00-4b8ce4052d1a","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.486554Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:7d43e2c8c328796a9c45a4e6171ad4633b585b3f0605b96d823976e6bdb1c8ae","observation_id":"296f4a1c-2447-4f05-b0ac-72e144376e46","resolution":{"observed_at":"2026-08-10T21:02:03.166744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.146569Z","title":"On generative spoken language modeling from raw audio,","venue":null,"work_id":"70789378-7b2a-45cd-92bc-f18713efeff8","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.492298Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:4361c769a4e93a6c7bc850a64ca1f7acc365dd86220b35eaebee8bdb44d279a9","observation_id":"8674e8e6-290e-4514-8287-73c4dac014fd","resolution":{"observed_at":"2026-08-10T21:02:03.151364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.130972Z","title":"Textually pretrained speech language models,","venue":null,"work_id":"5384dd42-57dc-4377-8a21-24db1daa3591","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.499665Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:41025b89c983452f8859134a1bdc15e4eb59fc65b6ba32a58af1d42b5fb737ab","observation_id":"019f8d6d-e9c8-459c-b44e-35aea695f7d6","resolution":{"observed_at":"2026-08-10T21:02:03.135528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.116198Z","title":"A comparison of discrete and soft speech units for improved voice conversion,","venue":null,"work_id":"626ad5a5-415c-4c19-b298-d93fe401decb","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.504216Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:3839add54447bf77e69d1c041b4928989ed5853cea428e9f9263d4db93d052b0","observation_id":"6ee72c18-ca06-4f18-b509-cf73bfac6729","resolution":{"observed_at":"2026-08-10T21:02:03.121630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.101200Z","title":"Improved distributed principal component analysis,","venue":null,"work_id":"8cab708a-ef56-4113-9ccc-5fa79e3842d8","year":2014},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.509436Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:5336772e6e2f070b6b445063ade28834a852db6c00f6f754e703a9503896f1f7","observation_id":"b9f56245-04ff-42b5-8903-7438f30a4419","resolution":{"observed_at":"2026-08-10T21:02:03.106103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.085079Z","title":"Analyzing acoustic word embeddings from pre-trained self-supervised speech models,","venue":null,"work_id":"ec3786ab-30f6-4fe2-b3df-8e8ba8c9a527","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.515844Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:d74f30eb04d3520e7504193d573a19487f82da16eb95801ca3d261ce5fe61646","observation_id":"7267de77-45cf-4ff6-aca8-6b30b7b48565","resolution":{"observed_at":"2026-08-10T21:02:03.090301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.070419Z","title":"Wav2vec behind the scenes: How end2end models learn phonetics.,","venue":null,"work_id":"0dcede3c-25e0-4562-a371-1492e17dbccf","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.520861Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:c40f51c45c6d2be6c13d8084cfe4c2ca2426fb2736361bf65618fa805f3036b5","observation_id":"f8fd249d-4cf3-412e-a404-b32a11d55998","resolution":{"observed_at":"2026-08-10T21:02:03.074684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.054618Z","title":"Orthogonality and isotropy of speaker and phonetic information in self-supervised speech representations,","venue":null,"work_id":"6942d26b-5694-42d1-b3ee-7b19aa7d9d35","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.526924Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:a21769a7e284f031f7d4dfe77ab8a28be284d120506ab34cb2e75415bce73aac","observation_id":"a9c33b6f-d172-4839-baee-b528ede7b226","resolution":{"observed_at":"2026-08-10T21:02:03.059773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.038837Z","title":"Discovering universal geometry in embeddings with ICA,","venue":null,"work_id":"14279678-1154-44c1-8d26-d3d4f815a455","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.532321Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:0b45f686628cf25cabcaccb777ac06a3dde972f5dc45eca0803a03b00a0a67fd","observation_id":"7e7ff25f-e372-4806-97db-159e0f7111d0","resolution":{"observed_at":"2026-08-10T21:02:03.043946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.022628Z","title":"w2v-BERT: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,","venue":null,"work_id":"9d43d94c-ba44-43f6-af33-ce41e90bb95c","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.536740Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:f72a0c811d8f72b5cf7d24ec8b0d524fcf163878478ddae51be15b17bc38738f","observation_id":"d2bc8a36-6497-4969-9951-20fdc1625f13","resolution":{"observed_at":"2026-08-10T21:02:03.027819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15316","last_updated":"2021-03-29T03:51:53Z","snapshot_observed_at":"2026-08-09T13:21:21.641559Z","submitted_at":"2021-03-29T03:51:53Z","title":"Whitening Sentence Representations for Better Semantics and Faster Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15316","snapshot_observed_at":"2026-08-10T21:02:02.542788Z","title":"Whitening sentence representations for better semantics and faster retrieval,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.542788Z"},"links":{"cited_paper":"/paper/2103.15316","citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:f1e470d863380e35b627bcf6427e840629c5f0463b3c3c4d2dace9b2d06100ef","observation_id":"dd0b5da9-6efc-4298-83b5-01b6db92850b","resolution":{"observed_at":"2026-08-10T21:02:02.542788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:03.006744Z","title":"WhiteningBERT: An easy unsupervised sentence embedding approach,","venue":null,"work_id":"77262683-9b88-4e4e-8b77-f859492d9104","year":2021},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.548507Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:1d2848e188a747cf4fff650a4223fc72a1f8be19357429d1665009e1d8a920fe","observation_id":"33819647-efa5-4ac6-8a08-13986dee172f","resolution":{"observed_at":"2026-08-10T21:02:03.012433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.989175Z","title":"A review of blind source separation methods: Two two converging routes to ILRMA originating from ICA and NMF,","venue":null,"work_id":"dc183916-8c25-4f49-a407-7de27269035b","year":2019},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.554781Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:076c77353491715e70f62e666ef4ffb0063d69f4d0e9a13ad089cebfbeb54331","observation_id":"99e79a83-8853-4ea5-bc5e-970a5b61b7cd","resolution":{"observed_at":"2026-08-10T21:02:02.995547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.971648Z","title":"Infomax and maximum likelihood for blind source separation,","venue":null,"work_id":"ff5d96d2-24a3-40fb-b250-64680710fe4e","year":1997},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.560546Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:fff8d8a80ff98525065991a44d941c737cfa8d8f32597b9308021260e4ebfaf1","observation_id":"5a08eb5f-a568-4333-887e-2050cc9ad1cc","resolution":{"observed_at":"2026-08-10T21:02:02.978067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.953676Z","title":"Auxiliary-function-based independent compo- nent analysis for super-gaussian sources,","venue":null,"work_id":"18191817-7dc8-4972-b2e0-f2a7c65aa892","year":2010},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.566126Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:b5eed3d4bb4471a197062d77ce5dfb6dbb48254505fcb085c8ec498a9de4734a","observation_id":"313e837e-8402-49ea-8255-652268432024","resolution":{"observed_at":"2026-08-10T21:02:02.959294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.936009Z","title":"LibriSpeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"88341af0-c6fa-4360-950b-f169eaa3f01d","year":2015},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.570726Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:f48d6d0822cb2bec08de949be6edecf5d316c9ee393b517d3c00716ef2f402e5","observation_id":"c71ae261-522b-48c2-923e-a7d0393a43fe","resolution":{"observed_at":"2026-08-10T21:02:02.942201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.919240Z","title":"The Chi- naTelecom Interspeech2024 discrete speech unit asr challenge system description,","venue":null,"work_id":"f6cd4561-281d-46df-b775-7787867f4783","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.575883Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:dde30777bf313039426fcbfa6d0b02b64d1e049fc227c26a62ee61a3b9548f42","observation_id":"0989d395-e0e0-418a-8d02-1860897dd4ab","resolution":{"observed_at":"2026-08-10T21:02:02.924294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.901014Z","title":"Exploration of efficient end-to-end ASR using discretized input from self-supervised learning,","venue":null,"work_id":"260c4d37-7126-46e8-88dd-a463a381a7db","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.581540Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:5f86fe663e192f4f69f6b05343163e993005a26c14f4a0a891db7f2be2ffd1de","observation_id":"f0f5bedf-6ffb-41d5-8e6f-0a36bbc63b6f","resolution":{"observed_at":"2026-08-10T21:02:02.906705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.882927Z","title":"E-Branchformer: Branchformer with enhanced merging for speech recognition,","venue":null,"work_id":"8e67a985-f3e7-428e-b2e2-8ee23e30edbb","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.590529Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:82a2f79bd8c9e226862f64faa2560ea55fbfd2285404b2b8abe581f0c78c6f20","observation_id":"67da77ab-4f14-4f2a-83b4-a5cca26164d2","resolution":{"observed_at":"2026-08-10T21:02:02.888545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.863308Z","title":"Anisotropy is inherent to self-attention in transformers,","venue":null,"work_id":"d9b0ff78-30ea-4fa3-bf32-3b8b96a299d2","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.596182Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:ee8aa5df920e1f7e5f697cbcb4b5d3a588701d9856c7ff1e6087a5913343c170","observation_id":"a6096f42-d2e4-4cc7-a91e-7a16607abc6c","resolution":{"observed_at":"2026-08-10T21:02:02.869720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.841559Z","title":"Codec-superb@ slt 2024: A lightweight benchmark for neural audio codec models,","venue":null,"work_id":"1a83c1ad-1417-482e-ac2e-3d1ffbca9baf","year":2024},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.601539Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:b52ede0f04dd5b3c16dd5a8e80f188744f54998e9c31697a94947e5635e2642a","observation_id":"59e57b49-3851-41ab-83d9-b5cafb58dc3a","resolution":{"observed_at":"2026-08-10T21:02:02.847244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.821063Z","title":"Textless speech-to- speech translation on real data,","venue":null,"work_id":"473df0c7-9d49-419e-bfb9-e2d637eaded2","year":2022},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.607455Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:177f3f412ade3c01bf80e018add53f76f25e4a3cec7ec2e65050895c29a9f092","observation_id":"5e54048f-a3b0-415c-aed0-b76f886d2474","resolution":{"observed_at":"2026-08-10T21:02:02.827251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.801668Z","title":"All-but-the-top: Simple and effective postpro- cessing for word representations,","venue":null,"work_id":"9ae082ca-2cec-4bc8-926a-3d35ba2ec0c8","year":2018},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.612290Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:9476890f0c92c919ea9c53f424aa6e5d731b39a6afc482f621f9b5f83e51ed2a","observation_id":"a50a861b-6f43-4242-b0b8-9a6e57361647","resolution":{"observed_at":"2026-08-10T21:02:02.807715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.782510Z","title":"Effective dimensionality reduction for word embeddings,","venue":null,"work_id":"58e3a1ff-80b5-4cfd-8090-7c6e31c2233c","year":2019},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.619949Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:59d98290aba5b8f4982c5714fab968d3040927cbd1e5a5031ac2a03b4a353c67","observation_id":"c717632d-33f2-46e1-a2f3-62b58ae74884","resolution":{"observed_at":"2026-08-10T21:02:02.789017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.763739Z","title":"DARPA TIMIT: Acoustic- phonetic continuous speech corpus CD-ROM, NIST speech disc 1-1.1,","venue":null,"work_id":"315eaac9-9254-4e8e-b5dc-a0b0a65a91ef","year":1993},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.624804Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:fe2e33cbff611acb4aa40299f041916ed8cae985a66f107fa320df0de320b9ff","observation_id":"a18c3db3-b9a9-48e5-be0c-a3d90678e19a","resolution":{"observed_at":"2026-08-10T21:02:02.769318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.746728Z","title":"An information-theoretic analysis of self-supervised discrete representations of speech,","venue":null,"work_id":"f3e79919-9028-4ea6-b773-09cee29931f2","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.630276Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:cfcd9c0864d33149bc6eaae6ede38939061344c0a10349555c8f22d1faa1b9d5","observation_id":"3a967ef0-cd7f-44eb-a98f-3940d8c6bff6","resolution":{"observed_at":"2026-08-10T21:02:02.752454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:02.727385Z","title":"Analysing discrete self supervised speech representation for spoken language modeling,","venue":null,"work_id":"3b3657ca-2e16-4db8-a318-f4762e13466c","year":2023},"citing_paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:02.635185Z"},"links":{"citing_paper":"/paper/2501.06562"},"observation_digest":"sha256:44bb5b2bfcc33746aa4d5263d523a94790c55e755425bdc156046cb280306fe4","observation_id":"6ce35aef-67f0-4ff6-8f9b-a89a0a64bdda","resolution":{"observed_at":"2026-08-10T21:02:02.734886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.06562","last_updated":"2025-01-11T14:45:03Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-10T20:55:29.557187Z","submitted_at":"2025-01-11T14:45:03Z","title":"Discrete Speech Unit Extraction via Independent Component Analysis"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2501.06562."}