{"as_of":"2026-08-18T04:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:679bc31a97d38e60e5b07941e22e4e41ca75f5dbce6e85f41f9a556305c8cfbb","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:54:03.608907Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:17:33.387816Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T16:46:13.422790Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"cited_work":{"arxiv_id":"2412.11538","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11538","snapshot_observed_at":"2026-08-11T16:46:13.422790Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","venue":"cs.CL","work_id":"46c812a4-f944-44c8-bb84-3f2774c35ac0","year":2024},"citing_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-08-15T13:23:21.388081Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T16:46:13.266950Z"},"links":{"cited_paper":"/paper/2412.11538","citing_paper":"/paper/2412.09818"},"observation_digest":"sha256:f78c841bc160bd09471fb864a2cfe60bf9bad7d2235adce87ab0775430ab24ac","observation_id":"182a10d3-e2cd-4229-b0a4-b2f98b646234","resolution":{"observed_at":"2026-08-11T16:46:13.428799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11538","snapshot_observed_at":"2026-08-15T20:17:33.387816Z","title":"Towards a speech foundation model for singapore and beyond,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13338","last_updated":"2025-06-03T04:11:48Z","snapshot_observed_at":"2026-08-17T21:15:08.318382Z","submitted_at":"2025-05-19T16:47:46Z","title":"Contextual Paralinguistic Data Creation for Multi-Modal Speech-LLM: Data Condensation and Spoken QA Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:17:33.387816Z"},"links":{"cited_paper":"/paper/2412.11538","citing_paper":"/paper/2505.13338"},"observation_digest":"sha256:021502437e0ae2b41ea0a7aa4f6d736438b59ef7a953a538c8f51fbbfbb227ea","observation_id":"79ba7230-e884-473a-bbec-18385fee75db","resolution":{"observed_at":"2026-08-15T20:17:33.387816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11538","snapshot_observed_at":"2026-08-01T03:52:17.191324Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23027","last_updated":"2026-07-25T03:59:26Z","snapshot_observed_at":"2026-08-17T15:54:10.306256Z","submitted_at":"2026-07-25T03:59:26Z","title":"Singlish, Can or Not? Fine-Tuning and Evaluating Zero-Shot TTS for Singapore English","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T03:52:17.191324Z"},"links":{"cited_paper":"/paper/2412.11538","citing_paper":"/paper/2607.23027"},"observation_digest":"sha256:b48cc9e8981a3f5f2418dd7e164ee4bd7a87b9bf3e36d3de36e62571dce0adc9","observation_id":"93bb33b1-2b2b-4e3c-bdcf-fa1dc5c147f1","resolution":{"observed_at":"2026-08-01T03:52:17.191324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11538/citation-record","integrity":"/paper/2412.11538/integrity","json":"/paper/2412.11538/citation-record.json","paper":"/paper/2412.11538"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.085412Z","title":"Ardila, M","venue":null,"work_id":"a4d79c4e-cd6d-4817-a330-d543a4ae7436","year":2020},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.428365Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:d6f8a8be9d8ad9c3692a886b054461ff5a4d0ae6e559757e8c1e04651c46abc8","observation_id":"2a5058fe-c1d6-4efb-9a32-b29f81f92af8","resolution":{"observed_at":"2026-08-11T14:54:04.089243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.073986Z","title":"Press release on S ingapore’s national multimodal large language model programme, 2023","venue":null,"work_id":"7f25580b-3bfd-4ed7-ae6f-7a364b51e808","year":2023},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.436067Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:030a9f1acd73c41cd1b1b1dd24cabcda0ca117565e2f3af081febf02141b0685","observation_id":"fedc1814-1396-4d7a-af33-a0e04ef3f90d","resolution":{"observed_at":"2026-08-11T14:54:04.078560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.063042Z","title":"Baevski, H","venue":null,"work_id":"c536dc5f-1fc3-4176-b8a7-6ccd7e037550","year":2020},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.447376Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:43c36574e5d2000e2b0ae9fe725430c75bf8f1173cdb09c842d6bf5ae1c01c51","observation_id":"d301e4b0-1b59-40b8-b589-e6b114b2c967","resolution":{"observed_at":"2026-08-11T14:54:04.067146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.052802Z","title":"Baevski, W.-N","venue":null,"work_id":"cec8ded9-8b13-40fa-a80c-15a073cb9545","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.452690Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:9680be457f129c273f2086c71c70ad3b13aa4beb6d066a3ae5e7191e6c2769bd","observation_id":"9c458ea1-2520-41f5-bdae-b9dbaf766948","resolution":{"observed_at":"2026-08-11T14:54:04.056243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.043276Z","title":null,"venue":null,"work_id":"76e544fd-d56a-4083-bf86-9dadabc42c88","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.457872Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:21761bc1c344fa54cfab19cf610b2a61bb4436565a2e2bce7faca3bf27217efa","observation_id":"589f3033-b643-48d4-b129-4ace7542876f","resolution":{"observed_at":"2026-08-11T14:54:04.046498Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.034046Z","title":null,"venue":null,"work_id":"7df86e07-36ee-4695-a136-6774a2772037","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.462074Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:f99bda91bb7521c2296bfbeb580bc7108f4de707000bf1c3c6745e3b401fe7f1","observation_id":"7ed279ed-ce75-4e0e-8ce6-a620dc9d5b38","resolution":{"observed_at":"2026-08-11T14:54:04.036820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.025182Z","title":null,"venue":null,"work_id":"494e1ffd-a255-4fc4-9602-1d6d89bdf8da","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.468230Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:a91bff9bb2f40022294841f3d682c91c9dd7edd46e9fce498192178365ad0456","observation_id":"1d97c774-6f33-44a5-b829-80e3177f5755","resolution":{"observed_at":"2026-08-11T14:54:04.028221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.016293Z","title":"Devlin, M.-W","venue":null,"work_id":"bfddc5ce-f6ce-42de-909f-4d58f94236aa","year":2019},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.473741Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:9e2ccc8566faa4c07e4b2c5c7097b017f8aa8182f0fbc8e7d186cc321ae431bf","observation_id":"1100cf5e-ae9e-4c45-a18f-789bc3701fe6","resolution":{"observed_at":"2026-08-11T14:54:04.019621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:04.005893Z","title":"Galvez, G","venue":null,"work_id":"b8815aa3-c645-464d-880a-23cf147968b8","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.478284Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:9183988c112e95cb975a9a51f94ef0d5ce64851a80ad647249b9f0cf089dd921","observation_id":"854a9f42-8cd5-4ee0-8d92-8fa114a9bf65","resolution":{"observed_at":"2026-08-11T14:54:04.009604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.995049Z","title":"Graves, S","venue":null,"work_id":"b7150562-f7bd-4877-898d-a8cd5c85ee8a","year":2006},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.482729Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:be209893951a7553170b5bf94f36102e3cac99efd86dd27689cb2c6db2a90fee","observation_id":"85e7be77-1098-4006-a933-f3cdb015ac65","resolution":{"observed_at":"2026-08-11T14:54:03.998619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.984041Z","title":"Gulati, J","venue":null,"work_id":"c2123e87-62eb-4e0c-b115-72057ead22d1","year":2020},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.494737Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:30f8785261c61ddc40c3b61307c542e5e54c3998cd30789ab7069cf46c9efca6","observation_id":"3dc7e5f8-51f9-45eb-9025-34be0d934339","resolution":{"observed_at":"2026-08-11T14:54:03.988046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04699","last_updated":"2019-06-13T17:35:04Z","snapshot_observed_at":"2026-08-14T19:16:07.367882Z","submitted_at":"2018-05-12T11:06:47Z","title":"TED-LIUM 3: twice as much data and corpus repartition for experiments on speaker adaptation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04699","snapshot_observed_at":"2026-08-11T14:54:03.503159Z","title":"Hernandez, V","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.503159Z"},"links":{"cited_paper":"/paper/1805.04699","citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:0f0cba206f252a1baace4b18fb11c1046524ad616d2922159c26219bb1cbbb91","observation_id":"5f9e548a-8845-4620-bf50-d77bd58627fe","resolution":{"observed_at":"2026-08-11T14:54:03.503159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.972235Z","title":null,"venue":null,"work_id":"0fe08946-8e96-4fff-9957-d1e2936721bc","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.508018Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:82dd9e92c046110f941b0f60190a7a21bf2c46acbe194872dcd3a689aa9b3080","observation_id":"8af130ed-4121-46e8-9540-e079f6631579","resolution":{"observed_at":"2026-08-11T14:54:03.975991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.961959Z","title":"Kahn , M","venue":null,"work_id":"e4267608-d437-4746-9d28-b706b8a44d0b","year":2020},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.512282Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:693c85930e6ed82b3052cfed79bb24d372d602531e4dba4409ccd45cbbe3e8fe","observation_id":"b1927df8-60d2-4450-b041-4b3cae73f386","resolution":{"observed_at":"2026-08-11T14:54:03.965393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.951811Z","title":null,"venue":null,"work_id":"c18bd283-efd3-4ba3-bf65-7acbadf5c9d2","year":2019},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.517813Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:82c8f082127d55d3e58eb81b2e44d5ab96bd7fead372c4ccabf3659a1ecaf26d","observation_id":"5e89d47d-4e86-4a02-81e2-c5ce40133400","resolution":{"observed_at":"2026-08-11T14:54:03.955273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.940962Z","title":"Kudo and J","venue":null,"work_id":"c5f917e9-387a-4675-9b9d-daa758a9e29c","year":2018},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.521877Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:440580351af458aa064ea176d357d7a2a75e69e6db242485189a15f4c287113a","observation_id":"00ae69d2-d00e-4eb7-8ffd-e48ea6976673","resolution":{"observed_at":"2026-08-11T14:54:03.944993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-08-15T13:23:21.388081Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-11T14:54:03.526578Z","title":"MERaLiON-AudioLLM : Technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.526578Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:3507fa278a78bf57d8db065348d089a159f70c755c67e13625e78119ff84b8b9","observation_id":"5cf7520f-7c90-46d6-900b-fb300ad6ecd2","resolution":{"observed_at":"2026-08-11T14:54:03.526578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.929696Z","title":"Mohamed, H.-y","venue":null,"work_id":"018d0675-f350-4a5d-8c8d-14caf8af5a25","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.531609Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:17a0969955fd30bdc78da2ea7376a88e322a4f6c96e2be3a114ca826c1dca144","observation_id":"1318e31c-056a-464d-a308-51ba71d88002","resolution":{"observed_at":"2026-08-11T14:54:03.933813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.910494Z","title":"Whisper text normalization, 2024","venue":null,"work_id":"9571b124-bc50-4368-80a8-d0d344f09197","year":2024},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.535358Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:86caf25a0af19ad1856ca2a01febd3e253d278764cb72fc0880030c349ffdcdc","observation_id":"f07656bd-00dd-4c7e-8cf1-5aca6aa4cb7e","resolution":{"observed_at":"2026-08-11T14:54:03.914997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.896288Z","title":null,"venue":null,"work_id":"9b544b49-182c-4d2e-ad3c-6df95d9a8884","year":2019},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.541222Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:865912b38be6a02dc5e18a9725865ca7a8eb75543875a22b7fbf3ca3f7605528","observation_id":"52eb9f22-a949-4bad-b8b3-840bc520188a","resolution":{"observed_at":"2026-08-11T14:54:03.901840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.883423Z","title":"Panayotov, G","venue":null,"work_id":"584dabfd-fc8b-4ccd-8b4f-4b8d58a63990","year":2015},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.545236Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:40e49b1418f09b92de1b0ee873b3c5fae395fa857e33eb0ac1fd20e027008874","observation_id":"af6b2098-f1ac-4c06-9735-e844f1e486b1","resolution":{"observed_at":"2026-08-11T14:54:03.887532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.872014Z","title":null,"venue":null,"work_id":"0e076d1b-c39f-4ddb-839e-88c874c4b58a","year":2019},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.549299Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:be001a47793492c1e43baf981ec0b7644dab8743ecd9418236a6c9a5ebefc74e","observation_id":"bc48800e-2513-4c30-8b1c-3291f27216a7","resolution":{"observed_at":"2026-08-11T14:54:03.875979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.860872Z","title":null,"venue":null,"work_id":"0275b6c4-c042-4fec-b91f-66ff77a63a41","year":2024},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.553061Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:77d8dbe146ac5090e91026de4aee3ffbb73a24dc0803c7d54867ca245cb01424","observation_id":"352d8048-27ac-4314-9d61-3b51c46e7da7","resolution":{"observed_at":"2026-08-11T14:54:03.864564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.847862Z","title":"Pratap, Q","venue":null,"work_id":"a5a71005-e4b4-4961-bd06-0c903a5cc9e0","year":2020},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.556428Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:6b2d808f86029bf5853cb0ea65285bc17b189ed0dcbe388cad26e5ae59eff98a","observation_id":"c2988822-f443-4be2-a33f-570961d61cc0","resolution":{"observed_at":"2026-08-11T14:54:03.852633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.833877Z","title":"Radford, J","venue":null,"work_id":"fbedb5f0-d8c2-4ad5-9413-c33e49566021","year":2023},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.559767Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:1c33e2d900193e1bb523079fb7be9fcd0c043f2e39e1b5dac740c1e380d08da3","observation_id":"ddc6634c-7bb7-4340-a000-718c373d8dc2","resolution":{"observed_at":"2026-08-11T14:54:03.838912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09841","last_updated":"2024-04-16T14:55:13Z","snapshot_observed_at":"2026-08-16T14:00:48.202348Z","submitted_at":"2024-04-15T14:48:43Z","title":"Anatomy of Industrial Scale Multilingual ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09841","snapshot_observed_at":"2026-08-11T14:54:03.564208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.564208Z"},"links":{"cited_paper":"/paper/2404.09841","citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:f70c57e5202c35383460db8f4714e47f18e196e89f2023983486723538b205a4","observation_id":"b9aa80ae-b6a1-4bb2-9c66-2d4d0eb8137d","resolution":{"observed_at":"2026-08-11T14:54:03.564208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.567890Z","title":"Schneider, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.567890Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:cfa49802536ce776a59d69bc0d4f522f74aee7e64ac366fe8886f3a2daba5b53","observation_id":"ceb9f9f3-17fa-4b49-b95d-e0573df6e276","resolution":{"observed_at":"2026-08-11T14:54:03.567890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-08-16T13:36:42.713695Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-11T14:54:03.571131Z","title":"Seed- ASR : Understanding diverse speech and contexts with LLM -based speech recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.571131Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:bda0e3644d91138cb833a15a239b91cc16b39f432d2a040880c9952d24f0a286","observation_id":"cb05912a-b141-4d17-b5f9-69cd95bac048","resolution":{"observed_at":"2026-08-11T14:54:03.571131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.575631Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.575631Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:298ee5bf74ed493a79a34d31746578aaefd497de18ae915f6d19269aaeec7b37","observation_id":"af1788ad-d2fa-4253-b2ed-8730c584b7a2","resolution":{"observed_at":"2026-08-11T14:54:03.575631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.813844Z","title":"Tsai, H.-J","venue":null,"work_id":"3023e4f5-495e-40b3-8845-e2b3addbe9b6","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.579965Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:1d8e575010e0d3cfe61034e8fe3b7ffa2da24b0c65edd565ccad501b7af31e49","observation_id":"dfae3660-88da-4440-91da-7c52134b1fe2","resolution":{"observed_at":"2026-08-11T14:54:03.820283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.786110Z","title":null,"venue":null,"work_id":"80529305-4385-4706-9447-309b66f81f1c","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.584023Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:37f28bb668bc24f32e088c015b7147b2de110cd572bbd9117fe5fa2b800e1285","observation_id":"88cacbb9-d1a2-41cc-bdbb-56ed8081686c","resolution":{"observed_at":"2026-08-11T14:54:03.795265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.768672Z","title":null,"venue":null,"work_id":"b62fb076-09c1-42e8-9ea4-bad811fd0021","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.588359Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:51762a4dd9de63e68b86c97b37b6bd4c087882f74823437762a0a8937f316029","observation_id":"709681fb-8c02-4ca5-8094-d738f1339dc7","resolution":{"observed_at":"2026-08-11T14:54:03.773852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.592713Z","title":"Watanabe, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.592713Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:65bc730fe03d6fd6eab31fcf9b3d4674fddaac7262ca7b3cde3e2b9d5876a65c","observation_id":"01f84539-6d40-45cc-9daa-1795aafa3260","resolution":{"observed_at":"2026-08-11T14:54:03.592713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.757277Z","title":"wen Yang, P.-H","venue":null,"work_id":"09671d05-000a-4aaf-beb4-a40219516f75","year":2021},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.597114Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:d611f387044e731b5d818fc28216d724a870fd9b6da67622da4a9046d0d9c86e","observation_id":"3d5db902-e59d-43ce-8541-6ea2c0c6badb","resolution":{"observed_at":"2026-08-11T14:54:03.761504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:54:03.741333Z","title":null,"venue":null,"work_id":"6d4ba5fb-f918-450e-acfa-1b4bd257f818","year":2022},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.601459Z"},"links":{"citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:32b254501943f629073a97694285b78c1647df9a6148fc820f0a6a0186f2cb57","observation_id":"962076cf-0253-49c7-bd6e-bdb8c55259a4","resolution":{"observed_at":"2026-08-11T14:54:03.746012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-16T15:51:28.593814Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-11T14:54:03.608907Z","title":"Zhang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T14:54:03.608907Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2412.11538"},"observation_digest":"sha256:17a42b593dc81c92b61a637c9cd9d9d270b630220a66c1e52272b387843c725f","observation_id":"8681b32d-13cf-451b-b5e2-6e019b1ef023","resolution":{"observed_at":"2026-08-11T14:54:03.608907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.11538","last_updated":"2025-09-11T05:26:13Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T07:55:28.523537Z","submitted_at":"2024-12-16T08:15:19Z","title":"MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2412.11538."}