{"as_of":"2026-08-10T09:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbbd54cb1f3e2139a6d0d08deb7aa6cedf71ed989d9c3d2565d344352e37c25c","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:53:41.496527Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05359/citation-record","integrity":"/paper/2509.05359/integrity","json":"/paper/2509.05359/citation-record.json","paper":"/paper/2509.05359"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:45.079092Z","title":null,"venue":null,"work_id":"e6e18d9d-9959-41bb-b367-b5463c92c8e8","year":null},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:37.922026Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:e438e9ed7806c0208fb2252f4532f18d8ae543b3e6309ac6fa119ec440dd43af","observation_id":"80ad3410-18c5-448c-ae9f-c1244dbe26a3","resolution":{"observed_at":"2026-08-05T10:53:45.187386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:38.154093Z","title":"In: Interspeech 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.154093Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:c676d2aa66be62779f7ed6075eba34d12884e5686fdb944d5d782d49f80d21c3","observation_id":"5640e635-400b-4c07-b231-9c97e8595805","resolution":{"observed_at":"2026-08-05T10:53:38.154093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:44.552818Z","title":"In: Proceedings of the 34th International Conference on Neural Information Processing Systems","venue":null,"work_id":"facd574f-067d-4bf8-b06b-fd8d04599e55","year":2020},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.247101Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:c43aee7eef97b96c26f772d47d98ef3bcbd28022c41321993689a8ffad9fb63b","observation_id":"ea0c4831-08c4-420f-bd0c-fecfb6f48080","resolution":{"observed_at":"2026-08-05T10:53:44.715812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:44.229203Z","title":null,"venue":null,"work_id":"777d77b8-021d-4fac-b0bf-1f6c3e518ecf","year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.425445Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:003d82e19294c43c3a00afaae3d608e61f3c948bb81e37417ce3e9fed92ba3cd","observation_id":"a6ea27cd-d4f3-402c-9a64-a287893e2866","resolution":{"observed_at":"2026-08-05T10:53:44.379017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:38.553816Z","title":"In: Interspeech 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.553816Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:61ee340548aa0b8d2d192db9355feea400a84303c9c708bac287c22827aa3b5f","observation_id":"62f5a60b-48c3-4353-b217-c83efa9fc2c5","resolution":{"observed_at":"2026-08-05T10:53:38.553816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:38.674057Z","title":"IEEE Journal of Selected Topics in Signal Processing 16(6), 1505–1518 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.674057Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:7e6dddafd012b4ebf21301b11b29ffe49dd36cfc03300943965b30bb9e75d467","observation_id":"41492c5a-1960-464a-a88b-689d5407a046","resolution":{"observed_at":"2026-08-05T10:53:38.674057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.21","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"In: Al-Onaizan, Y ., Bansal, M., Chen, Y .N","venue":null,"work_id":"e735debe-f416-4643-a169-897187a97776","year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.802248Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:d9c621296fc1f35b188718012399d991b2b3252412af170a04341e02e281dd57","observation_id":"e0c0fe02-31a1-45e9-8cc5-b5d92eee7344","resolution":{"observed_at":"2026-08-05T10:53:42.249594Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09344","last_updated":"2021-11-17T19:14:40Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T19:14:40Z","title":"The People's Speech: A Large-Scale Diverse English Speech Recognition Dataset for Commercial Usage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09344","snapshot_observed_at":"2026-08-05T10:53:38.926567Z","title":"CoRR abs/2111.09344 (2021), https://arxiv","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.926567Z"},"links":{"cited_paper":"/paper/2111.09344","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:aba39ba61572c5913bbd633448ccadd0d04a3e1bfdd53ba77edc149f3cacc22a","observation_id":"11f03851-e677-4215-b44e-f17e27cdb100","resolution":{"observed_at":"2026-08-05T10:53:38.926567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13009","last_updated":"2024-01-30T11:52:51Z","snapshot_observed_at":"2026-08-07T04:29:22.486158Z","submitted_at":"2023-05-22T13:12:16Z","title":"Textually Pretrained Speech Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13009","snapshot_observed_at":"2026-08-05T10:53:39.130213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.130213Z"},"links":{"cited_paper":"/paper/2305.13009","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:985777f39e05f33b2b446de076bcf355bf533d10eaca0eadbe5ffd567a117d67","observation_id":"ab53ccd9-9878-4fb0-83c5-9de9e9bfc270","resolution":{"observed_at":"2026-08-05T10:53:39.130213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:39.253438Z","title":"IEEE/ACM Trans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.253438Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:4908e6b2220b26bb44ff3db163f6492a292126dd94783b7824922fcfa5bddfc4","observation_id":"4e099185-d1a9-4b45-9e82-ce4bfcb774a8","resolution":{"observed_at":"2026-08-05T10:53:39.253438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:43.834799Z","title":null,"venue":null,"work_id":"33ea3f17-165b-47e4-a173-7e564259f1d0","year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.368764Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:156f3d70528884fa93018878ab29415bc45fab0da39cefb986bc96a375306055","observation_id":"588fb598-50d1-4eed-bf23-16c721330d10","resolution":{"observed_at":"2026-08-05T10:53:43.997504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:43.501529Z","title":null,"venue":null,"work_id":"ecfaf129-aafc-4abc-a195-0133ea1c1d98","year":2023},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.496067Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:2dc7ffa09e5df56bad9e2cb16be3bad749abf6370d4083da8a85ad99dab7efe4","observation_id":"205651b9-467b-4b37-8d0e-d662e63fb0b0","resolution":{"observed_at":"2026-08-05T10:53:43.652048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:39.679308Z","title":"Transactions of the Association for Computational Linguistics 9, 1336–1354 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.679308Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:08bf03252579ed29fde75bd07b0691d50d21df214b3a29257c611e499e076c12","observation_id":"aa1561d6-d67e-4a25-8179-cb6f863324e1","resolution":{"observed_at":"2026-08-05T10:53:39.679308Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:43.294538Z","title":"In: International Confer- ence on Learning Representations (2019), https://openreview.net/forum?id= Bkg6RiCqY7","venue":null,"work_id":"782d6747-f29f-4fde-93e0-a021cf7dcdca","year":2019},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.841593Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:f7d4cf6376d36bff1f89656b5e19ef6ecf45c4dcff7b06647296a6f5a26aa14e","observation_id":"a26a5b94-5b90-45f3-9dfd-7c30c49d8623","resolution":{"observed_at":"2026-08-05T10:53:43.365958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07937","last_updated":"2024-01-24T15:36:31Z","snapshot_observed_at":"2026-08-09T22:48:33.736331Z","submitted_at":"2023-09-14T03:13:18Z","title":"Voxtlm: unified decoder-only models for consolidating speech recognition/synthesis and speech/text continuation tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07937","snapshot_observed_at":"2026-08-05T10:53:39.960813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:39.960813Z"},"links":{"cited_paper":"/paper/2309.07937","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:b159872bed976db9ac4f46048cd639d894d8ad3aeb3908fbd47332ec27347110","observation_id":"e27bc955-3675-4b8c-8c77-2c22286d257f","resolution":{"observed_at":"2026-08-05T10:53:39.960813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:40.175913Z","title":"In: Interspeech 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.175913Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:13b4a1d7e924021c422100de24c0758be9cf60dddb6d1b7977dcdb85fd5b26b6","observation_id":"49e21257-d482-4f1c-83ab-e2a42fb8a2ed","resolution":{"observed_at":"2026-08-05T10:53:40.175913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14294","last_updated":"2026-04-21T15:27:17Z","snapshot_observed_at":"2026-07-30T17:14:02.349402Z","submitted_at":"2024-06-20T13:23:27Z","title":"DASB - Discrete Audio and Speech Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14294","snapshot_observed_at":"2026-08-05T10:53:40.339604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.339604Z"},"links":{"cited_paper":"/paper/2406.14294","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:16009c84eb5e7fe6e688456770412aadbe8ca6aa2847ed3953068c4da2f54cb0","observation_id":"9127ad96-fd4a-4e9c-b4af-12c39d7984c8","resolution":{"observed_at":"2026-08-05T10:53:40.339604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05755","last_updated":"2024-10-18T19:18:41Z","snapshot_observed_at":"2026-08-08T16:34:49.867190Z","submitted_at":"2024-02-08T15:39:32Z","title":"Spirit LM: Interleaved Spoken and Written Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05755","snapshot_observed_at":"2026-08-05T10:53:40.479082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.479082Z"},"links":{"cited_paper":"/paper/2402.05755","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:3a4ed2d3635ddae130088eb59c3fbbd6c6f3f6d111f813ae49737c74343e8e0e","observation_id":"948aa07e-e75c-45e1-a406-5356ea23aaad","resolution":{"observed_at":"2026-08-05T10:53:40.479082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32009","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:42.783456Z","title":"https://doi.org/10.1109/JSTSP.2022.3200909","venue":null,"work_id":"73ce30e1-4b4b-4a8a-8d26-8fff7d1d83c8","year":2022},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.567646Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:48f13680fdf79b1c72a16398cf254b0dbbc6ea93df2f6f4bc3671eae2ffce44a","observation_id":"0de3952e-9d1e-4565-b644-98ba2a085d6d","resolution":{"observed_at":"2026-08-05T10:53:42.859161Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11588","last_updated":"2020-12-01T15:53:57Z","snapshot_observed_at":"2026-08-09T15:17:58.109636Z","submitted_at":"2020-11-23T18:01:37Z","title":"The Zero Resource Speech Benchmark 2021: Metrics and baselines for unsupervised spoken language modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11588","snapshot_observed_at":"2026-08-05T10:53:40.660528Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.660528Z"},"links":{"cited_paper":"/paper/2011.11588","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:18ad6f3cd613bbbaf8c6b50eb5cb6cc9dba9edfad831099b7018a7616d2142e6","observation_id":"d9eaf1bc-9078-4e9a-8637-9485b5aaa5c9","resolution":{"observed_at":"2026-08-05T10:53:40.660528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T10:53:40.762480Z","title":"org/abs/2303.08774","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.762480Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:4cc5c97b12fe35ed5baf77974dec1837375b13da8defb1a376fd3f75fdf34ff9","observation_id":"ec34cfe5-5d0c-4a6e-a0dd-be4939390dd0","resolution":{"observed_at":"2026-08-05T10:53:40.762480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:40.890328Z","title":"In: 2015 IEEE International Confer- ence on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:40.890328Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:b7fff152c709c2eb277537ec11d28fc4ebff21e5eab629fa7b4afae8aa9f6e29","observation_id":"d36aab44-469b-41ff-a849-f509cc28ec56","resolution":{"observed_at":"2026-08-05T10:53:40.890328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:41.002652Z","title":"In: 2021 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.002652Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:ea66db2e4c002e9f1d491fb38fd3d2088634bbe67f7cfd39b25e027525aa2c3f","observation_id":"bdc57484-ab45-4344-81a6-cc8ad8a825dc","resolution":{"observed_at":"2026-08-05T10:53:41.002652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:41.089862Z","title":"In: ICASSP 2023 - 2023 IEEE International Con- ference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.089862Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:ed25663e059f9fbdaccb9c3330df9e1d7485def10bb7769e5321c3a259707cd1","observation_id":"da58e3a3-a7a8-412a-8d4d-d6a2302c7b6e","resolution":{"observed_at":"2026-08-05T10:53:41.089862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T10:53:41.193410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.193410Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:f45bd180208cf15b6ed24732e0f13d52de538256150280dcd0aaa2a8e5314856","observation_id":"f3e4cb03-26c7-469c-b514-350dbc341096","resolution":{"observed_at":"2026-08-05T10:53:41.193410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-343","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"In: Interspeech 2023","venue":null,"work_id":"4a922ee9-b80f-4531-bdc1-0d42addbe666","year":2023},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.269325Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:0017ba88f9f77244ecd95103adb176d533d9910c7f7cbd33ee652c85c8580cdc","observation_id":"8b5f5e5a-062b-4ae2-8e23-0c0a2263f7d6","resolution":{"observed_at":"2026-08-05T10:53:41.882500Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02612","last_updated":"2024-12-03T17:41:24Z","snapshot_observed_at":"2026-08-02T21:27:26.884251Z","submitted_at":"2024-12-03T17:41:24Z","title":"GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02612","snapshot_observed_at":"2026-08-05T10:53:41.369932Z","title":"org/abs/2412.02612","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.369932Z"},"links":{"cited_paper":"/paper/2412.02612","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:71ceb73b46d71a32a166d66db40bb7a2b4e0e6625b415db0219130b13a0c314c","observation_id":"a4407fe5-fb24-4538-b95f-ae677ddbc10a","resolution":{"observed_at":"2026-08-05T10:53:41.369932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-05T10:53:41.496527Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:41.496527Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:ad219e9b35c582f1c0cbda454351977b915273057f35f155813d23a4174114e1","observation_id":"0be44166-4d2a-4af7-b3c4-8117fb1bf908","resolution":{"observed_at":"2026-08-05T10:53:41.496527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:53:44.852290Z","title":null,"venue":null,"work_id":"e217238b-6575-4223-a217-6656931cf1c7","year":2020},"citing_paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training","version":1},"reference_index":4222,"source":"pdf_text","source_observed_at":"2026-08-05T10:53:38.039954Z"},"links":{"citing_paper":"/paper/2509.05359"},"observation_digest":"sha256:113a988f0168cd3dc1e944f89097b424e56287773cace5af1957be3eadcf64d4","observation_id":"1d5b15c1-c4d2-47f5-8481-1c981be1f5f3","resolution":{"observed_at":"2026-08-05T10:53:44.957590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05359","last_updated":"2025-09-03T18:11:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T13:15:36.565643Z","submitted_at":"2025-09-03T18:11:53Z","title":"An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2509.05359."}