{"as_of":"2026-08-14T06:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:40e2b75e4d75ec88ace31347c94a9b3d0ae4473cbca1e6f74e0b3dc0d325cbd2","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:41:19.298523Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.11999/citation-record","integrity":"/paper/2501.11999/integrity","json":"/paper/2501.11999/citation-record.json","paper":"/paper/2501.11999"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.192357Z","title":"Definition of the opus audio codec,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.192357Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:9eeea905eb073d20a6fa21ee4353139ffc0bc3c2e13f005582afc86132e2c5a1","observation_id":"89dd27ab-05e1-4892-853f-87457387c87e","resolution":{"observed_at":"2026-08-10T17:41:19.192357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.652245Z","title":"Overview of the evs codec architecture,","venue":null,"work_id":"1444ae02-0f8a-4086-aa77-7b27c6052154","year":2015},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.198238Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:1164ebedfd60a60250f81d15a8b8c93165b94de723701645aebf19250724d90a","observation_id":"22304633-4246-4270-a684-e90df86c19f7","resolution":{"observed_at":"2026-08-10T17:41:19.657670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.633762Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":"f883b79e-e4a1-4ea2-aa38-ed22588bc890","year":2021},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.203578Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:1c4c05ce1c0d6faee8c340aa5176e6a8d392b198739e2830f5167d84456c16bf","observation_id":"80acd235-df74-4ede-bcfc-d6e70f13a565","resolution":{"observed_at":"2026-08-10T17:41:19.639745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-10T17:41:19.208986Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.208986Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:94af97eb2cecbbefcd783f5f3073a7d8a6d1de587947e0d5044d41d05b2bb0f5","observation_id":"bfe1fc2a-de89-48a8-a7b0-7b9e9a7722b4","resolution":{"observed_at":"2026-08-10T17:41:19.208986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.613513Z","title":"Funcodec: A fundamental, reproducible and integrable open-source toolkit for neural speech codec,","venue":null,"work_id":"090eea00-466b-4d5b-9042-c3a27502334f","year":2024},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.215105Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:b8a3f4530a37ecc6eb458927ca70e57f082d4bb24b92d9954395f29f352f0c46","observation_id":"77f6a551-29f8-4e24-bfb7-a67cb887a95a","resolution":{"observed_at":"2026-08-10T17:41:19.619889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.594873Z","title":"High- fidelity audio compression with improved rvqgan,","venue":null,"work_id":"46da7327-cd9c-41d8-bfd5-a85e01fff811","year":2023},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.220758Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:fe75a0f3aa3542187acdafdbe5bd5af2d92ce06362d5ffedbb272259bf773574","observation_id":"e137eeb7-5ca9-4f40-9ce0-8a2383bd22c3","resolution":{"observed_at":"2026-08-10T17:41:19.600706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.02095","last_updated":"2020-10-01T17:26:35Z","snapshot_observed_at":"2026-08-13T21:41:05.228578Z","submitted_at":"2020-09-04T10:22:43Z","title":"SEANet: A Multi-modal Speech Enhancement Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.02095","snapshot_observed_at":"2026-08-10T17:41:19.226962Z","title":"Seanet: A multi- modal speech enhancement network,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.226962Z"},"links":{"cited_paper":"/paper/2009.02095","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:fadb97ffe4c2364c4afaf1d46106a2824c8346b31d042c2158148a09846b400a","observation_id":"acabeb25-fc9b-4d2f-b41f-4d4812811a69","resolution":{"observed_at":"2026-08-10T17:41:19.226962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.578182Z","title":"Real-time speech frequency bandwidth extension,","venue":null,"work_id":"02365346-b9c9-4913-92e6-59bdb0f9c2ac","year":2021},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.232669Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:a80d864e8da396d0625b9d081e794c39f65f6f6bd864fe1bf5d3a7abc873ae4e","observation_id":"ed381c3b-3dea-4cee-84f1-f99d7a5380d3","resolution":{"observed_at":"2026-08-10T17:41:19.583163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.237799Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.237799Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:521184912b392631c430a1449930a5cf746e1abc1305b7ee8744eda55d9e7d57","observation_id":"dae36b5f-f77d-4557-b950-f751367429b3","resolution":{"observed_at":"2026-08-10T17:41:19.237799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.242381Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.242381Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:6524bf2cbc6212f57d66a0c9a115111f999fa5ac5768924fe270ec2a30307d8b","observation_id":"6029b862-5fcf-4332-a490-2d5cd8c63ec9","resolution":{"observed_at":"2026-08-10T17:41:19.242381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.246983Z","title":"Melgan: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.246983Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:28f4a2cfd3858734023938b2898e3caa67aaa55472671b8e3e28c7afe2590f04","observation_id":"9b8a1c25-e5cd-40e5-931e-35e85fad88e3","resolution":{"observed_at":"2026-08-10T17:41:19.246983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12208","last_updated":"2025-06-04T05:50:15Z","snapshot_observed_at":"2026-08-13T04:15:21.068786Z","submitted_at":"2024-02-19T15:12:12Z","title":"Language-Codec: Bridging Discrete Codec Representations and Speech Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12208","snapshot_observed_at":"2026-08-10T17:41:19.251505Z","title":"Language-codec: Reducing the gaps between discrete codec represen- tation and speech language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.251505Z"},"links":{"cited_paper":"/paper/2402.12208","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:ca825410196d373e2b6f0e972c05f422b794dc6eacc2919ff2bf6e8b932ad241","observation_id":"e115d7ab-84cb-498f-9c20-8672a0849123","resolution":{"observed_at":"2026-08-10T17:41:19.251505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01436","last_updated":"2018-05-01T05:30:29Z","snapshot_observed_at":"2026-08-02T09:34:56.255411Z","submitted_at":"2018-02-01T00:42:29Z","title":"Variational image compression with a scale hyperprior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01436","snapshot_observed_at":"2026-08-10T17:41:19.256882Z","title":"Vari- ational image compression with a scale hyperprior,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.256882Z"},"links":{"cited_paper":"/paper/1802.01436","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:2ea0e792a85906b35f56341355c785959d18a6378bef3dddf1edd4f4306ea0aa","observation_id":"b38c3379-53e0-4b0d-b6a9-006a91d5b608","resolution":{"observed_at":"2026-08-10T17:41:19.256882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.261640Z","title":"Learned image com- pression with discretized gaussian mixture likelihoods and attention modules,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.261640Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:b07c6920c8ef6c68da748ff037f5c65bcbde912f6109a20b4772b416431a69b7","observation_id":"4c81a297-3db8-4b64-9aab-33a8a9bf8ab2","resolution":{"observed_at":"2026-08-10T17:41:19.261640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.515583Z","title":"Channel-wise autoregressive entropy models for learned image compression,","venue":null,"work_id":"cae2d935-2fab-48ff-8960-ff9960d530f7","year":2020},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.265913Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:972b60817e6581c722e2053ee15934cdba779e38379d6d3094b4db080303e267","observation_id":"15aa9973-15f9-4e10-9b7f-5fb4f07ffb7f","resolution":{"observed_at":"2026-08-10T17:41:19.520646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.270460Z","title":"Elic: Efficient learned image compression with unevenly grouped space- channel contextual adaptive coding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.270460Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:7702385d9779454b0b5b580e118a545d70a3608e0aebfe1fb1bbbb07c54e1e53","observation_id":"17aeacd7-2aa7-4b44-8e6f-760056901a2e","resolution":{"observed_at":"2026-08-10T17:41:19.270460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.486033Z","title":"Learned image compression with mixed transformer-cnn architectures,","venue":null,"work_id":"fb21ad1b-2e4c-483b-8004-d871a398fa37","year":2023},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.274933Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:4ae88ce634a22ff53f4fb4dfe07d9ac2c5f5dba376c197e22cca0ca365ab9e27","observation_id":"a562ecd5-f337-48a3-bda4-a0307e6c41a9","resolution":{"observed_at":"2026-08-10T17:41:19.492017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-08-14T04:57:43.972237Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-10T17:41:19.279555Z","title":"Rwkv: Reinventing rnns for the transformer era,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.279555Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:8da9236612414d8715835c3e041122f900378da5bd0c9f63277c23f38fb2cec8","observation_id":"50d5abd5-c9c3-4594-90fa-9077d99611c3","resolution":{"observed_at":"2026-08-10T17:41:19.279555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05892","last_updated":"2024-09-26T22:39:08Z","snapshot_observed_at":"2026-08-12T16:03:56.235250Z","submitted_at":"2024-04-08T22:20:59Z","title":"Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05892","snapshot_observed_at":"2026-08-10T17:41:19.284388Z","title":"Eagle and finch: Rwkv with matrix-valued states and dynamic recurrence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.284388Z"},"links":{"cited_paper":"/paper/2404.05892","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:c1cceaa700aa78a23fe0b00766bd5e9f37b7928391c6f0a30b044307c6fdbbc5","observation_id":"79188123-8e45-455b-9f62-fffd7fb1c869","resolution":{"observed_at":"2026-08-10T17:41:19.284388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-10T09:39:47.608323Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-10T17:41:19.289645Z","title":"Libritts: A corpus derived from librispeech for text-to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.289645Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:d0203b3ee53fb8b97ceb8ad4c2938deaf9026afc5fa9c33f376685ee210e8f6f","observation_id":"ee4ea5b8-3ebb-472d-bfa1-78ecf644c5bf","resolution":{"observed_at":"2026-08-10T17:41:19.289645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.465270Z","title":"Visqol: an objective speech quality model,","venue":null,"work_id":"38896ad1-6880-46a1-ae7d-88942886dc59","year":2015},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.294217Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:739ad0a02128281ebdb20b68b020d91e33b6664b923f4e90f5aa459e4dffd60d","observation_id":"f27bea2f-cf59-45fa-994a-c4ae2bee2ba9","resolution":{"observed_at":"2026-08-10T17:41:19.472584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:19.298523Z","title":"Per- ceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:19.298523Z"},"links":{"citing_paper":"/paper/2501.11999"},"observation_digest":"sha256:2e71ad09ddba1b98d41610c5fc50e0ee45ea540cf13d00f9696ca197858af421","observation_id":"02a8ef96-e531-4dd3-87d7-6e3d496dda9f","resolution":{"observed_at":"2026-08-10T17:41:19.298523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.11999","last_updated":"2025-01-21T09:46:43Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T01:16:55.710084Z","submitted_at":"2025-01-21T09:46:43Z","title":"Rate-Aware Learned Speech Compression"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2501.11999."}