{"as_of":"2026-08-21T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f354afbd349aa7a70b8678a8a4b5cd2baa0087721a46647ef8248c9896a64943","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":43,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:37:04.994189Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-12T20:13:58.182070Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-20T13:09:54.981053Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"reference_index":225,"source":"pdf_text","source_observed_at":"2026-08-12T20:13:58.182070Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2411.13577"},"observation_digest":"sha256:225cd054333f704ec8ba0109567343e786c1aa67cdeb5da88344c8bc38be650c","observation_id":"78434dc1-1136-4d6a-8214-784de52cb154","resolution":{"observed_at":"2026-08-12T20:13:58.182070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-12T10:57:08.531814Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18803","last_updated":"2025-04-27T16:37:28Z","snapshot_observed_at":"2026-08-19T16:49:09.731359Z","submitted_at":"2024-11-27T23:07:52Z","title":"TS3-Codec: Transformer-Based Simple Streaming Single Codec","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:57:08.531814Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2411.18803"},"observation_digest":"sha256:b3c98836bd64c1c1e1d99d7bd3ee18719f7b10fd874e06ab72b793d8ef8b5591","observation_id":"4f77f30a-3f52-42c9-844a-8bcc67f0ff31","resolution":{"observed_at":"2026-08-12T10:57:08.531814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-10T20:34:37.527498Z","title":"BigCodec: Push- ing the limits of low-bitrate neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08238","last_updated":"2026-06-05T17:32:46Z","snapshot_observed_at":"2026-08-17T22:34:27.630404Z","submitted_at":"2025-01-14T16:26:14Z","title":"CodecFake+: Codec-Based Resynthesized Data as a Proxy for Detecting CodecFake Speech","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T20:34:37.527498Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2501.08238"},"observation_digest":"sha256:89e54a96c8fb27d246cf27553bdcb345ff79c4bd29b99ea55b586a875ad24a14","observation_id":"183c0cf4-00e2-4fe6-98de-43313629bdfd","resolution":{"observed_at":"2026-08-10T20:34:37.527498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-07T14:53:17.728250Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17426","last_updated":"2025-05-23T03:13:46Z","snapshot_observed_at":"2026-08-16T18:13:29.906602Z","submitted_at":"2025-05-23T03:13:46Z","title":"UniTTS: An end-to-end TTS system without decoupling of acoustic and semantic information","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.728250Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2505.17426"},"observation_digest":"sha256:e52eeea42f357f179f9d4fce76ca9582de80a3f118e70ae5d953ed8f91e5d640","observation_id":"bdc4cb98-4edf-4f45-80c6-4ec8e460e120","resolution":{"observed_at":"2026-08-07T14:53:17.728250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-07T12:29:40.791796Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24314","last_updated":"2025-05-30T07:53:01Z","snapshot_observed_at":"2026-08-14T10:04:40.808126Z","submitted_at":"2025-05-30T07:53:01Z","title":"DS-Codec: Dual-Stage Training with Mirror-to-NonMirror Architecture Switching for Speech Codec","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:29:40.791796Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2505.24314"},"observation_digest":"sha256:a7c35a5ee5206fb56bd4c769f8f8111b4bb5de250847b40d50184f9137d1b887","observation_id":"18ce0122-83d8-410c-a52c-5e72d928fc6a","resolution":{"observed_at":"2026-08-07T12:29:40.791796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-07T12:27:30.047060Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24496","last_updated":"2025-05-30T11:47:29Z","snapshot_observed_at":"2026-08-15T08:11:51.259191Z","submitted_at":"2025-05-30T11:47:29Z","title":"Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:27:30.047060Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2505.24496"},"observation_digest":"sha256:63dd15127490364e63b57e72857c16357b75e1b3b089b5cda276306e2cb1f2a4","observation_id":"1681cb1f-31c1-41c1-a254-49e330700f19","resolution":{"observed_at":"2026-08-07T12:27:30.047060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-07T12:12:29.869064Z","title":"BigCodec: Pushing the limits of low-bitrate neural speech codec.arXiv preprint arXiv:2409.05377,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-12T05:59:14.233667Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.869064Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:3f19e49c3e12476858855248632b0dd97262492ea73c75a8641ee8d1b470dcfe","observation_id":"4cce3fd7-c466-4712-b8bc-90ae4aafcd0b","resolution":{"observed_at":"2026-08-07T12:12:29.869064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-06T21:51:36.381830Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23325","last_updated":"2025-07-09T17:40:35Z","snapshot_observed_at":"2026-08-17T17:41:09.789585Z","submitted_at":"2025-06-29T16:51:50Z","title":"XY-Tokenizer: Mitigating the Semantic-Acoustic Conflict in Low-Bitrate Speech Codecs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:51:36.381830Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2506.23325"},"observation_digest":"sha256:22a0dd2a9174908f03c54b5dd85e67030b3ef9eea34c4aff91789f5b2a93a870","observation_id":"8b56d155-f599-4703-a5f6-958f59f252f0","resolution":{"observed_at":"2026-08-06T21:51:36.381830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2507.16632","last_updated":"2025-08-27T16:42:11Z","snapshot_observed_at":"2026-08-13T23:38:52.637908Z","submitted_at":"2025-07-22T14:23:55Z","title":"Step-Audio 2 Technical Report","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-16T05:59:50.900436Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2507.16632"},"observation_digest":"sha256:6ed65ab59f11b6f2356e3070ac4531c7474fdb6f3bed5c14b2355fbf7ed54dc3","observation_id":"2a28d9ff-c3c3-4c9e-909b-477a118883d6","resolution":{"observed_at":"2026-05-16T05:59:51.092542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-15T18:04:57.546637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19062","last_updated":"2025-07-25T08:25:17Z","snapshot_observed_at":"2026-08-18T11:29:44.161165Z","submitted_at":"2025-07-25T08:25:17Z","title":"From Continuous to Discrete: Cross-Domain Collaborative General Speech Enhancement via Hierarchical Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:04:57.546637Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2507.19062"},"observation_digest":"sha256:dce44950218b1493f2eb134eeab624900a5eb9938a906f74dcf73c0c2833f6b0","observation_id":"ef08dafd-a626-47c3-b6f0-d886cf649b22","resolution":{"observed_at":"2026-08-15T18:04:57.546637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-06T15:02:02.970136Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21138","last_updated":"2025-07-22T23:57:11Z","snapshot_observed_at":"2026-08-09T08:43:35.449807Z","submitted_at":"2025-07-22T23:57:11Z","title":"TTS-1 Technical Report","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:02.970136Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2507.21138"},"observation_digest":"sha256:499b81f188d209efc8942f3e805077b527e67b74e4421eed381f4c36e58a6460","observation_id":"dee61c16-a693-413d-baec-a8d71bc82094","resolution":{"observed_at":"2026-08-06T15:02:02.970136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T15:00:14.133170Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20660","last_updated":"2025-08-28T11:07:36Z","snapshot_observed_at":"2026-08-16T00:28:53.748581Z","submitted_at":"2025-08-28T11:07:36Z","title":"CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:00:14.133170Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2508.20660"},"observation_digest":"sha256:96a57c8bd0d3c2e9cd44effb439a028a4b234391fa131f65ca3649ae6af8ee88","observation_id":"d06df0a6-9d79-4011-803e-22139be9f85e","resolution":{"observed_at":"2026-08-05T15:00:14.133170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-04T18:58:04.224307Z","title":"Bigcodec: Pushing the limits of low-bitrate neu- ral speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09550","last_updated":"2025-09-12T06:43:25Z","snapshot_observed_at":"2026-08-19T23:14:28.355224Z","submitted_at":"2025-09-11T15:39:59Z","title":"Finite Scalar Quantization Enables Redundant and Transmission-Robust Neural Audio Compression at Low Bit-rates","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:58:04.224307Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2509.09550"},"observation_digest":"sha256:2cd2a31dd85808a9109d3f2c5b552b96e2c571f094189b7f7de8efaf83bbc94b","observation_id":"e91580cc-0484-4ced-9172-f07bfec012e8","resolution":{"observed_at":"2026-08-04T18:58:04.224307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2512.01537","last_updated":"2026-05-18T17:15:31Z","snapshot_observed_at":"2026-08-15T21:40:35.377632Z","submitted_at":"2025-12-01T11:06:38Z","title":"Two-Dimensional Quantization for Geometry-Aware Audio Coding","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-21T18:16:51.486807Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2512.01537"},"observation_digest":"sha256:150469a6603b3ecd489d8e27cd44b8cdf8481a3d7c20d67823571e83afb731d1","observation_id":"b8a29a7c-4166-4b40-8ec2-fd19991e5f76","resolution":{"observed_at":"2026-05-21T18:20:29.287620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2512.20211","last_updated":"2026-06-29T06:29:50Z","snapshot_observed_at":"2026-08-11T16:21:41.773574Z","submitted_at":"2025-12-23T10:04:48Z","title":"Aliasing-Free Neural Audio Synthesis","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-16T20:34:50.539351Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2512.20211"},"observation_digest":"sha256:9dffa724a2a8d386ba70b40d5ffec018245c8ad977cd65b4b660675273d72e62","observation_id":"3428effe-c8ea-409c-8bb7-a6a31af8cf4d","resolution":{"observed_at":"2026-05-16T20:38:24.825696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-03T14:33:15.966459Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.20211","last_updated":"2026-06-29T06:29:50Z","snapshot_observed_at":"2026-08-11T16:21:41.773574Z","submitted_at":"2025-12-23T10:04:48Z","title":"Aliasing-Free Neural Audio Synthesis","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-03T14:33:15.966459Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2512.20211"},"observation_digest":"sha256:be48da57226e26747c0e948efdd0610c987e72618e50573fe1929c6083af044c","observation_id":"0a5d8ad9-3ed0-45f8-850d-3b842d45a872","resolution":{"observed_at":"2026-08-03T14:33:15.966459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-02T22:52:22.771262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.15491","last_updated":"2026-07-27T12:16:11Z","snapshot_observed_at":"2026-08-19T14:26:16.222437Z","submitted_at":"2026-02-17T10:59:33Z","title":"The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T22:52:22.771262Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2602.15491"},"observation_digest":"sha256:547ac2786c6248607a39b5162840406543451b0468b497a48088627cef834991","observation_id":"fa262b01-9d56-433a-a87d-eef8170a4019","resolution":{"observed_at":"2026-08-02T22:52:22.771262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-02T20:45:10.064437Z","title":"BigCodec: Push- ing the limits of low-bitrate neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22417","last_updated":"2026-06-04T10:49:29Z","snapshot_observed_at":"2026-08-13T23:11:02.667333Z","submitted_at":"2026-02-25T21:22:08Z","title":"Absorbing Discrete Diffusion for Speech Enhancement","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T20:45:10.064437Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2602.22417"},"observation_digest":"sha256:0864b746db0d1536d69a54fb21c1daffa1b19707b09b845c7b0f65a43227e54f","observation_id":"4c8b4d40-6815-433f-b210-5d00d6e23c2e","resolution":{"observed_at":"2026-08-02T20:45:10.064437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2604.17852","last_updated":"2026-04-20T06:02:25Z","snapshot_observed_at":"2026-08-14T01:00:57.309732Z","submitted_at":"2026-04-20T06:02:25Z","title":"LLM-Codec: Neural Audio Codec Meets Language Model Objectives","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T04:02:06.400937Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2604.17852"},"observation_digest":"sha256:2c759172604a222a83ff5e4b75501894fa5857598e1c979a88637b8d058d6c89","observation_id":"29c6b634-4898-479a-a082-69ce703db628","resolution":{"observed_at":"2026-05-10T04:04:47.429249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2604.26296","last_updated":"2026-04-29T04:51:14Z","snapshot_observed_at":"2026-08-17T02:55:34.037852Z","submitted_at":"2026-04-29T04:51:14Z","title":"SPG-Codec: Exploring the Role and Boundaries of Semantic Priors in Ultra-Low-Bitrate Neural Speech Coding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T12:44:08.364835Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2604.26296"},"observation_digest":"sha256:c588a5f706dd1722dff3307f1284d0922478c9b7500413a466fa5ddcb9e62528","observation_id":"bf6e8be7-a122-4df5-a8f3-ca313f4af068","resolution":{"observed_at":"2026-05-12T09:11:25.360220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-08-15T01:04:50.804421Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T12:25:52.847432Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:157b2d4865ab1fa6ed44e7334f643d27d7952df1f483ab88bbf7fedd7f955072","observation_id":"4be3814b-2230-4307-a252-e892e9cd9676","resolution":{"observed_at":"2026-05-11T19:16:08.753355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-08-15T01:04:50.804421Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T23:14:32.494076Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:81cb43708abfe26f5232f89008ae19f7f89d8b44d4c95f2966245bc92d45e262","observation_id":"ef440f87-5e18-422b-8ea0-aa5159dcedf8","resolution":{"observed_at":"2026-06-30T23:15:07.764198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.08608","last_updated":"2026-05-09T02:07:57Z","snapshot_observed_at":"2026-08-13T03:16:49.822860Z","submitted_at":"2026-05-09T02:07:57Z","title":"Reducing Linguistic Hallucination in LM-Based Speech Enhancement via Noise-Invariant Acoustic-Semantic Distillation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T01:11:50.733585Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.08608"},"observation_digest":"sha256:231651785484474d586d9ca6a475cd3a33140f8f819184a64ed1e043ceab83eb","observation_id":"a2231cdd-147a-49ec-b38c-f8a16216963b","resolution":{"observed_at":"2026-05-12T08:26:23.223312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.11098","last_updated":"2026-05-11T18:04:33Z","snapshot_observed_at":"2026-08-15T16:43:29.631683Z","submitted_at":"2026-05-11T18:04:33Z","title":"AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-13T01:04:54.506749Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.11098"},"observation_digest":"sha256:1603fad5216cb1d713445fab037d2b80092c6565941db82a1b9075c897b889f0","observation_id":"adf84d68-1c40-4351-b93c-b0ef80649ef7","resolution":{"observed_at":"2026-05-13T01:07:00.329820Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.11192","last_updated":"2026-05-11T19:58:14Z","snapshot_observed_at":"2026-08-18T20:31:27.815120Z","submitted_at":"2026-05-11T19:58:14Z","title":"Exploring Token-Space Manipulation in Latent Audio Tokenizers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T02:40:05.812426Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.11192"},"observation_digest":"sha256:e80a269f35f4dd740c70528701f1aaae35485434c88a513edcee58a0d62a81dc","observation_id":"33fa20fe-e4d6-4a0c-9437-fd6e14566f71","resolution":{"observed_at":"2026-05-13T02:42:08.256552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.19541","last_updated":"2026-07-24T12:58:15Z","snapshot_observed_at":"2026-08-16T04:50:21.010117Z","submitted_at":"2026-05-19T08:40:12Z","title":"Optimising Neural Speech Codecs for 300bps Communication using Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T02:07:50.016394Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.19541"},"observation_digest":"sha256:674ca1bf25337312f4ed6edbe3d3a4e1f27b08258522f0b200a75028970b0fd8","observation_id":"46fda62b-a291-491e-9a9f-202ad0794917","resolution":{"observed_at":"2026-05-20T02:07:58.617340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-02T13:42:35.727778Z","title":"BigCodec: Pushing the limits of low-bitrate neural speech codec,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.19541","last_updated":"2026-07-24T12:58:15Z","snapshot_observed_at":"2026-08-16T04:50:21.010117Z","submitted_at":"2026-05-19T08:40:12Z","title":"Optimising Neural Speech Codecs for 300bps Communication using Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:35.727778Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.19541"},"observation_digest":"sha256:2b68b59d0e09dac7b39d4994f72e043923b2eea671ec209c02208c309f327386","observation_id":"02e82e6d-231d-40fe-8b15-72f827118de5","resolution":{"observed_at":"2026-08-02T13:42:35.727778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.25669","last_updated":"2026-05-25T10:19:16Z","snapshot_observed_at":"2026-08-16T15:44:19.990220Z","submitted_at":"2026-05-25T10:19:16Z","title":"Ultra-Low-Bitrate Mel-Spectrogram-based Neural Speech Coding with Flow-Matching-based Refinement and Vocoding-driven Reconstruction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T19:45:01.705167Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.25669"},"observation_digest":"sha256:2690cf5d972a5ee2cbb693ca88aa39ab5635bd4285a9c9113db4ff6370bcecea","observation_id":"f4a9bd06-5406-4895-9eff-53b9165eb6f3","resolution":{"observed_at":"2026-06-29T19:53:55.885306Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2605.26812","last_updated":"2026-05-26T10:30:03Z","snapshot_observed_at":"2026-08-06T05:28:57.214176Z","submitted_at":"2026-05-26T10:30:03Z","title":"CFMDCTCodec: A Low-Bitrate Neural Speech Codec with Noise-Prior-aware Conditional Flow Matching for MDCT-Spectral Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T16:35:53.154968Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2605.26812"},"observation_digest":"sha256:50d1c433dc7c43b610727a4a312a625a462a1664cc192c3ef5de4b92d9274d67","observation_id":"90dfada4-8ac9-4042-a2d4-6827ff57c9c0","resolution":{"observed_at":"2026-07-01T16:45:50.849276Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.05876","last_updated":"2026-06-04T08:50:23Z","snapshot_observed_at":"2026-08-07T01:13:05.880627Z","submitted_at":"2026-06-04T08:50:23Z","title":"An Ultra-Low-Bitrate Neural Speech Codec with Plain-to-Pseudo Synergistic Vector Quantization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T23:56:21.886829Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.05876"},"observation_digest":"sha256:25fbd2279338fba4617b3bffa83b200a3a0b6493b0eb91f52f72869b7ab682ad","observation_id":"6c382414-6f5d-42d7-bd41-d7ab65f65308","resolution":{"observed_at":"2026-07-02T15:17:08.265442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.05892","last_updated":"2026-06-04T09:00:13Z","snapshot_observed_at":"2026-08-09T20:38:50.025250Z","submitted_at":"2026-06-04T09:00:13Z","title":"VoCodec: A Low-bitrate Streamable Neural Speech Codec with Voicing-driven Quantization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T23:54:16.305772Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.05892"},"observation_digest":"sha256:64b7053ff8a2bfc7747d99c8a2f1728f6aeae496de8e7c0317d2cac2952ba5ff","observation_id":"cc8ea18c-a8c4-4eb7-88aa-95da7e17b798","resolution":{"observed_at":"2026-07-02T15:17:08.559832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.11611","last_updated":"2026-06-10T03:23:21Z","snapshot_observed_at":"2026-08-14T10:11:40.647550Z","submitted_at":"2026-06-10T03:23:21Z","title":"SARA: A Dual-Stream VAE for High-Fidelity Speech Generation via Integrating Semantic and Acoustic Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T08:38:51.371500Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.11611"},"observation_digest":"sha256:1c043d1f9383ed6a9a60f9c4a28c7affbf6d5082acd5c21431f06418692a2f50","observation_id":"4021ff04-ff23-4f2b-afb7-425c94569445","resolution":{"observed_at":"2026-07-03T12:58:08.377203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.11631","last_updated":"2026-06-10T03:49:54Z","snapshot_observed_at":"2026-08-02T17:57:49.398213Z","submitted_at":"2026-06-10T03:49:54Z","title":"Benchmarking Neural Speech Compression from a Rate-Distortion Perspective","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T08:43:35.279033Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.11631"},"observation_digest":"sha256:9b3092a4d0c66d23d3de916d33000130277dd405dd5da4fba7832ed26341f9c1","observation_id":"3584b4fe-5dbc-4fb9-b7c6-0c1532783a87","resolution":{"observed_at":"2026-07-03T12:48:12.307965Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.12940","last_updated":"2026-06-11T06:06:02Z","snapshot_observed_at":"2026-08-13T18:47:34.345492Z","submitted_at":"2026-06-11T06:06:02Z","title":"Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment","version":1},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-06-27T06:05:26.735340Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.12940"},"observation_digest":"sha256:3a87c08d4f33bed9211cadfdcd3cbf28403553b4709ffe7dc8d38f6ab2e15dca","observation_id":"1528e992-6a89-40f1-9a74-d440db2ee079","resolution":{"observed_at":"2026-07-03T16:08:37.474128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.21157","last_updated":"2026-06-19T06:49:06Z","snapshot_observed_at":"2026-08-16T02:00:50.842737Z","submitted_at":"2026-06-19T06:49:06Z","title":"SDP-Codec: A Speaker-Decoupled Speech Codec with Pitch Injection for Low-Bitrate Coding and Zero-Shot Voice Conversion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T13:19:43.545346Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.21157"},"observation_digest":"sha256:326978265a57c07e52e2fbac76874d2f098b57d1379c6d12a31b33c3e6614f1f","observation_id":"71aa00ee-9fee-4bb7-a739-03fb7127903e","resolution":{"observed_at":"2026-07-04T07:39:38.408979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.27627","last_updated":"2026-06-26T00:53:49Z","snapshot_observed_at":"2026-08-17T03:54:28.610356Z","submitted_at":"2026-06-26T00:53:49Z","title":"HybridCodec: Modeling Discrete and Continuous Representations for Efficient Speech Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T00:56:43.991936Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.27627"},"observation_digest":"sha256:522beabed8a0e50fbbc7326f0c0c248e1815a98627fd38e924f39a8df929473a","observation_id":"e122b4f2-9d6d-4d05-8cb9-f5be44f59c89","resolution":{"observed_at":"2026-06-29T01:02:56.255534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.29480","last_updated":"2026-06-28T16:17:37Z","snapshot_observed_at":"2026-08-12T13:07:53.997567Z","submitted_at":"2026-06-28T16:17:37Z","title":"DTM-Codec: Dynamic Token Masking for VFR Speech Coding with Efficient Boundary Selection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T02:10:08.691873Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.29480"},"observation_digest":"sha256:be59af963edd2d7b9401e19adf191dd9a1fe18e1db23ca38cb5496bb6861c429","observation_id":"284e2c1d-8688-4968-b147-e36769da091e","resolution":{"observed_at":"2026-06-30T02:14:11.536891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":"2409.05377","doi":"10.48550/arxiv.2409.05377","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec","venue":"arXiv (Cornell University)","work_id":"e9f39fd1-2fa1-42f3-a015-0c19ae2ee455","year":2024},"citing_paper":{"arxiv_id":"2606.31247","last_updated":"2026-06-30T07:24:10Z","snapshot_observed_at":"2026-08-13T09:35:09.713263Z","submitted_at":"2026-06-30T07:24:10Z","title":"FlexiSLM: A Dynamic and Controllable Frame Rate Spoken Language Model","version":1},"reference_index":210,"source":"arxiv_source","source_observed_at":"2026-07-01T03:50:26.873406Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2606.31247"},"observation_digest":"sha256:d4bf1be7fac0d4ce9c73fe6bffaf2bdd1107136a80067de80c147d14ec994b81","observation_id":"f8c3108c-76a4-42cf-b6b7-1337990ab2c9","resolution":{"observed_at":"2026-07-01T11:45:47.197348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.64807+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-07-13T05:10:26.667731Z","title":"arXiv preprint arXiv:2409.05377 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09134","last_updated":"2026-07-10T06:44:04Z","snapshot_observed_at":"2026-08-13T01:04:17.839846Z","submitted_at":"2026-07-10T06:44:04Z","title":"ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-13T05:10:26.667731Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2607.09134"},"observation_digest":"sha256:c6f310763da42335dcb1d6a1a411ade82bae980cf93c27fe94ef324102469397","observation_id":"e1ec23c2-f332-49ea-ae72-f71080098275","resolution":{"observed_at":"2026-07-13T05:10:26.667731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-08T00:32:28.119828Z","title":"2409.05377 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05727","last_updated":"2026-08-06T08:09:48Z","snapshot_observed_at":"2026-08-19T04:49:43.772095Z","submitted_at":"2026-08-06T08:09:48Z","title":"LILAC: An Idempotent Neural Speech Codec","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:32:28.119828Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2608.05727"},"observation_digest":"sha256:da5f5307cc9177d7df7be61308a43270d29ea1da30504650788a80e54b9df72a","observation_id":"36dc20d5-827d-4c9c-9ff8-99eca56d09df","resolution":{"observed_at":"2026-08-08T00:32:28.119828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-10T04:20:42.272574Z","title":"arXiv preprint arXiv:2409.05377 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-19T16:31:52.529349Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:42.272574Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:c93275a3eb12b6cd7ab3a68fb3a83922dc5a8f7eb3e88312ad1b8f5764c0aeb0","observation_id":"3875a677-7baf-4da8-8349-4cf09f304f7c","resolution":{"observed_at":"2026-08-10T04:20:42.272574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-14T04:32:47.903185Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08667","last_updated":"2026-08-09T12:21:54Z","snapshot_observed_at":"2026-08-14T09:18:48.936467Z","submitted_at":"2026-08-09T12:21:54Z","title":"A Unifying Perspective on Audio Generative Modeling: Latent Representations and Modeling Strategies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:47.903185Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2608.08667"},"observation_digest":"sha256:2f2f71bfd6f9fc854df257d2d5fa545495c556e013c22af11891085468bd6be5","observation_id":"418150a3-dc47-4c54-890e-6f658235067d","resolution":{"observed_at":"2026-08-14T04:32:47.903185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-16T00:37:04.994189Z","title":"Bigcodec: Pushing the limits of low-bitrate neural speech codec.arXiv preprint arXiv:2409.05377, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11737","last_updated":"2026-08-12T07:23:54Z","snapshot_observed_at":"2026-08-18T22:02:39.463120Z","submitted_at":"2026-08-12T07:23:54Z","title":"Phoenix TTS: High-Fidelity Synthesis and Voice Conversion via Flow-Matching-Driven Speech Tokenization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:04.994189Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2608.11737"},"observation_digest":"sha256:c80e63513f6ca92daa16a9baca0c189a022bb2f3447a4e774864af80a4937140","observation_id":"81311671-a9d0-4270-9e88-5af927fd25c1","resolution":{"observed_at":"2026-08-16T00:37:04.994189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.05377/citation-record","integrity":"/paper/2409.05377/integrity","json":"/paper/2409.05377/citation-record.json","paper":"/paper/2409.05377"},"outbound":[],"paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T20:32:23.736592Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 43 inbound Pith citation observations for arXiv:2409.05377."}