{"as_of":"2026-08-21T06:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dab9414190e5efe711dc44853028ae44fe8de9e400cb1b0e2ebda8a898f2447c","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T02:08:02.803410Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T02:08:02.803410Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T14:59:54.996385Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"cited_work":{"arxiv_id":"2606.27320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.27320","snapshot_observed_at":"2026-07-04T14:59:54.996385Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","venue":"cs.SD","work_id":"ff32c006-d8d0-4d0e-ab51-3c383b39f360","year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2606.27320","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:78012406f32cd1d598cb7cc1a573a871cabfc57c0204f552deafa3f3157586c8","observation_id":"2c0ac024-52c9-4078-8f87-6cdc523658bd","resolution":{"observed_at":"2026-07-04T14:59:54.997758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.27320/citation-record","integrity":"/paper/2606.27320/integrity","json":"/paper/2606.27320/citation-record.json","paper":"/paper/2606.27320"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"cited_work":{"arxiv_id":"2606.27320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.27320","snapshot_observed_at":"2026-07-04T14:59:54.996385Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","venue":"cs.SD","work_id":"ff32c006-d8d0-4d0e-ab51-3c383b39f360","year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2606.27320","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:78012406f32cd1d598cb7cc1a573a871cabfc57c0204f552deafa3f3157586c8","observation_id":"2c0ac024-52c9-4078-8f87-6cdc523658bd","resolution":{"observed_at":"2026-07-04T14:59:54.997758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"anchor” frames, each of which is the very first frame of the chunk. After chunk- ing, only these “anchor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:34ab5097b59ef301009d5d0c0ccca02c7bc35e808a6fc5c32c7b0f1fe3bce50d","observation_id":"75262060-a3df-4171-844e-84fc399b308a","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:0424216f5453d2a55990e29ed436762ab17624f128dc84e7ab821c5dff52923a","observation_id":"62dfc1b6-e258-4d01-a67f-08af7df34380","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"In ad- dition, we trainET-dp-widerange, withρ∼ U(0.2,0.995)to test the impact of training for more aggressive compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:a4b0c789492f32e1fd9ab90d58364450b4542d64b6f0af7c56f8206744023cc6","observation_id":"fdb0957e-0e87-43e7-bb53-cb298e1bd20a","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Im- plemented as a Re-Bottleneck plug-in on top of a frozen pre- trained autoencoder, ET introduces a lightweight causal latent predictor for chunking and dechunking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:207a3858bbb41a81c8a399e9c9fbb8dae3ef9f0b3d2f923b8cbdd29037b68d58","observation_id":"d12c3402-b442-42c6-997f-b8f9891e37db","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:6ff511e81eba1f9922360041a928e49ea78373725210851c726665d9117207b6","observation_id":"dd5bd4a2-1bae-4e4a-8ffa-aa64bd8024ee","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:37dcff30b4e9e41ee2c2d75277b387bd77a6f16d6fe6dab483c62cafa061c347","observation_id":"94eed512-30ff-43a3-957c-6428f24013cf","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:8aea76640dfd45ee0d70e82d0d66f237534d7297ed8cddb6323d53c9a4db924e","observation_id":"dcb2b974-9b6c-463c-b4a9-bd8a5a8e26e4","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:d6b760c23262aefce6b42f1c94ca59b68e0cdf1dbf64efc9e326ee261b2f6c3e","observation_id":"a22ccfa3-39b6-4165-8452-91c0ec5412c4","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:1501adeaa4565701a4acc941e014eec8fc650f222284acc618390260507e9924","observation_id":"ad642b70-43a6-454f-85cd-285ee45c670c","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05207","last_updated":"2025-08-07T09:44:00Z","snapshot_observed_at":"2026-08-20T13:25:37.183414Z","submitted_at":"2025-08-07T09:44:00Z","title":"SpectroStream: A Versatile Neural Codec for General Audio","version":1},"cited_work":{"arxiv_id":"2508.05207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.05207","snapshot_observed_at":"2026-07-04T14:59:54.992758Z","title":"Spectrostream: A versatile neural codec for general audio","venue":null,"work_id":"e5f1dc1c-004b-4bd0-963e-8a8e8bd157fa","year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2508.05207","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:bc65d5644e5c55c48aef9a10a4a9f67d1108b0297dd2ebc799be1d0d894bce1c","observation_id":"fa6bc4a9-da85-414c-939f-4e0da604a108","resolution":{"observed_at":"2026-07-04T14:59:54.994613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:fd075914cea67b91e2eb2674af0ae9d9ea948bb1aaf3d8d5b4d1f04a17b52beb","observation_id":"1d9c9d61-53ac-41e2-953c-e8b23f9ba5a7","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Audiolm: a language modeling approach to audio gener- ation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:563b36668889ae92b4636f8fb102488c2c24411146031df1517b2168a0f38706","observation_id":"c05be091-49e4-4661-a11c-cde75c7feb32","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Audiogen: Tex- tually guided audio generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:3c207b39fa934b9a12afca087c51aaf1cf0662559d4284084fff81bf87a4a259","observation_id":"5839dfd5-e5c9-4991-b013-5312b1ffb0bc","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Simple and controllable music gen- eration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:356eea927d2139eb7a7d930328342f2ff48a5739795be01dbe37ccc441cbe200","observation_id":"6b9d0eb9-5252-4ee8-95a2-416b3eaaf1fc","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":"2410.00037","doi":"10.1121/1.1906946","metadata_source":"pith","pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moshi: a speech-text foundation model for real-time dialogue","venue":"eess.AS","work_id":"3104332b-d279-44c8-aaa7-3d5a13c01832","year":2024},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:89278f6c5495035c9364d0aa2ff9bd2a634a1ced0becd5a66516f28e5f86a1fa","observation_id":"b0f859ec-d13a-45e4-9359-cfa3462c72dd","resolution":{"observed_at":"2026-07-04T14:59:55.011412Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-19T12:40:58.936874Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":"2305.09636","doi":"10.48550/arxiv.2305.09636","metadata_source":"pith","pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AudioLM: A language modeling approach to audio generation.IEEE/ACM Trans","venue":"cs.SD","work_id":"c68926d8-7cb2-4b44-9b10-396551c6bb67","year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:9ce75a765f91272f36eed296b23d13b5df894cbbbb6f3b582be9c05fce67d802","observation_id":"f5619d5b-9571-4943-99b1-c435db7ab3f5","resolution":{"observed_at":"2026-07-04T14:59:55.014270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:11.328066+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:11.328066+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.14912","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:59:55.006934Z","title":"Back to ear: Perceptually driven high fidelity music reconstruction","venue":null,"work_id":"02eb3bb1-6e5a-435f-931f-60a76ce11cac","year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:814e507b628df6d6f590f05c7545b35f68cc6ddf31169a788077b20e14269989","observation_id":"748c318e-a486-4e2a-89c5-c2caa6a01226","resolution":{"observed_at":"2026-07-04T14:59:55.008698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07592","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:59:54.986527Z","title":"Salad-vae: Semantic audio compression with language-audio distillation,","venue":null,"work_id":"842d06e8-ae11-4947-ad67-0ef9200d6316","year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:69a272bdcb4e79f255b12fb55da08d281192643e7855b89904171ce3008c0678","observation_id":"7704ae7a-5a3e-4488-934f-957c75b70dcc","resolution":{"observed_at":"2026-07-04T14:59:54.988088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:a8ba9e9aaffbadec0c8fd4bd84f4cbbc86a52d879596b85583783c102b1f2c7d","observation_id":"dab37c2c-f2fd-473e-b348-6a307978580e","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Continuous audio language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:49449c00cc292409a318ed7e8a3438fca601db76d0ae06a2b1979870b8feb3a3","observation_id":"b87f2ea5-c777-4424-9cec-053411bb2a5c","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Diffusion transformers with representation autoencoders,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:231b87adf0761c97d93c9765dbc857451736c55c46dd996e44737ce11ff38552","observation_id":"3a3d7396-e4a8-4b08-a128-db8b0147eac1","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Long-form music generation with latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:8c035b9b6938c6bf62b5fd7c6f8139721ad1be83a03fa69eb4d9aec9e28b78d3","observation_id":"700633d3-049d-4e54-81eb-8a9a08c3a0bb","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Variable bitrate residual vector quantization for audio coding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:1d53e29e33d1c1315624be735f11b7c83a7a3dd05a7338e67faac018cf3cb495","observation_id":"ea53460b-3706-49b3-a082-135b919cb315","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Unlock- ing temporal flexibility: Neural speech codec with variable frame rate,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:a2e250e0f35e6dac8a0b773d184158575b52e677bbb7fb4af1da0321eb84a57b","observation_id":"ceeabcb8-f070-49e3-92a4-686922d8e178","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Flexicodec: A dynamic neural audio codec for low frame rates,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:456bbdfd1689601c705f0a31eb183c772149933ffd29fca4e66fd7ef35a9a598","observation_id":"b4a2cdfa-f81a-4e9a-bc9a-63d206d6042e","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.23174","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:59:55.001581Z","title":"Beyond fixed frames: Dynamic character-aligned speech tokenization,","venue":null,"work_id":"1be9a624-8555-4b04-a979-03ec92d4368a","year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:6ccf2008e3732c38e683f3735ce2f2ec3a07247cae5157c5c9057659da91b3cd","observation_id":"95bdefc2-a7bf-461e-a9e9-67847843281b","resolution":{"observed_at":"2026-07-04T14:59:55.003119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Codecslime: Tem- poral redundancy compression of neural speech codec via dy- namic frame rate,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:9a654393a820c4fb80cc6f944ee64b44854c812684e9856bcc385ec366aee374","observation_id":"a1ca6d49-db92-4ddb-b316-bcdc723d7233","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Say more with less: Variable- frame-rate speech tokenization via adaptive clustering and im- plicit duration coding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:856c42f9122c2aed506cf788d07dffc46395a73215f7655b6f176306346fce43","observation_id":"831b02f9-bbba-40c5-9e1c-acf0a6bd9367","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Re-bottleneck: Latent re-structuring for neural audio autoencoders,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:198b967f87d8d8fbdf2915f9ed3199550341eb95b7353185eb57f926605f98df","observation_id":"5bf74d04-2050-472c-82cc-81068b33838f","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07955","last_updated":"2025-07-15T09:06:11Z","snapshot_observed_at":"2026-08-19T09:43:53.193377Z","submitted_at":"2025-07-10T17:39:37Z","title":"Dynamic Chunking for End-to-End Hierarchical Sequence Modeling","version":2},"cited_work":{"arxiv_id":"2507.07955","doi":"10.48550/arxiv.2507.07955","metadata_source":"pith","pith_arxiv_id":"2507.07955","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hwang, B","venue":"cs.LG","work_id":"2c24205d-e043-4482-800c-bb7d2d61ad6c","year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2507.07955","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:e181799aa9b2c25658823ccf25e4b7819b495b4dede89b5bb12ed0411be7b8d7","observation_id":"08a2fec7-5dfb-4c9e-a825-5daf0b3c6d3e","resolution":{"observed_at":"2026-07-04T14:59:54.991327Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"You only train once: Loss- conditional training of deep networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:b6461dbfa1c1b75d095d6acd0f2b693dee9f2f6c7619cf19cf27e205ed9aeec3","observation_id":"6150cc82-5bfa-40cf-88a3-31e8d9600a26","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Convnext v2: Co-designing and scaling convnets with masked autoencoders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:81dea783a6a989b093bd24f899ed9d52952573017039f0f1864f0483d69330e3","observation_id":"beded11e-d8dd-4171-ab22-47feaf105ed9","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:0eb00f5fda3ad4da84e71a8885fea6ad0e008dc833aab07a36fed6819dfe3b42","observation_id":"9d68cace-f306-40a2-b738-a911c5da3284","resolution":{"observed_at":"2026-07-04T14:59:55.000303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:29ae200af48525b97137357dc8171d593771dbd2a311c66ebca5022949964969","observation_id":"a968f53b-00cf-47bd-8c79-f1af44319da1","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:f48592ab592e1afefdce64213789cb7f680d74ef711f89e2dfdd1cc96133d0ee","observation_id":"391835f1-847b-46af-9357-95cefcf6ead0","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"BBC Sound Effects,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:1acd459a0daec5cb1b44eefaf1fdd0c63e4b39c888e1cb18c7584f467288f101","observation_id":"553c8f46-f980-40ae-9508-b011a3f50768","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.18656623","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rwc music database","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"8eaadb3f-f1b5-4ba8-9140-ce094627c6bc","year":null},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:bb25a5c0e39484b30b2dec8d3a3ea5008ad4fd4d04cdb5824d6560a72e34d8a2","observation_id":"257c6e11-051b-4ca3-bf8f-24bb1a306bb4","resolution":{"observed_at":"2026-06-26T02:08:53.944397Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15913","last_updated":"2023-07-29T06:59:37Z","snapshot_observed_at":"2026-08-16T15:12:20.739190Z","submitted_at":"2023-07-29T06:59:37Z","title":"Moisesdb: A dataset for source separation beyond 4-stems","version":1},"cited_work":{"arxiv_id":"2307.15913","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.15913","snapshot_observed_at":"2026-07-04T14:59:54.983707Z","title":"Moisesdb: A dataset for source separation beyond 4-stems.arXiv preprint arXiv:2307.15913","venue":null,"work_id":"6dc6fa1c-a3b8-4373-a4f9-27ebb2fa5fe0","year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2307.15913","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:3e27bae325dc7555b7b8d84ee1c97c40e08958529df96f9dd72b0860af8f75e3","observation_id":"c3b79e4e-d087-466a-b4b1-0464d5f89bb2","resolution":{"observed_at":"2026-07-04T14:59:54.985326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Coarse-to-fine text-to-music latent diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:6244fb96e27bd759b28dce9b0a051442a80e591ac90047c771d1f60e92e1f456","observation_id":"7f79ba0d-98c2-4204-9ba7-baac1dcc7433","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"The mtg-jamendo dataset for automatic music tagging,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:bea212074c3fd04b1078c0d6e9ced1f51197fa685994c464e688bb9e30ed598b","observation_id":"48823467-a7fb-4777-b1ca-656964398890","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Fma: A dataset for music analysis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:211dba1e9937483274468eb3ca662bb98ea0aa49f42e3c20f5f451a3f76c4395","observation_id":"59326918-2a14-423f-95ed-3724b9beb67d","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:6eb4b5224e80f10b00fdecf78b29ea7ba989575e91f8ccd63a2f26ef2ad1741f","observation_id":"36570fc1-fc2b-49ff-b138-b6dccb966553","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Muon: An optimizer for hidden layers in neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:febf99931cf8f5ec3bbc5656f92f2cce820aa51afb674789c1655057b8d17ccb","observation_id":"0e5585df-fda4-4575-b8b2-7fcfec59168f","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16982","last_updated":"2025-02-24T09:12:29Z","snapshot_observed_at":"2026-08-16T22:48:15.725816Z","submitted_at":"2025-02-24T09:12:29Z","title":"Muon is Scalable for LLM Training","version":1},"cited_work":{"arxiv_id":"2502.16982","doi":"10.48550/arxiv.2502.16982","metadata_source":"pith","pith_arxiv_id":"2502.16982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muon is Scalable for LLM Training","venue":"cs.LG","work_id":"a818f37a-b985-49e6-879d-603a00525f65","year":2025},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"cited_paper":"/paper/2502.16982","citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:9a21200f089a39c840d5ca14afa68b6b07da19c81d7bc4426b25678dc41e0a7e","observation_id":"c4e91742-48a5-4454-b3e8-bd530b2f692c","resolution":{"observed_at":"2026-07-04T14:59:55.005775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"The song de- scriber dataset: a corpus of audio captions for music-and-language evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:fb38213c714aa1920d8baa2481c2f0007043ae82d18ba1ba047a0e06aab7dd76","observation_id":"8a70c85c-01ca-40ed-9282-7db956a43c57","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Audiocaps: Generating captions for audios in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:15f90aa354649109872e2c49c9c2c6cf80a9223d64f97aed7915c76b69798beb","observation_id":"3626f511-52b1-4273-bdf0-d417b8b8912f","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Muchin: a chinese colloquial description bench- mark for evaluating language models in the field of music,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:34e02b17fce16395d3204a5c4985db3eab9bdd10e295e26e360d6d5bac68e156","observation_id":"c8912bfd-ae85-4f8f-99cd-3cdfd7a08014","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:1df27c745cd72d05a6f2fb334957ca3136e2b9ef9ddac346040bcd940c46bed2","observation_id":"172431a6-856a-493e-96bd-e73a5c0b7942","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"auraloss: Audio focused loss functions in pytorch,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:14a0056873b47a261ce24746f8f71a78e1b6b146322cdcf3e8a6add127016367","observation_id":"d0aa79a9-0991-4cba-a577-ae8b4bf7782e","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T02:08:02.803410Z","title":"Adapting frechet audio distance for generative music evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-26T02:08:02.803410Z"},"links":{"citing_paper":"/paper/2606.27320"},"observation_digest":"sha256:113136296674e7652228cd785ff3cf54a3d65b3899eceedb852d138ff70fd181","observation_id":"55754b06-0b22-460e-bde7-078aa1dd44ec","resolution":{"observed_at":"2026-06-26T02:08:02.803410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.27320","last_updated":"2026-06-25T17:33:09Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T01:51:36.685656Z","submitted_at":"2026-06-25T17:33:09Z","title":"Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2606.27320."}