{"as_of":"2026-08-21T23:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:684c1a029dc75e85efb934dc9361994584af5239525e18108576475e0478d954","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:58.858729Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:58.742461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T18:36:58.942650Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"cited_work":{"arxiv_id":"2507.07867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07867","snapshot_observed_at":"2026-08-06T18:36:58.942650Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","venue":"cs.SD","work_id":"6bb57843-6b47-4bc6-8a7e-8f4ed3619951","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.742461Z"},"links":{"cited_paper":"/paper/2507.07867","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:4fb4529887ed353288ef77cc409c9c070100a4c77ae692c0e125d3911943e8ca","observation_id":"f60161fc-82be-47c7-9e59-ba7a78464768","resolution":{"observed_at":"2026-08-06T18:36:58.946173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07867/citation-record","integrity":"/paper/2507.07867/integrity","json":"/paper/2507.07867/citation-record.json","paper":"/paper/2507.07867"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"cited_work":{"arxiv_id":"2507.07867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07867","snapshot_observed_at":"2026-08-06T18:36:58.942650Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","venue":"cs.SD","work_id":"6bb57843-6b47-4bc6-8a7e-8f4ed3619951","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.742461Z"},"links":{"cited_paper":"/paper/2507.07867","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:4fb4529887ed353288ef77cc409c9c070100a4c77ae692c0e125d3911943e8ca","observation_id":"f60161fc-82be-47c7-9e59-ba7a78464768","resolution":{"observed_at":"2026-08-06T18:36:58.946173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.246853Z","title":"real” latents (those directly fromA E(x)and “fake","venue":null,"work_id":"b5965db9-07eb-48ec-97a4-eb2cc1b9a9f2","year":null},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.746515Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:01df28a1b961e26b7feabb238b3c3ac539b138608c9f10044b412a85849d74e6","observation_id":"afa8dd69-0f40-4512-9b91-9b91b5588dca","resolution":{"observed_at":"2026-08-06T18:36:59.250288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.237221Z","title":null,"venue":null,"work_id":"a3e89485-f8d4-4fe5-932f-7a6848680b67","year":null},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.750242Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:db323a09c0d423fc86be660107bf0efa8bba61c22ddf77ea5896cbcc87616b3d","observation_id":"1f7746e6-bdf3-45af-bab0-c4e845b2665b","resolution":{"observed_at":"2026-08-06T18:36:59.240421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.227901Z","title":"modern day PCA","venue":null,"work_id":"40b0b81b-89c7-430e-986c-e6183f174b6f","year":null},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.753522Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:e5fbb7fbde6c633d451aca0415907170e8804530f4abfce8296e8a5fd9711088","observation_id":"3d5667d4-ad34-4e5a-bd76-bb30eae87cfe","resolution":{"observed_at":"2026-08-06T18:36:59.231147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.217957Z","title":"Our proposed Re-Bottleneck framework offers a flexible, post-hoc solution to this limitation","venue":null,"work_id":"23dcd5e5-305c-4b41-a859-7e333a116ffd","year":null},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.758083Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:ad060f4ec4551c11693339cd1f6b64eb8c3ad854b9bb54aae322b8a6372d3799","observation_id":"9870e316-9c2f-419f-a2c0-c006e7910fb3","resolution":{"observed_at":"2026-08-06T18:36:59.221385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.208386Z","title":"Soundstream: An end- to-end neural audio codec,","venue":null,"work_id":"9b53fffd-f759-47e8-a7bb-f084abff51d9","year":2021},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.761579Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:553bfa7709b6db25f0f6727312a75caa8ad84519cdaa6581dfeed23dd77ab76f","observation_id":"ef998048-1cde-4592-b01f-13a04a4940ec","resolution":{"observed_at":"2026-08-06T18:36:59.211581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.765594Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.765594Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:9b6de5cd954a46da5d02433a3f76da55ba47ce3b55d9b58225b79d849d71e02f","observation_id":"68a268dc-3fc8-41f2-8d53-e7ef715f9b4c","resolution":{"observed_at":"2026-08-06T18:36:58.765594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.191605Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":"b31e789e-bb4a-4f9a-94dd-8087d2efddb6","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.769225Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:5cdc3db19bbdfe90aeabeff432076dc42f0e9fd927e9b0890e7a2e975207ba15","observation_id":"eb9057e3-6149-453f-a58e-83c125c8e982","resolution":{"observed_at":"2026-08-06T18:36:59.194973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.182047Z","title":"Stable audio open,","venue":null,"work_id":"de49e031-110e-48e0-a7a6-6a158b92a773","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.772598Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:541ca8458e0f3aaa5d4e462777301e8e8273f7ca9ba7f61d0b05c87719ea18f4","observation_id":"a7991d02-c938-4d1a-bf17-210d54545631","resolution":{"observed_at":"2026-08-06T18:36:59.185136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-20T13:40:28.954978Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-06T18:36:58.775777Z","title":"Musiclm: Generating music from text,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.775777Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:ed8995dd87723ba4495555619e4c7642d757f93ad6b71830f7f989f6de7ff692","observation_id":"2aab86eb-8214-4ec0-baaa-7a237e96152f","resolution":{"observed_at":"2026-08-06T18:36:58.775777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.171170Z","title":"Vampnet: Music generation via masked acoustic token mod- eling,","venue":null,"work_id":"c14bbf0b-1e68-49ff-9faa-83dca7084b9d","year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.779427Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:181747d95c18099aa22acd7a57cf33a6ff39fbe1dea391adb58721bfd21ae89f","observation_id":"759e469c-05a3-4a60-b023-6ad9dcf1dd28","resolution":{"observed_at":"2026-08-06T18:36:59.175310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-19T12:40:58.936874Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-06T18:36:58.782317Z","title":"Sound- storm: Efficient parallel audio generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.782317Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:6dca5cb4caadb81f63c1cdaae0d0fb8eeb90d416d9f305382929f28bc6696461","observation_id":"d2c61d49-3b5f-438a-8cfb-d2fa7837a1c1","resolution":{"observed_at":"2026-08-06T18:36:58.782317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.160862Z","title":"Time-domain heart sound classification using neural audio codecs,","venue":null,"work_id":"4e945b05-9f0c-4ef8-b06e-3a68c29d928e","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.786253Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:3a8e4eedae458ec02f09c08d48fc8c4d78ea88f35ce04b0122c3cc148b6dc6b1","observation_id":"a4d63460-3330-450b-94f5-9f8edf57f0ff","resolution":{"observed_at":"2026-08-06T18:36:59.164290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.151288Z","title":"Speech separation using neural audio codecs with embedding loss,","venue":null,"work_id":"b5130ed9-9812-4220-a239-cfd96446f126","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.789223Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:f2ec34ba7450dfc08a54962bd7b4595b18f0af7fd349dbe7a43c4fde5583be0d","observation_id":"0401d865-6630-4a70-82f1-36f8e826fa1f","resolution":{"observed_at":"2026-08-06T18:36:59.154432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.141111Z","title":"Coarse-to-fine text-to-music latent diffusion,","venue":null,"work_id":"d2eeadec-338e-4cce-8012-72b5b1acbba5","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.791910Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:8119738832231d9d89e6b12cf568bd4324f49ccfb3e9686ee9aa367d1a4bb0c6","observation_id":"0b942c9e-c995-4015-9a71-08aca96c9e24","resolution":{"observed_at":"2026-08-06T18:36:59.144297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.131743Z","title":"An independence-promoting loss for music generation with language models,","venue":null,"work_id":"e18477be-f277-47df-8130-e0d039318625","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.794745Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:b834308641b7ded703d7d181c42bfa8a5f22ffc7a3adbe1aadc3e61e49d38fcf","observation_id":"945560c9-c313-4cf9-9a8b-b220b72b83cf","resolution":{"observed_at":"2026-08-06T18:36:59.134881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.122760Z","title":"Speechtokenizer: Unified speech tokenizer for speech language models,","venue":null,"work_id":"fc163ec7-f1d0-4dff-a878-ea56ef693909","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.797648Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:f1e809821a683ee41a0e34a746bc78bd1f1e179ccae7a7b4d356df1e39fcc365","observation_id":"379cbf38-596f-4b7f-8d97-7b8176fde6d0","resolution":{"observed_at":"2026-08-06T18:36:59.125976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.113142Z","title":"Moshi: a speech-text foundation model for real- time dialogue,","venue":null,"work_id":"727cadd2-d449-453f-9ac2-755282615e5f","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.800455Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:1748ac2c17e9cddea541ae10d4e69af8e490bb53ec93244750b3d573df324671","observation_id":"02ede10a-c116-4f75-8f90-aca340bae7fb","resolution":{"observed_at":"2026-08-06T18:36:59.116358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.103486Z","title":"Codec-superb: An in- depth analysis of sound codec models,","venue":null,"work_id":"0ccf6d94-a340-4a5f-9f6f-5526d6c12cfa","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.803303Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:e88600ffffda20bd03de7922e1af11b4acbb7caf2100d7df0ef18a4799cbb22a","observation_id":"a3993152-1e68-4c8f-b2ac-77afbd39aab0","resolution":{"observed_at":"2026-08-06T18:36:59.106915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.093416Z","title":"Reconstruction vs. generation: Taming optimization dilemma in latent diffu- sion models,","venue":null,"work_id":"78d27723-c26a-48c0-abf1-76237ad1affb","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.806592Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:90512ce20f4f45428367a9af08b695aa8d2d23404c75fc3ed62f296102c9a0d6","observation_id":"aac4cf7a-1b1c-43c5-b806-ddc06f186f5c","resolution":{"observed_at":"2026-08-06T18:36:59.096869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.083861Z","title":"Masked autoencoders are effective tokenizers for diffu- sion models,","venue":null,"work_id":"7c522f91-4981-4c13-b74b-e7dd9f16a437","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.809593Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:6bb2653771526c63e24591a1ee32740ad8b406d3a4d3f662440ae23ec3805b38","observation_id":"e4243303-6fbe-4d1a-8660-e3c96daa177d","resolution":{"observed_at":"2026-08-06T18:36:59.087205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00681","last_updated":"2025-09-08T18:54:42Z","snapshot_observed_at":"2026-08-14T11:57:39.468585Z","submitted_at":"2025-05-31T19:27:22Z","title":"Learning to Upsample and Upmix Audio in the Latent Domain","version":2},"cited_work":{"arxiv_id":"2506.00681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00681","snapshot_observed_at":"2026-08-06T18:36:58.901122Z","title":"Learning to Upsample and Upmix Audio in the Latent Domain","venue":"cs.SD","work_id":"7e767ba2-2fa2-4dc9-8bbc-11cb8b09bad8","year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.812383Z"},"links":{"cited_paper":"/paper/2506.00681","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:201f0cb79dbfa45c06bdd81d7ffe7ac5bca828220e897cc363336303baf85a9b","observation_id":"f8bd0ce0-fb58-40c1-83a2-9ff032c6f57b","resolution":{"observed_at":"2026-08-06T18:36:58.907785Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.074651Z","title":"Beats: Audio pre-training with acoustic tokeniz- ers,","venue":null,"work_id":"dc9a915b-1aa2-477e-ad6e-0ccf808391a6","year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.815391Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:56d128a86fa75095b9772fe63689e3fc9ee4e65bd7b3649b6e33aefda29ad95b","observation_id":"a21cb547-522b-4e2c-ba51-50d05f892f4d","resolution":{"observed_at":"2026-08-06T18:36:59.077947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.064728Z","title":"Exploring the limits of transfer learning with a uni- fied text-to-text transformer,","venue":null,"work_id":"bde10992-9700-46c0-86a1-9ab836503016","year":2020},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.818637Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:a4812d2305babfb9ddc3d3681529c0c25cb769b28b4e28040ed6c251acf71311","observation_id":"b9fd80e0-f8ee-4048-943d-1668168524c6","resolution":{"observed_at":"2026-08-06T18:36:59.068281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.055441Z","title":"Learning ordered representations with nested dropout,","venue":null,"work_id":"c17a7f7e-17b8-4042-b48a-b5282206dd00","year":2014},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.821854Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:2609606fa6c8dc2aff8b39f9956e7642a752afee158e3a6db7d81d187421de2c","observation_id":"2f4bcdc9-e2c6-4130-a6fe-38e3ca4ad787","resolution":{"observed_at":"2026-08-06T18:36:59.058471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09509","last_updated":"2025-08-04T10:44:54Z","snapshot_observed_at":"2026-08-15T10:24:37.659346Z","submitted_at":"2025-02-13T17:21:51Z","title":"EQ-VAE: Equivariance Regularized Latent Space for Improved Generative Image Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09509","snapshot_observed_at":"2026-08-06T18:36:58.824650Z","title":"Eq-vae: Equivariance regularized la- tent space for improved generative image modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.824650Z"},"links":{"cited_paper":"/paper/2502.09509","citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:6c30cddb33c654c9e434920614cb48fc00d645817239816d93bfd8cfc554a21d","observation_id":"e67ccd6d-7d0e-4b40-a0d8-b9e0fb5d1ec2","resolution":{"observed_at":"2026-08-06T18:36:58.824650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.045748Z","title":"Convnext v2: Co-designing and scaling convnets with masked autoen- coders,","venue":null,"work_id":"ebee1695-5f31-46f3-b0f7-c548a73ed56f","year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.828094Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:6cc73fbdaefce8a31f80d240c06fb38431aedce29ecb1d2dd9b5036bf7e72b46","observation_id":"9108f003-b1af-425e-b51c-e846d5327128","resolution":{"observed_at":"2026-08-06T18:36:59.049172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.035293Z","title":"The mtg-jamendo dataset for au- tomatic music tagging,","venue":null,"work_id":"9acf5a13-d506-42fe-9604-5cb3468fc0f1","year":2019},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.831731Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:07dc54ad90b3d8d07aa43c78dff48c410eee5f7444eaec56406a5bd50129472c","observation_id":"07029931-e6cf-4335-a9c8-b1173f04e23a","resolution":{"observed_at":"2026-08-06T18:36:59.038852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.025522Z","title":"Fma: A dataset for music analysis,","venue":null,"work_id":"2789016a-35aa-47bf-b33e-3b4302422801","year":2017},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.835542Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:31cb3d8f2052b881b78337303250f6407bfe3e3a465956861f64bad9172f115b","observation_id":"cc362b45-f80b-4cbb-b451-b307ddf5da31","resolution":{"observed_at":"2026-08-06T18:36:59.029091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.015817Z","title":"The song describer dataset: a corpus of audio captions for music-and- language evaluation,","venue":null,"work_id":"b4894952-8cda-48d3-acba-9e91ce6859a3","year":2023},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.838744Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:afed5c705d37ecf42b5ecfb49173437f66e5ebd500061e2dea01b745d30992a3","observation_id":"c7949f9b-b744-43cc-8c41-2d503c0b340c","resolution":{"observed_at":"2026-08-06T18:36:59.019199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.005812Z","title":"Generation or replication: Auscultating audio latent diffusion models,","venue":null,"work_id":"d1b011a6-5153-4d9a-b90a-a316e6c49d00","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.842452Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:38c8bf7e728645443bf9057c6db0c6fc37e650a94d90cf044595ecdcae65fc52","observation_id":"963f3360-3698-454c-b714-174d9484ed10","resolution":{"observed_at":"2026-08-06T18:36:59.009473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.994868Z","title":"auraloss: Audio focused loss functions in pytorch,","venue":null,"work_id":"bc6db5e1-eab5-4258-b72a-13fd2431fb2a","year":2020},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.845859Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:19114111af0ab00c5753bb00baa4b2c103bab37282f36ebb98dbbf1359a40fcc","observation_id":"cd895108-b5cf-4895-a6d2-eab4e45f5d6e","resolution":{"observed_at":"2026-08-06T18:36:58.998789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.983765Z","title":"Adapting frechet audio distance for gener- ative music evaluation,","venue":null,"work_id":"5e79ec36-bce5-49aa-8276-b3c79082d0e4","year":2024},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.849744Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:8777f49bd2efa9621999ee6bea15e7f875eeee85cb7110f8e1ce1b3a3ed6f52b","observation_id":"831b4b12-356b-4f03-8b0b-6716fdd91861","resolution":{"observed_at":"2026-08-06T18:36:58.987611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.973478Z","title":"Similarity of neural network representations revisited,","venue":null,"work_id":"304764fd-6871-4179-84f2-5ef369e3afd8","year":2019},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.852647Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:8dc8a3d4a9f80f5241c8fdaa9e7b4a2b977e867c18915301fdcc000dfb1eaad7","observation_id":"84fba41a-229d-4206-a723-66644baaae9c","resolution":{"observed_at":"2026-08-06T18:36:58.977148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.963182Z","title":"On kernel-target alignment,","venue":null,"work_id":"25aab1c1-3e92-4a8c-acc7-f2e2adf4f52a","year":2001},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.855764Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:03bdde8345be20de55ea26dccdd6e447ad356b204f5e0848bd90da71aa10349b","observation_id":"ef9746b0-f6fb-4853-a7ef-26a4721bb30b","resolution":{"observed_at":"2026-08-06T18:36:58.966688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.952777Z","title":"Insights on representational similarity in neural networks with canonical correlation,","venue":null,"work_id":"75d3e987-38d8-4309-8a16-126bb0bcc4fb","year":2018},"citing_paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.858729Z"},"links":{"citing_paper":"/paper/2507.07867"},"observation_digest":"sha256:15f9d10035709d4d4d3323c9814fc49a15442e3137a038a33160e6b366f887a3","observation_id":"db9ed99c-71ee-476e-8cf2-d0ad8803e6bf","resolution":{"observed_at":"2026-08-06T18:36:58.956284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07867","last_updated":"2025-09-08T18:44:53Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T15:52:17.553244Z","submitted_at":"2025-07-10T15:47:43Z","title":"Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2507.07867."}