{"as_of":"2026-08-07T06:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0862d2bc1b9a249d0ede2df6cec765451be8415da106728eb6b8f57565273a0e","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:14:46.392932Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T04:48:13.811008Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T04:50:54.535578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"cited_work":{"arxiv_id":"2507.22995","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22995","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bal- ancing information preservation and disentanglement in self- supervised music representation learning","venue":null,"work_id":"bc03eafa-b915-4f1a-9221-908ff030ea40","year":2025},"citing_paper":{"arxiv_id":"2510.20759","last_updated":"2026-04-08T18:29:49Z","snapshot_observed_at":"2026-07-29T22:42:05.625472Z","submitted_at":"2025-10-23T17:29:13Z","title":"Controllable Embedding Transformation for Mood-Guided Music Retrieval","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T04:48:13.811008Z"},"links":{"cited_paper":"/paper/2507.22995","citing_paper":"/paper/2510.20759"},"observation_digest":"sha256:bf26e8948b744c9530fe40c93926b452ab5c1563e8974ffd62a29c8f5998325e","observation_id":"858c1498-6db9-4437-8a6a-68118b5f7226","resolution":{"observed_at":"2026-05-18T04:50:54.538162Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22995/citation-record","integrity":"/paper/2507.22995/integrity","json":"/paper/2507.22995/citation-record.json","paper":"/paper/2507.22995"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:50.562576Z","title":"Masked autoencoders that listen,","venue":null,"work_id":"5cf61476-140a-49b2-9651-ff3b11f5c86f","year":2022},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.549917Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:945324117bc7f85fe72316d5de4db57f8a30f764521552c01cc4d3cdca9fa034","observation_id":"1379080a-bc99-40f7-a93c-1465d0e4be7e","resolution":{"observed_at":"2026-08-06T11:14:50.642470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11477","last_updated":"2020-10-22T06:09:10Z","snapshot_observed_at":"2026-08-07T05:13:16.889179Z","submitted_at":"2020-06-20T02:35:02Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11477","snapshot_observed_at":"2026-08-06T11:14:43.621234Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.621234Z"},"links":{"cited_paper":"/paper/2006.11477","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:27322dedb3236825b864727d7670ff95ad2b08f348d0f81b4ed01d922d346a5f","observation_id":"1721ce3f-2492-4f28-8dca-a53805500ffd","resolution":{"observed_at":"2026-08-06T11:14:43.621234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:50.360813Z","title":"Semanticodec: An ultra low bitrate semantic audio codec for general sound,","venue":null,"work_id":"97035457-9a62-432c-b3c7-390694f50d50","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.679603Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:758fe397c476715260cb0afcc95e506d837a0d3fde204674e00f57797ca6c727","observation_id":"f722313a-2952-4619-993a-91081eab055d","resolution":{"observed_at":"2026-08-06T11:14:50.474419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:50.166625Z","title":"Masked spectrogram prediction for self-supervised audio pre-training,","venue":null,"work_id":"b6de9be9-09fe-4cb1-8588-6604a27d278d","year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.772913Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:10d9a98e8b1f113cae51b363eb2fb9bb9329099caa74a3118a3bb6553ca30362","observation_id":"27cd5708-5641-4037-88b6-32ea7c47248d","resolution":{"observed_at":"2026-08-06T11:14:50.277359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16691","last_updated":"2022-03-30T22:06:13Z","snapshot_observed_at":"2026-07-06T12:55:01.603047Z","submitted_at":"2022-03-30T22:06:13Z","title":"MAE-AST: Masked Autoencoding Audio Spectrogram Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16691","snapshot_observed_at":"2026-08-06T11:14:43.822392Z","title":"Mae-ast: Masked autoencoding audio spectrogram transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.822392Z"},"links":{"cited_paper":"/paper/2203.16691","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:59755700a15b9750e8a85241541ff509924444eda4437fc8eed3a0be048f2949","observation_id":"c0a77ec9-56b2-4177-9479-2f8ea4fabd96","resolution":{"observed_at":"2026-08-06T11:14:43.822392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T11:14:43.878999Z","title":"Representation learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.878999Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:8a387cd8b313f56a0d9fa4512ff02289cf817343c406e333f8ede376b10f4bb6","observation_id":"d885ee23-9060-4443-924c-21bc3b8101f6","resolution":{"observed_at":"2026-08-06T11:14:43.878999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.950911Z","title":"A simple framework for contrastive learning of visual representations,","venue":null,"work_id":"8827e837-08a5-47f9-bd52-4ab479286e8b","year":2020},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:43.954988Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:59835ee57c374c9b2c6040439f3f66fff3a497f37ba4f1fff4b78f1ce252bf69","observation_id":"16883334-0636-4da0-85cb-146868aa2186","resolution":{"observed_at":"2026-08-06T11:14:50.041968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:44.029464Z","title":"Barlow twins: Self-supervised learning via redundancy reduction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.029464Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:516c9b8bcb5d43f0bccb64c42fbe7d26428c43fd19a2aecf4a507c9956222e0d","observation_id":"207f39f4-cf6b-4a41-b712-da5d3f2f1a07","resolution":{"observed_at":"2026-08-06T11:14:44.029464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-06T11:14:44.102156Z","title":"Vicreg: Variance-invariance- covariance regularization for self-supervised learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.102156Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:95408bd2941124abec425eb374c4c69ee214111dfa6d53baf4a937d538cf1397","observation_id":"acde6c70-96da-41ff-8e85-6c68161ac6ab","resolution":{"observed_at":"2026-08-06T11:14:44.102156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06508","last_updated":"2021-03-24T02:44:05Z","snapshot_observed_at":"2026-07-06T10:48:52.299449Z","submitted_at":"2021-03-11T07:13:05Z","title":"Multi-Format Contrastive Learning of Audio Representations","version":3},"cited_work":{"arxiv_id":"2103.06508","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.06508","snapshot_observed_at":"2026-08-06T11:14:46.956848Z","title":"Multi-Format Contrastive Learning of Audio Representations","venue":"cs.SD","work_id":"7bdbffaf-9f65-4295-a7d5-e1d2208d6eb1","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.199804Z"},"links":{"cited_paper":"/paper/2103.06508","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:eae12ec1b76f0aa05dc8454fa4c06229188c06b5a99f80a9453fe2894640d58c","observation_id":"00a8d752-e9e4-4c83-9086-c54a3f308d12","resolution":{"observed_at":"2026-08-06T11:14:47.040906Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.775172Z","title":"Contrastive learning of general- purpose audio representations,","venue":null,"work_id":"2e0b21a5-c688-4b9a-8581-c19c42afd2e0","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.268593Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:61f77d76c03090cf2376f09da905c25e03d939f08333497359f24830eb73ae9f","observation_id":"0c3f9441-e99d-4208-b3fe-bf7d03247888","resolution":{"observed_at":"2026-08-06T11:14:49.876657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.613787Z","title":"Unsupervised contrastive learning of sound event representations,","venue":null,"work_id":"8e5fd925-7ba9-4ed9-a314-5869d9f50ef5","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.322771Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:62bad6fa1d6df8c8323f6347faf3942fb4dc5d6892bebf202b697b3b48c8632a","observation_id":"7da2d832-b535-4ccd-862d-577ac485b437","resolution":{"observed_at":"2026-08-06T11:14:49.667027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.451282Z","title":"Clar: Contrastive learning of auditory representations,","venue":null,"work_id":"ee363bc7-1ee8-46b6-8db9-f807b26f7905","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.423540Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:c36729c0b4f707f9f0f59cb66bad52028829a03bb4d878baef3ae2827fa6bb3e","observation_id":"f4d19a42-c904-4a33-8758-cc0001be1a24","resolution":{"observed_at":"2026-08-06T11:14:49.519629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.271202Z","title":"Contrastive audio-visual masked autoencoder,","venue":null,"work_id":"4a8a79a2-a4b3-4008-815f-5b4d229752a0","year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.526072Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:789425fb1b45fbeb7816fd242a1fa5c0dca7db035401700e6b7ae5878f375537","observation_id":"4710381f-2fe7-4edc-b480-03ea3465bdeb","resolution":{"observed_at":"2026-08-06T11:14:49.358081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13991","last_updated":"2021-07-05T03:13:25Z","snapshot_observed_at":"2026-07-06T10:08:49.711870Z","submitted_at":"2020-10-27T02:09:06Z","title":"Speech SIMCLR: Combining Contrastive and Reconstruction Objective for Self-supervised Speech Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13991","snapshot_observed_at":"2026-08-06T11:14:44.594875Z","title":"Speech simclr: Combining contrastive and reconstruction objective for self-supervised speech representation learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.594875Z"},"links":{"cited_paper":"/paper/2010.13991","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:e05e80177c2403a74b7643d5305d9b2be1e9972992387922c424f85c0088bee8","observation_id":"7562d155-cfed-4b89-9e10-722dc3f32365","resolution":{"observed_at":"2026-08-06T11:14:44.594875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:49.108057Z","title":"What should not be contrastive in contrastive learning,","venue":null,"work_id":"37a349f8-344c-4734-9979-79b871f840e5","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.695167Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:69d8aa308140148ea229e2b299e749565138c89aa80941d725d4d47b3f1aaff4","observation_id":"812e508b-8be4-44c5-9e85-fa1794417cbc","resolution":{"observed_at":"2026-08-06T11:14:49.177201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.938042Z","title":"Focal: Contrastive learning for multimodal time-series sensing signals in factorized orthogonal latent space,","venue":null,"work_id":"a9441570-c1a0-491f-9273-2d8f060350a3","year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.803741Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:4ebe32d2d5a56a2b0da0e3df5d26dbb4436efbec7c57252a56740f9634d48567","observation_id":"9858236f-a445-4c2d-89ab-39938f1728e5","resolution":{"observed_at":"2026-08-06T11:14:49.004432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.776728Z","title":"Self-supervised disentanglement by leveraging structure in data augmentations,","venue":null,"work_id":"a52872ce-2d66-4576-8142-698c7aa4a77d","year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.935871Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:1a75dea32733bc6232e4b584817567e34afabfffa4482c4d7c53c3e9092e07ed","observation_id":"003fe18e-d008-4f33-9e29-f8e9b87b0b33","resolution":{"observed_at":"2026-08-06T11:14:48.863238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-07-06T20:13:13.004731Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"cited_work":{"arxiv_id":"2412.18955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18955","snapshot_observed_at":"2026-08-06T11:14:46.791020Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","venue":"cs.SD","work_id":"9ff694f1-ebf5-4427-a525-655c7280f96d","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.999517Z"},"links":{"cited_paper":"/paper/2412.18955","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:f1df9cfcd8059cd77b407088d0107403859f6c6f99dd2a6cf6e886981d513c47","observation_id":"4a5db0e6-cf49-4d83-87b1-d68371202f88","resolution":{"observed_at":"2026-08-06T11:14:46.859914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.627105Z","title":"Similar but faster: manipulation of tempo in music audio embeddings for tempo prediction and search,","venue":null,"work_id":"7042667b-d2ba-46bc-a246-5c5140c8f3e2","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.075504Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:ba3362b66071c1025a1d90986dd612101cd9082b374c29156225fd0ce86c7fe9","observation_id":"bf71c939-fa09-4ece-926d-ec9032919879","resolution":{"observed_at":"2026-08-06T11:14:48.701703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.480934Z","title":"Isolating sources of disentanglement in variational autoencoders,","venue":null,"work_id":"8c829d77-bdac-4bd7-9388-76db2e74c7c8","year":2018},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.130569Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:44f21693b283a910edfcd6db2208fc35d60ac5249ee17a04f81da508140fe5bd","observation_id":"7078dcec-2253-454e-a7f8-3e8932dbd39e","resolution":{"observed_at":"2026-08-06T11:14:48.563172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.307320Z","title":"Disentangling by factorising,","venue":null,"work_id":"5789c149-89b2-40c5-ac64-0825e111966f","year":2018},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.221746Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:b71c6b0a71eb3a4f33247e37150d8e1adf0c4b4aa4e213cdd2e6143f85839a21","observation_id":"9d4cf336-4ae3-4a03-8119-f3a8aea63e7e","resolution":{"observed_at":"2026-08-06T11:14:48.391382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:48.144100Z","title":"Disentangling disentanglement in variational autoencoders,","venue":null,"work_id":"2e700ee2-d455-49e7-99e0-4f7ade194722","year":2019},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.292671Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:1cc1140f4830116d6d383132d72b79990c667087478c7724f629d7c9ebfa371a","observation_id":"9252f8d0-b70c-4e04-b2fb-e37db26776af","resolution":{"observed_at":"2026-08-06T11:14:48.223773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10547","last_updated":"2024-02-16T10:20:42Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T10:20:42Z","title":"Learning Disentangled Audio Representations through Controlled Synthesis","version":1},"cited_work":{"arxiv_id":"2402.10547","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10547","snapshot_observed_at":"2026-08-06T11:14:46.666502Z","title":"Learning Disentangled Audio Representations through Controlled Synthesis","venue":"cs.SD","work_id":"00a5d3cf-21c8-4291-b425-49032d6a4b19","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.377900Z"},"links":{"cited_paper":"/paper/2402.10547","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:66d6d2b8198153487adeb645035b6be70cf5c8293819195d44094933bbbe21ad","observation_id":"8b2214d3-7f87-4fbd-a516-df16c7179e7f","resolution":{"observed_at":"2026-08-06T11:14:46.721311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.974723Z","title":"Unsupervised disentanglement of pitch and timbre for isolated musical instrument sounds","venue":null,"work_id":"541458d4-b71e-4486-8e01-dd0bd0e759fd","year":2020},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.474396Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:9533760ce9524f234b5e44a42fa8692e36c82db36f9372bf39f9afdebff08c56","observation_id":"5ab329de-1cf8-4cc7-ab3f-ecc772ece59c","resolution":{"observed_at":"2026-08-06T11:14:48.060578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.842158Z","title":"Pitch- timbre disentanglement of musical instrument sounds based on vae-based metric learning,","venue":null,"work_id":"18f28458-a8a2-49a7-8214-c15c6aac8550","year":2021},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.562053Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:847bc7e97e952d6f564487523609edf3b7a1f915a0c7b6de13fe2e7039ba455c","observation_id":"373f9947-b909-494f-8b89-73f44dae5058","resolution":{"observed_at":"2026-08-06T11:14:47.907554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.713853Z","title":"Unsupervised pitch- timbre-variation disentanglement of monophonic music signals based on random perturbation and re-entry training,","venue":null,"work_id":"6d080573-3c02-46ee-af4f-bfa08b211fec","year":2025},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.637987Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:d6371a116cd43e7f7644815edad8ed12b5f85e3d166ab2431ecd44db48110eaf","observation_id":"c9931ef5-4f64-45e9-bc00-618746f027fc","resolution":{"observed_at":"2026-08-06T11:14:47.782884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02711","last_updated":"2024-11-05T01:21:28Z","snapshot_observed_at":"2026-07-06T19:45:17.343568Z","submitted_at":"2024-11-05T01:21:28Z","title":"Self-Supervised Multi-View Learning for Disentangled Music Audio Representations","version":1},"cited_work":{"arxiv_id":"2411.02711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02711","snapshot_observed_at":"2026-08-06T11:14:46.487838Z","title":"Self-Supervised Multi-View Learning for Disentangled Music Audio Representations","venue":"cs.SD","work_id":"6f609fb7-3ece-43eb-8e8c-44b0f75d887b","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.763732Z"},"links":{"cited_paper":"/paper/2411.02711","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:957266e3be3261c15818772447a1dc816bf99867461029a404b381106ab8b050","observation_id":"b8f03a2e-752a-4458-ae08-a12a36d1c2eb","resolution":{"observed_at":"2026-08-06T11:14:46.576062Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.579351Z","title":"An experimental comparison of multi-view self-supervised methods for music tagging,","venue":null,"work_id":"1f3242c7-b32f-40b3-ab01-01b7420cc1d7","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.851466Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:c002c33ca8870da9a2d898fcf65b566452c3e787f9f98592677c10080ec3123d","observation_id":"8a6e4ec3-4aca-40c5-ac51-3bc23a6e1cd9","resolution":{"observed_at":"2026-08-06T11:14:47.643896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-06T11:14:45.975004Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:45.975004Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:4bf01524d9d53a1ca899974fa428f4b40290e3ed8a1bc5319c2c220096ce0cab","observation_id":"03e5a5da-3e5a-41fb-bb98-4ad67dc40ad3","resolution":{"observed_at":"2026-08-06T11:14:45.975004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.384767Z","title":"Neural audio synthesis of musical notes with wavenet autoencoders,","venue":null,"work_id":"ee01050d-d0fe-4000-8e89-d81c2e23ad3f","year":2017},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:46.044133Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:435b5a0530aa2c24a52efa3c3fbb7ebafa9c2e37d8ed6d82b0515b7546e0f705","observation_id":"19842978-7c46-453e-b93b-3c7aa6534595","resolution":{"observed_at":"2026-08-06T11:14:47.469857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12503","last_updated":"2023-09-09T15:27:58Z","snapshot_observed_at":"2026-08-06T16:43:15.954030Z","submitted_at":"2023-01-29T17:48:17Z","title":"AudioLDM: Text-to-Audio Generation with Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12503","snapshot_observed_at":"2026-08-06T11:14:46.151866Z","title":"Audioldm: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:46.151866Z"},"links":{"cited_paper":"/paper/2301.12503","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:7c00a1d8138f2e8441b926cb94137985a78dd7a61f2b2eec4fa460322b419397","observation_id":"eae0bf53-89bc-4d9b-adb5-4745a5dce62d","resolution":{"observed_at":"2026-08-06T11:14:46.151866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-06T11:14:46.240127Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:46.240127Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:512e90c2ffbc1a29add7b5694015b06fb1f1a6add28d065e717745a50ff9d8b2","observation_id":"2798e571-ad33-4e5a-ada7-a1d5ba7f446d","resolution":{"observed_at":"2026-08-06T11:14:46.240127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:14:47.163895Z","title":"Bootstrap your own latent-a new approach to self-supervised learning,","venue":null,"work_id":"5c24b977-938d-49e3-ad3f-8c0f36dab7a6","year":2020},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:46.392932Z"},"links":{"citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:57c393ff3588145ebb27155b0db84458c670a05a081d36e9e98112d278dee747","observation_id":"c2a14eec-412a-4f33-af0d-46b74b3bd7a2","resolution":{"observed_at":"2026-08-06T11:14:47.271697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2507.22995."}