{"as_of":"2026-08-14T00:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:877cceac4f4cceb77dac0120ea7ccea6566684d9f219ed8fbeaff763e0d3bafc","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T01:05:36.285044Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:14:44.999517Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T11:14:46.791020Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"cited_work":{"arxiv_id":"2412.18955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18955","snapshot_observed_at":"2026-08-06T11:14:46.791020Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","venue":"cs.SD","work_id":"9ff694f1-ebf5-4427-a525-655c7280f96d","year":2024},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:44.999517Z"},"links":{"cited_paper":"/paper/2412.18955","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:8e8f5f35bb041847a035237b812d0db1842e33f09dcd8153814ff39761f30905","observation_id":"4a5db0e6-cf49-4d83-87b1-d68371202f88","resolution":{"observed_at":"2026-08-06T11:14:46.859914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18955/citation-record","integrity":"/paper/2412.18955/integrity","json":"/paper/2412.18955/citation-record.json","paper":"/paper/2412.18955"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.354235Z","title":"A simple framework for contrastive learning of visual representations,","venue":null,"work_id":"39117494-2e20-4232-8294-967ddac49413","year":2020},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.783363Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:3a29531e730ffc56d5b6fa7fa42682fc1af2b010f3a9f2aeeada9736b2f51c08","observation_id":"a0b4d8ef-398f-4e26-b8f9-f0a2b80fa600","resolution":{"observed_at":"2026-08-11T01:05:38.367932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.09410","last_updated":"2021-09-24T23:19:02Z","snapshot_observed_at":"2026-08-13T19:57:10.087156Z","submitted_at":"2021-03-17T02:53:55Z","title":"Contrastive Learning of Musical Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.09410","snapshot_observed_at":"2026-08-11T01:05:35.800973Z","title":"Contrastive Learning of Musical Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.800973Z"},"links":{"cited_paper":"/paper/2103.09410","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:5a84bef854d12b4c9665f6f64adf04562c488ff6c57e6e08f047cbb18d7ab7b8","observation_id":"f0d9d657-0e2e-4a0d-bc7b-a961af8f2889","resolution":{"observed_at":"2026-08-11T01:05:35.800973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.305948Z","title":"S3t: Self-supervised pre- training with swin transformer for music classification,","venue":null,"work_id":"a029dc8b-ee52-4648-b411-c37439d615d1","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.808019Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:bc67bcdde21a287e37f6f150e9657405eb087a5cbfa137bcf6ee047415b0ec42","observation_id":"f44d0223-fdbc-43e2-ad5e-6e5f7c8995e3","resolution":{"observed_at":"2026-08-11T01:05:38.317027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.251668Z","title":"Tailed u-net: Multi-scale music representation learning.,","venue":null,"work_id":"5c18b716-4edc-4fe0-88bb-67190d076cb2","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.821944Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:dd9ab345cf3403742c65667c928e54e359963979dc201e0bda75ba34aa39605d","observation_id":"51268172-5925-42f2-8246-916a7ed50039","resolution":{"observed_at":"2026-08-11T01:05:38.266101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03799","last_updated":"2022-10-07T20:07:35Z","snapshot_observed_at":"2026-08-13T14:10:16.218238Z","submitted_at":"2022-10-07T20:07:35Z","title":"Supervised and Unsupervised Learning of Audio Representations for Music Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03799","snapshot_observed_at":"2026-08-11T01:05:35.843289Z","title":"Supervised and Unsupervised Learning of Audio Representations for Music Understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.843289Z"},"links":{"cited_paper":"/paper/2210.03799","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:dc552b0b2252052560f73c5ed451e1c506f494ce427254cdae502b73d627af3f","observation_id":"c04f971e-66f5-4fb4-b714-b805704b6eb8","resolution":{"observed_at":"2026-08-11T01:05:35.843289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07077","last_updated":"2023-05-10T23:31:01Z","snapshot_observed_at":"2026-08-13T12:44:42.362974Z","submitted_at":"2023-02-14T14:36:59Z","title":"Multi-Source Contrastive Learning from Musical Audio","version":2},"cited_work":{"arxiv_id":"2302.07077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.07077","snapshot_observed_at":"2026-08-11T01:05:36.671351Z","title":"Multi-Source Contrastive Learning from Musical Audio","venue":"eess.AS","work_id":"1f65bb0a-bbc1-4732-94c2-4d8cb019c725","year":2023},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.850815Z"},"links":{"cited_paper":"/paper/2302.07077","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:5398667b71e6808432ee3c6500fd172f84422b687ed2b185696cec4bd4feb914","observation_id":"4971ffb6-d7a5-4f5b-a38a-baaaac5aa8dc","resolution":{"observed_at":"2026-08-11T01:05:36.689057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.198460Z","title":"To- wards proper contrastive self-supervised learning strategies for music audio representation,","venue":null,"work_id":"cb8634af-6615-4754-8eea-1dd61a5bfbb7","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.864506Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:e212847199c607d33ce3428c091985b3f63b267f365bc2b87ff974c4d6f5b007","observation_id":"7e6bfb71-7cf3-424b-a9ff-aeec29e5032d","resolution":{"observed_at":"2026-08-11T01:05:38.215847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13840","last_updated":"2024-07-18T18:21:40Z","snapshot_observed_at":"2026-08-12T23:19:11.394469Z","submitted_at":"2024-07-18T18:21:40Z","title":"Semi-Supervised Contrastive Learning of Musical Representations","version":1},"cited_work":{"arxiv_id":"2407.13840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13840","snapshot_observed_at":"2026-08-11T01:05:36.590937Z","title":"Semi-Supervised Contrastive Learning of Musical Representations","venue":"eess.AS","work_id":"0fefcb99-d17b-4c7d-812a-207e6dd71e3e","year":2024},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.884212Z"},"links":{"cited_paper":"/paper/2407.13840","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:458a7e3e38cbf61667f81568f7291d071e86d9a01dec8d2193434fc80f1d987c","observation_id":"06facd66-f166-481d-8c0c-6ab6cf1dc073","resolution":{"observed_at":"2026-08-11T01:05:36.608228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.155745Z","title":"Contrastive Learning with Positive-Negative Frame Mask for Music Representation,","venue":null,"work_id":"23e5b69b-5ee0-4d30-8947-68ff88216aa8","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.906953Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:febc28ab5d0461d73e9ae67a4952c06b42f80248cccf870e5d5fb56f913aa815","observation_id":"a012d2c4-3817-4431-9b77-5be8cc1310fd","resolution":{"observed_at":"2026-08-11T01:05:38.168959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.096068Z","title":"COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations,","venue":null,"work_id":"2674da11-0916-49ca-8bc5-e8469acda53c","year":2024},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.916796Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:758973034caa537b11d2fcc3bd9b23ba1fa5e91d96bca293c8cb1ac00e5d34ac","observation_id":"bb077fdb-e202-42ea-b584-3a6687fbd0c6","resolution":{"observed_at":"2026-08-11T01:05:38.116584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:38.040294Z","title":"Class-Aware Contrastive Semi-Supervised Learning,","venue":null,"work_id":"c2ee6c0a-aefd-44fc-a4c7-20e28874a85e","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.935092Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:1cded1480f0a564353633ab580a00e7a973098452a3983c0415b2ba3eaaa562b","observation_id":"2b2490e6-f511-4455-9b41-e150d7605f65","resolution":{"observed_at":"2026-08-11T01:05:38.052739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.980129Z","title":"Boosting Contrastive Self-Supervised Learning with False Negative Cancellation,","venue":null,"work_id":"1c1af457-5138-4e22-9059-730aca2cabb7","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.972730Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:f4413e25af68a0f9e746bd5b23a16485a7bfab664f9ae39b016aee2f8e76580e","observation_id":"b9846260-d24f-452d-938e-49a6c36a652e","resolution":{"observed_at":"2026-08-11T01:05:37.988748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.956629Z","title":"Robust Contrastive Learning Using Negative Samples with Diminished Semantics,","venue":null,"work_id":"719f5171-2787-46d5-b02c-8a1bad6d0578","year":2021},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:35.998134Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:a4263cef5d3d5626eec632174417656525775239b9450fb42bf56a8200aa9e51","observation_id":"e59553b6-80b4-4f96-af6f-788e8e11dac8","resolution":{"observed_at":"2026-08-11T01:05:37.962683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.809943Z","title":"Wav2CLIP: Learning Robust Audio Representations from Clip,","venue":null,"work_id":"c169a3df-2152-41cf-84ec-a5f82e190bcc","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.035879Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:79a74094578ed34763231c6952b1f75f9299c723bb765e14bdf5340dec15bd29","observation_id":"4b9aaf5a-f482-4306-81ee-86d269b6a2ae","resolution":{"observed_at":"2026-08-11T01:05:37.828012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.763596Z","title":"What Makes for Good Views for Contrastive Learning?,","venue":null,"work_id":"c5f3ace4-8308-4bcf-b597-be1750bfe323","year":2020},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.045222Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:f7938a431dc401ec4ac1c8cc779284df5c7e18fae645f192acc5425a2ee3748d","observation_id":"a5b6c05c-018b-4a17-a4c0-e7b37f30ce97","resolution":{"observed_at":"2026-08-11T01:05:37.782829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.716806Z","title":"What Should Not Be Contrastive in Contrastive Learning,","venue":null,"work_id":"ef3321e9-eda8-4abe-90e7-55b4209de1c2","year":2021},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.065001Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:13e6897814a89bac009306fcf3be1330e6a9021dd2b5f1b0e47c4e00c7be68a2","observation_id":"8c262067-8b9b-4a01-b766-1a3f3a31470b","resolution":{"observed_at":"2026-08-11T01:05:37.730402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.675314Z","title":"On the effect of data-augmentation on local embedding properties in the contrastive learning of music audio representations,","venue":null,"work_id":"cddf3324-013f-4013-9303-2a0ecbe549f1","year":2024},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.074284Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:c56246209329f452ebec7d5e977bb9b9077afbb72c471c65bee3f52bb9826bfe","observation_id":"36489e96-6870-4ed3-b24c-8c33a7c99ed7","resolution":{"observed_at":"2026-08-11T01:05:37.687403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.632326Z","title":"Improved Baselines with Momentum Contrastive Learning,","venue":null,"work_id":"a539c048-1084-4270-b0a5-c9708afc37c5","year":2020},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.082568Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:6a8ee3fbe35daffcbfe9741d904eae9b3f9e3feb9e1ba68bcda47f33f7b124a0","observation_id":"54a5c176-e89c-43d0-ba84-4175a90e7a3a","resolution":{"observed_at":"2026-08-11T01:05:37.649032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.591553Z","title":"Towards Learning Universal Audio Representations,","venue":null,"work_id":"32dd609f-743b-4af5-835f-33a91a1ca24b","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.095558Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:54f25bfbe5f4d084faae15b9afc0147ed88c1724581b22f317cc82ae5bc905c6","observation_id":"bf28b7cd-a187-4397-9623-9ee5ddd58f29","resolution":{"observed_at":"2026-08-11T01:05:37.601467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.543276Z","title":"The mtg- jamendo dataset for automatic music tagging,","venue":null,"work_id":"2108459e-3943-427f-a312-4f366b33f2b2","year":2019},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.115171Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:a45b1583298c118716a36802f29088b5a7f961ecf7de3056bc0dcd2a945c952c","observation_id":"0b3395d7-c132-431a-9307-7e26707bbb3b","resolution":{"observed_at":"2026-08-11T01:05:37.558800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.491732Z","title":"Evaluation of algorithms using games: The case of music tagging.,","venue":null,"work_id":"708b9f5a-7b41-4d51-bb85-129f6a12cb46","year":2009},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.129170Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:6544528235b1932208eee7cbdd2bb5c09cca36da4eef74e4d89f387166929cd2","observation_id":"26e0dd59-48ac-47d1-a5ee-2d8820586c1e","resolution":{"observed_at":"2026-08-11T01:05:37.507744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale","version":4},"cited_work":{"arxiv_id":"1711.02520","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.02520","snapshot_observed_at":"2026-08-11T01:05:36.526806Z","title":"End-to-end learning for music audio tagging at scale","venue":"cs.SD","work_id":"cefda2b2-159d-41e8-9065-2fdbe6afb916","year":2017},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.142802Z"},"links":{"cited_paper":"/paper/1711.02520","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:11eaf0742df2791800ccb2b3e365517f7838f7da35aa9437a5999f06057ceffd","observation_id":"172dd704-c55e-4cd5-a844-f4416438b873","resolution":{"observed_at":"2026-08-11T01:05:36.537014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.439471Z","title":"Two data sets for tempo estimation and key detection in electronic dance music annotated from user corrections,","venue":null,"work_id":"28d94769-d41a-4fb2-825c-17d5a8009dae","year":2015},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.148794Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:95bdc508f2197f9feeceb9a90607b966eefa808f15f4d265b54e34418a2f1163","observation_id":"289f6dc1-63eb-49a6-9baf-57bb16d17d2a","resolution":{"observed_at":"2026-08-11T01:05:37.459463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.378618Z","title":"End-to-end musical key estimation using a convolutional neural network,","venue":null,"work_id":"c1c82b3e-0b3a-4c4c-86ed-5bb3f794343e","year":2017},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.195796Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:2d70a923df38f1a42ffa40f7824fea2cd77645b7bacac59f1fd24f3211f65a07","observation_id":"90980809-f58c-449c-a774-33484c83be67","resolution":{"observed_at":"2026-08-11T01:05:37.388451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.311288Z","title":"MARBLE: Music Audio Representation Benchmark for Universal Evaluation,","venue":null,"work_id":"ad11b8b7-425e-4e10-88e7-75d1b3b51e7c","year":2023},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.216174Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:3d103076a5efee33321696e55576d22823d3f79303a86e1e66febe01ee36daf1","observation_id":"cbd71a58-73ee-41fa-95f7-77b2864d3384","resolution":{"observed_at":"2026-08-11T01:05:37.324764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.257247Z","title":"Mir eval: A transparent implementation of common mir metrics.,","venue":null,"work_id":"6c870e52-ebbd-41fe-ba9b-a439feaa316a","year":2014},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.221710Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:c9b2b979941f6aac1467243c8c760a8d6a38c0c380ea84943f63d9fe0a7a243b","observation_id":"a0001dda-0440-4d3b-adc3-2611344e3902","resolution":{"observed_at":"2026-08-11T01:05:37.270795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.202505Z","title":"Neural audio synthesis of musical notes with wavenet autoencoders,","venue":null,"work_id":"911458ed-ce0e-4e6b-845a-55acc53dff5f","year":2017},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.230174Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:f9de7908cae5e75c522754e50cb57ec15f02d6ca6ef87acc515d2aebda1314eb","observation_id":"d30ceb4a-bec4-4ea9-acea-49018af10a68","resolution":{"observed_at":"2026-08-11T01:05:37.217772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.127865Z","title":"Musical genre classification of audio signals,","venue":null,"work_id":"0c10ff01-27c1-4388-a568-a73a29cf61e1","year":2002},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.241064Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:aa4d3289c31f935e0ae9f7f7fe48abc9d6e5513d8393ed57b92ceb47b4b49351","observation_id":"bf0afc74-ac2e-468e-8c04-ad3312fd93e9","resolution":{"observed_at":"2026-08-11T01:05:37.142234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:37.005688Z","title":"Perceptual tempo estima- tion using gmm-regression,","venue":null,"work_id":"dd6570bf-fd14-409e-bb6b-3251fe764148","year":2012},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.249204Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:ef2e214de678bebd61a5d44d40e3b3fbc211246d9f8b3eff2839ea038914ff40","observation_id":"ff1b4531-9ce4-4fd1-9f2f-80d402ff0b7a","resolution":{"observed_at":"2026-08-11T01:05:37.057421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:36.888482Z","title":"Particle filtering applied to musical tempo tracking,","venue":null,"work_id":"28bb6e34-69a2-44dd-a278-9de056c780d4","year":2004},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.261594Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:0888f9afd5c6b5edd7b3d9bc9fe896e0d8bfcb45a03159149fb388487c2a4ca7","observation_id":"529f4d56-87d2-4908-953f-2178963b17e7","resolution":{"observed_at":"2026-08-11T01:05:36.910384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08902","last_updated":"2024-01-17T01:06:22Z","snapshot_observed_at":"2026-08-13T23:13:49.404691Z","submitted_at":"2024-01-17T01:06:22Z","title":"Similar but Faster: Manipulation of Tempo in Music Audio Embeddings for Tempo Prediction and Search","version":1},"cited_work":{"arxiv_id":"2401.08902","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08902","snapshot_observed_at":"2026-08-11T01:05:36.438829Z","title":"Similar but Faster: Manipulation of Tempo in Music Audio Embeddings for Tempo Prediction and Search","venue":"cs.SD","work_id":"eac8d6aa-845e-4823-90b6-452f7df12414","year":2024},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.268779Z"},"links":{"cited_paper":"/paper/2401.08902","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:0ca36367f804ef88400552ea60ed0a5ec68e16141208019f4b09dc72a626a356","observation_id":"c771b580-2208-488b-bd67-4c0e83ee567f","resolution":{"observed_at":"2026-08-11T01:05:36.444962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01478","last_updated":"2022-09-03T18:43:39Z","snapshot_observed_at":"2026-08-13T14:33:30.811087Z","submitted_at":"2022-09-03T18:43:39Z","title":"Equivariant Self-Supervision for Musical Tempo Estimation","version":1},"cited_work":{"arxiv_id":"2209.01478","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.01478","snapshot_observed_at":"2026-08-11T01:05:36.364988Z","title":"Equivariant Self-Supervision for Musical Tempo Estimation","venue":"cs.SD","work_id":"94b87531-4a41-47d0-91ce-2161c7bfda55","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.277364Z"},"links":{"cited_paper":"/paper/2209.01478","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:aef5802a7e99eb818148c3dab8939267ac862abaee4c06664fbeeb9afbf0f66d","observation_id":"4a73dc80-d37e-4d1b-a09e-dd063932f0a3","resolution":{"observed_at":"2026-08-11T01:05:36.379697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:05:36.838924Z","title":"Towards proper contrastive self-supervised learning strategies for music audio represen- tation,","venue":null,"work_id":"968ff14d-8a3a-4c44-ac7d-be7665434cac","year":2022},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.285044Z"},"links":{"citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:55923dbbe6c538ccc9cc390fc8f7785a1e1ff759a575f6ff53b07f40b61c2fec","observation_id":"f0a266a8-91f9-409d-8272-4cdad18ca8c5","resolution":{"observed_at":"2026-08-11T01:05:36.850755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":5,"verified_fuzzy":26},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2412.18955."}