{"as_of":"2026-08-08T10:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:983eb14ccb7b579d9a3792b2550ea78ced08210065148aaf92a70c75e2bb7c3f","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:53:53.743257Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:53:51.622636Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:53:54.706310Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"cited_work":{"arxiv_id":"2505.17233","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17233","snapshot_observed_at":"2026-08-07T14:53:54.706310Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","venue":"cs.LG","work_id":"0e551672-3da7-4bfb-83d9-12de45f7fde6","year":2025},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.622636Z"},"links":{"cited_paper":"/paper/2505.17233","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:814d75c731723d74c410cd26bd8796d299d04f77c846347bf6e4cb06f4461d02","observation_id":"52c30a3c-4096-436e-bae1-c3e528a3bb6c","resolution":{"observed_at":"2026-08-07T14:53:54.771033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17233/citation-record","integrity":"/paper/2505.17233/integrity","json":"/paper/2505.17233/citation-record.json","paper":"/paper/2505.17233"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:58.224625Z","title":"This task involves as- signing semantic labels—such as genres, instruments, moods, and production qualities—to audio tracks","venue":null,"work_id":"9bb1f16a-5afe-408a-9088-dc68c6f6f5ff","year":null},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.570893Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:f7e1799875aae30c389bd1447c4bd9d0c697c20c6ae19b8ec3f5dc228f3a1377","observation_id":"dd48677e-d3b9-49a5-8c33-0b5549ca13fc","resolution":{"observed_at":"2026-08-07T14:53:58.319676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"cited_work":{"arxiv_id":"2505.17233","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17233","snapshot_observed_at":"2026-08-07T14:53:54.706310Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","venue":"cs.LG","work_id":"0e551672-3da7-4bfb-83d9-12de45f7fde6","year":2025},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.622636Z"},"links":{"cited_paper":"/paper/2505.17233","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:814d75c731723d74c410cd26bd8796d299d04f77c846347bf6e4cb06f4461d02","observation_id":"52c30a3c-4096-436e-bae1-c3e528a3bb6c","resolution":{"observed_at":"2026-08-07T14:53:54.771033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:57.934850Z","title":null,"venue":null,"work_id":"06eb7036-2dd0-41d8-a54c-077b75d44c0a","year":null},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.704668Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:4c5e47d6c746dbd9357f184bb0f787f8bdc825521efcea4e6c95340f80f0213a","observation_id":"565c44bf-a754-4c0e-b705-e558ff40597b","resolution":{"observed_at":"2026-08-07T14:53:58.070891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:57.617487Z","title":null,"venue":null,"work_id":"72ec1ae3-6480-489c-bb5d-3ddb86b06e54","year":null},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.724355Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:4743cda56512123dadc83ea58219b8d593217b63722a83365a1750ef3d8ebcd6","observation_id":"5af44986-c58f-4fa3-b6a6-4b451d9d03e0","resolution":{"observed_at":"2026-08-07T14:53:57.770396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:57.427767Z","title":"Basic research Financing (Horizontal support of all Sciences)","venue":null,"work_id":"d3164592-65e0-451e-862e-2c12797096c3","year":null},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.764818Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:47cc685dd6eca20de642be13856341ac1845d340e83e6141dafbed2cc7af4895","observation_id":"e297b974-a3a9-4962-991f-cfa787b35a99","resolution":{"observed_at":"2026-08-07T14:53:57.479992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14340","last_updated":"2024-09-03T14:53:34Z","snapshot_observed_at":"2026-07-06T19:06:01.833508Z","submitted_at":"2024-08-26T15:13:14Z","title":"Foundation Models for Music: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14340","snapshot_observed_at":"2026-08-07T14:53:51.795095Z","title":"Foundation models for music: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.795095Z"},"links":{"cited_paper":"/paper/2408.14340","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:1f93f6c09fc0e6fa7f91f77346b28e9b549854823180c34c5eb583109ca0c4a6","observation_id":"b8cfe6f9-d930-4ac2-9611-384ebda1c7c3","resolution":{"observed_at":"2026-08-07T14:53:51.795095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00107","last_updated":"2024-12-27T12:28:34Z","snapshot_observed_at":"2026-08-06T16:16:34.606158Z","submitted_at":"2023-05-31T18:27:43Z","title":"MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00107","snapshot_observed_at":"2026-08-07T14:53:51.845493Z","title":"Mert: Acoustic music understanding model with large-scale self-supervised training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.845493Z"},"links":{"cited_paper":"/paper/2306.00107","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:84aa0efce19e786f9a85d46d0039b272a0635d28cf503c5e07ab6bfb8f03e212","observation_id":"6c9ae4b0-9bca-41e5-a443-ecfa11e4a866","resolution":{"observed_at":"2026-08-07T14:53:51.845493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:57.267789Z","title":"Sample-level deep convolutional neural networks for music auto-tagging,","venue":null,"work_id":"1d43dfec-7525-4cef-8d76-64479757035a","year":2019},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.879148Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:aede00e407691ef7c2f7484213bb025d12afef38f9a5372bd87241cf911264d0","observation_id":"cce58793-0b90-452d-bbf4-b51b1b83ca6e","resolution":{"observed_at":"2026-08-07T14:53:57.294371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:57.144293Z","title":"A foundation model for mu- sic informatics,","venue":null,"work_id":"bc1d98a0-77ea-4b7e-ae03-092dd59fb748","year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.939877Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:cc290cc6d67511ccaa62b6a31242cddede3fb4df6eaf96444701447397ee5f9d","observation_id":"71c8d268-958a-4910-b6f1-e18128c47276","resolution":{"observed_at":"2026-08-07T14:53:57.217054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-07T08:20:39.814613Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-07T14:53:51.992360Z","title":"Towards a rigorous science of in- terpretable machine learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:51.992360Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:68573db70a61a92f26a75c4ee30ff5d90630f9d7637e673452a1546286db3ca6","observation_id":"359e073f-3a06-4bee-b48c-1ec080d5ab60","resolution":{"observed_at":"2026-08-07T14:53:51.992360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04972","last_updated":"2019-06-12T07:08:01Z","snapshot_observed_at":"2026-07-06T07:59:43.450553Z","submitted_at":"2019-06-12T07:08:01Z","title":"Toward Interpretable Music Tagging with Self-Attention","version":1},"cited_work":{"arxiv_id":"1906.04972","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04972","snapshot_observed_at":"2026-08-07T14:53:54.521427Z","title":"Toward Interpretable Music Tagging with Self-Attention","venue":"cs.SD","work_id":"8dd2bdd6-82f7-4d79-aa1d-95668dba684a","year":2019},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.056020Z"},"links":{"cited_paper":"/paper/1906.04972","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:5b76310f7c5e7cf43d17a2520b28d419d5c667963c598c9c4ef64c164b3ddbd2","observation_id":"39b0e644-ef53-4aae-8ee0-22dc9a45b7a7","resolution":{"observed_at":"2026-08-07T14:53:54.589765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10496","last_updated":"2025-03-17T18:21:48Z","snapshot_observed_at":"2026-07-06T19:16:14.638445Z","submitted_at":"2024-09-16T17:28:21Z","title":"MusicLIME: Explainable Multimodal Music Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10496","snapshot_observed_at":"2026-08-07T14:53:52.124688Z","title":"Musiclime: Explainable multimodal music understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.124688Z"},"links":{"cited_paper":"/paper/2409.10496","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:762f00e5037f077e8e2fc31b5094f046f2a02af6f0a4f6ec7921377a07395a80","observation_id":"c8325e61-88a7-473a-a9ac-3d089cdc5699","resolution":{"observed_at":"2026-08-07T14:53:52.124688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12485","last_updated":"2022-08-29T09:43:32Z","snapshot_observed_at":"2026-07-06T13:45:42.509291Z","submitted_at":"2022-08-26T07:45:29Z","title":"Concept-Based Techniques for \"Musicologist-friendly\" Explanations in a Deep Music Classifier","version":2},"cited_work":{"arxiv_id":"2208.12485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.12485","snapshot_observed_at":"2026-08-07T14:53:54.377820Z","title":"Concept-Based Techniques for \"Musicologist-friendly\" Explanations in a Deep Music Classifier","venue":"cs.SD","work_id":"a0e1a342-9c69-4846-982c-738b255364f9","year":2022},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.169262Z"},"links":{"cited_paper":"/paper/2208.12485","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:5ebafe8c46a3d1e6af11190dd961e4cbdb5c5d0c1d21f7731b2b3959953a21f5","observation_id":"a3c0c8c8-ee0f-4968-a4e2-cba288bd14f6","resolution":{"observed_at":"2026-08-07T14:53:54.416368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09318","last_updated":"2024-02-14T17:13:36Z","snapshot_observed_at":"2026-08-03T19:10:53.033717Z","submitted_at":"2024-02-14T17:13:36Z","title":"Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio","version":1},"cited_work":{"arxiv_id":"2402.09318","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09318","snapshot_observed_at":"2026-08-07T14:53:54.076313Z","title":"Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio","venue":"cs.SD","work_id":"18e54f01-2619-4bcc-96ea-6ab0e8fa6984","year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.226102Z"},"links":{"cited_paper":"/paper/2402.09318","citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:1f9e3e5e937e2ab1169d6f9fe015a0a688dcf7de245950088adda0aac11915a8","observation_id":"965c7406-a725-4d93-a1a9-c812fd37b3b7","resolution":{"observed_at":"2026-08-07T14:53:54.206249Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:56.869715Z","title":"A model you can hear: Audio identification with playable prototypes,","venue":null,"work_id":"3ce8a5ea-7e89-46f0-8436-7af842059ec8","year":2022},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.278944Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:762ce37bb94b7c87f4bff03de48004a71182a805de6ac17fae03ba4e8d1afad5","observation_id":"b73d5b03-84c2-4a82-88c0-fbc29404e6ea","resolution":{"observed_at":"2026-08-07T14:53:56.996396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:52.373651Z","title":"Stop explaining black box machine learning models for high stakes decisions and use interpretable models instead,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.373651Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:e2bd7b0c4c5836686b9bbfafdad24d0944315a7d8d22e73a134054b07d581d2d","observation_id":"0914cd6b-9a2d-4246-a359-e0f5a848d0e6","resolution":{"observed_at":"2026-08-07T14:53:52.373651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:56.555318Z","title":"A data-driven approach to mid-level perceptual musical feature modeling,","venue":null,"work_id":"770fcc9e-bc99-4e4d-9017-28385cfa9e94","year":2018},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.466669Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:d3e12b41a799d5f1cfb201067df0b865f125f16246456c2fb5e0565b1a71de8b","observation_id":"64a13951-47a4-4c55-9100-4f207c74fefd","resolution":{"observed_at":"2026-08-07T14:53:56.709324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.3527788","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:53.881461Z","title":"Towards Explainable Music Emotion Recognition: The Route via Mid-level Features","venue":null,"work_id":"37625f74-7edd-4a44-bd92-2a8a75e04e62","year":2019},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.538179Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:c2e1e7aa667e773dc3b0fab8e4d41fe81a10357ce809cbd739d80d0bc5673b21","observation_id":"77d8b2a5-fc6b-4c18-8433-23cab438a81e","resolution":{"observed_at":"2026-08-07T14:53:53.955000Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:56.405274Z","title":"Per- ceptual musical features for interpretable audio tagging,","venue":null,"work_id":"c2a487c1-452f-4637-9589-066026d00889","year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.570260Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:fbc67e1e41545fe0c38b7a1d9e3d96ddfb946a07246845603928a87531b13337","observation_id":"9ff98348-d789-4f01-a463-e4200cfebf70","resolution":{"observed_at":"2026-08-07T14:53:56.482812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:56.163979Z","title":"The role of structure in the mu- sical expression of emotions,","venue":null,"work_id":"c5988186-823e-4685-9966-8e161afce9b3","year":2010},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.666559Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:dea6db65713b0664824aed389d674305e0cf70ec67822871157a83ea81b58fb2","observation_id":"1dd101ae-13d6-478a-9bf5-5cc722130602","resolution":{"observed_at":"2026-08-07T14:53:56.257148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.991236Z","title":"A multidimensional study of perceptual-emotional qualities in music,","venue":null,"work_id":"9444052b-b440-45e8-8517-4f8c817f913a","year":1972},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.754187Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:9112fbe41fdb2b829c4933a70fea9737c00114d969999c76086564101b269bad","observation_id":"cf1849bf-89bb-45f5-87c2-1ed9c5684001","resolution":{"observed_at":"2026-08-07T14:53:56.048675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.797095Z","title":"Rhyme and style fea- tures for musical genre classification by song lyrics","venue":null,"work_id":"7bc03091-8416-47af-ab38-f225d6c84dde","year":2008},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.825837Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:b26f984bf447b9ebcc87f1ead36250110e0df818ba4d80500bcdeb611667dd9a","observation_id":"81dca5af-72ad-4519-97e1-f9fb05ba914a","resolution":{"observed_at":"2026-08-07T14:53:55.889805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.641660Z","title":"Lyrics-based analysis and classifica- tion of music,","venue":null,"work_id":"59542730-c935-4cc7-8355-c8ccc7f6feff","year":2014},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.864656Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:e60c534b6b3f7efaa72be196c52ac6078662d1190df7ab696f85cde6105fd220","observation_id":"9c10ec42-e09e-4b71-9c50-2c0d0ffbe092","resolution":{"observed_at":"2026-08-07T14:53:55.715333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.525160Z","title":"Es- sentia: an open-source library for sound and music analysis,","venue":null,"work_id":"67a9ef79-7f47-4282-9204-8146db7fd212","year":2013},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:52.932378Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:c68d6226840d327f076477f2eb512fce08274b0165a575ba0c54004a5daf0b2a","observation_id":"713c26e1-562e-4b4e-bea4-386abe665d6d","resolution":{"observed_at":"2026-08-07T14:53:55.573008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.403725Z","title":"Func- tional harmony ontology: Musical harmony analysis with descrip- tion logics,","venue":null,"work_id":"c914d29f-3263-4650-a4c7-ed83dd9eb9fe","year":2022},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.043631Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:27d04044170001d47a2d0f292c77488eb31d716ecbb605a671c8ddd5a6cde8c6","observation_id":"97aad2a5-2ce2-46f5-9650-741873fb9c2a","resolution":{"observed_at":"2026-08-07T14:53:55.460436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.296567Z","title":"Exploring an em-algorithm for banded regression in computational neuroscience,","venue":null,"work_id":"27821a3d-0753-4876-bb53-fa551501cfc8","year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.138227Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:92414e1bd1f52605d3198b88519c309d846583fe8ebfa550dfa287542c6c27fd","observation_id":"beb20231-0c12-4334-8508-662adb3aa377","resolution":{"observed_at":"2026-08-07T14:53:55.353955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:53.245365Z","title":"Omnizart: A general toolbox for automatic music transcription,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.245365Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:fa93c57b48c1b1c8199446490cd110a5659ce786e34ae54cb80b028629b627bd","observation_id":"4d1de85a-f55e-4da9-8696-92285deab076","resolution":{"observed_at":"2026-08-07T14:53:53.245365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.148206Z","title":"Hybrid transformers for music source separation,","venue":null,"work_id":"f2542f3e-dd18-4f4f-aedb-c5c1b2283af2","year":2023},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.360353Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:58db39372476a6c1cddc654bf202521963717d08e85c22e047bf211de4542804","observation_id":"6f281a33-780a-43c7-a0b9-4ab006b02cc4","resolution":{"observed_at":"2026-08-07T14:53:55.216490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:53.477189Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.477189Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:c7b295e1a866a5b3af50aa6c6dae99a160407262751db9a65a13f373837fd545","observation_id":"4a679c57-ac42-4faa-b12f-f52d5612b029","resolution":{"observed_at":"2026-08-07T14:53:53.477189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:55.004961Z","title":"Exploring an em-algorithm for banded regression in computational neuroscience,","venue":null,"work_id":"17a14f7d-e9e7-47f8-9302-f53ddd14289c","year":2024},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.589454Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:6bd9b70e6c7eed9ff1fd4045c9b809ef314afe978768fea1130b2f786ca7eedc","observation_id":"183c01ab-349f-4812-be5c-6289de64390f","resolution":{"observed_at":"2026-08-07T14:53:55.068768Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:54.852850Z","title":"The mtg-jamendo dataset for automatic music tagging","venue":null,"work_id":"5d654ab5-67f0-40f3-85a6-b9b2ac001067","year":2019},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.687377Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:9ca20fd70cb3b4cb77b05694e7fd294e2ebaea15c2d8873e14e264bf67a21fd3","observation_id":"0d69e831-6bbf-4a57-8776-58de04a046ae","resolution":{"observed_at":"2026-08-07T14:53:54.924447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:53.743257Z","title":"Automatic mu- sic genre classification based on modulation spectral analysis of spectral and cepstral features,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:53.743257Z"},"links":{"citing_paper":"/paper/2505.17233"},"observation_digest":"sha256:77eb74789e4ddd74534e21f46c9462e2d19f8946b5c2f03c288f4f0c02ee0ec7","observation_id":"65795954-baef-403b-ba72-88c5752d100f","resolution":{"observed_at":"2026-08-07T14:53:53.743257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17233","last_updated":"2026-05-27T08:04:33Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T14:48:13.803840Z","submitted_at":"2025-05-22T19:15:48Z","title":"Semantic-Aware Interpretable Multimodal Music Auto-Tagging"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":5,"verified_fuzzy":16},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2505.17233."}