{"as_of":"2026-08-12T22:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b8d26ef9a281a48a714ea1d9b645e84541545c50cfeb16ff82c4548beb998ea","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:29:54.414352Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.05694/citation-record","integrity":"/paper/2412.05694/integrity","json":"/paper/2412.05694/citation-record.json","paper":"/paper/2412.05694"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.973627Z","title":"In: Proceedings of the 20th ACM International Conference on Multimedia, pp","venue":null,"work_id":"01bab35a-7328-4d11-bf5a-4fb4e2701779","year":2012},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.238075Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:511fb14fef48c3f24682bed77193acfad625ceff8cdac8dad853e2addc662181","observation_id":"7e885b16-e339-46bf-b04a-f3993a60a774","resolution":{"observed_at":"2026-08-11T20:29:54.977865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.961773Z","title":"Master’s thesis, Mississippi College (2018)","venue":null,"work_id":"e8f9256a-5578-4185-b48c-c063224f2e81","year":2018},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.242830Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:6e53710c7c6972f0ad2f0cc5b8f53cba5fadc950f7ab620d040a7e760132475f","observation_id":"af83a81e-9c80-403b-a626-d8cfdef8cb6a","resolution":{"observed_at":"2026-08-11T20:29:54.965797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.949165Z","title":"In: 2003 International Conference on Multimedia and Expo","venue":null,"work_id":"c333e255-b961-4228-9d3f-3ae40c83d2ce","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.247055Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:308835a85c7f0ea3a9c374a50db94d07d4f7814fbf066f5576fdf14f5522cea6","observation_id":"fee8669e-174e-4a08-b8f9-08c7550cf94f","resolution":{"observed_at":"2026-08-11T20:29:54.953982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.935728Z","title":"In: IEEE Conference on Computer Vision and Pattern Recognition, vol","venue":null,"work_id":"bea13077-0277-48d3-95cd-bc7b9ad12a15","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.251254Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:e7a19e050ff5f9f668dbd48bb8ee42e84193684ebb039378c0def76d74ef29ef","observation_id":"9c9533b6-44f2-4f8e-9ec2-c1807f7389ac","resolution":{"observed_at":"2026-08-11T20:29:54.940239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.922568Z","title":"In: The Second International Workshop on Recognition, Analysis, and Tracking of Faces and Gestures in Real-Time Systems, pp","venue":null,"work_id":"682adcdf-9c3d-49e8-b641-319d80c72fd0","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.255976Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:ad997a140646ac8c2b954739281c0b8007ffbb5072b46e6e549dece51bd2f765","observation_id":"899116bf-d8ae-487b-8e98-ecf9216358b5","resolution":{"observed_at":"2026-08-11T20:29:54.927644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.909862Z","title":"In: KES’2000","venue":null,"work_id":"664626a9-8558-4060-b5c4-bf2b3cd50ff7","year":2000},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.260089Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:9fcab6cb05bdd41580553448fde7471e469eeaaab6bb476f247fabb10952417d","observation_id":"aefa0445-4656-4d33-86d4-ae9d5a13304a","resolution":{"observed_at":"2026-08-11T20:29:54.913879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.896833Z","title":"Image and Vision Computing 21(13-14), 1077–1086 (2003) 19","venue":null,"work_id":"9171e948-ded7-4b7c-a33e-a36d61fcca6a","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.264927Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:c390e829a588f99ae3538961103cf071bf7a2705937f47f6485e415586f0cdca","observation_id":"7ac15913-8415-4ee3-9e49-8087aeb6c74f","resolution":{"observed_at":"2026-08-11T20:29:54.900651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.885025Z","title":"International Journal of Computer Vision 53, 71–92 (2003)","venue":null,"work_id":"68915346-3e28-4f5b-b2be-371a7f2b5b20","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.268733Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:59ab2b4e83b87dfe110999ca164a810902136c6e71a30dd9e91fdf173729dc77","observation_id":"7ec5e084-037c-4824-84a0-183ae45e1a63","resolution":{"observed_at":"2026-08-11T20:29:54.888905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.873329Z","title":"ACM (2023)","venue":null,"work_id":"2d6f468e-54ab-4ee8-8ae2-a3118ef4d2e3","year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.272567Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:9a845bb1052323757a5a068d8d0310f25e6e16fb432e6c897433d10140b3bf49","observation_id":"d8a42072-a7d5-4b61-8533-8101450b4f85","resolution":{"observed_at":"2026-08-11T20:29:54.877288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.860949Z","title":"In: Proceedings of the 28th ACM International Conference on Multimedia, pp","venue":null,"work_id":"c5d61f2c-7e17-41c5-9f3c-7916a277c64d","year":2020},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.276224Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:66cb2a7da4a25403742bc0a12df6609996b585aac3c10ecad76cdd8a011d92b7","observation_id":"c32c673b-630a-4dd4-ac88-073849fa12c9","resolution":{"observed_at":"2026-08-11T20:29:54.865285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.848110Z","title":"In: Pro- ceedings of the IEEE Conference on Computer Vision and Pattern Recognition Workshops, pp","venue":null,"work_id":"0b3bfd8e-d022-4918-8a88-9075d2db6538","year":2018},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.280032Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:b40adcb5e1a60717cce7e7bf146d0308f42d109c9e6d1f463c52c8a98bff5a25","observation_id":"92de68c1-81be-4ae7-bf3d-e8753c60d85f","resolution":{"observed_at":"2026-08-11T20:29:54.852786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.834548Z","title":"In: Proceedings of the 20th ACM International Conference on Multimedia, pp","venue":null,"work_id":"2dc2b84d-7f01-4bf7-893f-c83092450292","year":2012},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.283926Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:a70d79d16edf9b35e41b0ed0525579c5e7ae3d267fed987709fa85ea85cd744b","observation_id":"7b44fbbd-cb41-4e07-be24-2659b9ba55cf","resolution":{"observed_at":"2026-08-11T20:29:54.839295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.820408Z","title":"In: Proceedings of the 25th ACM International Conference on Multimedia, pp","venue":null,"work_id":"57eb9dfa-1f22-4c17-bbff-5aeca8bd338c","year":2017},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.288238Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0ca1413485e2ce33d7873d8702838f9da2478677658cfd0ed9fd2ecaec20fd05","observation_id":"129ce848-1d49-49bb-8bb6-d48b8f49b211","resolution":{"observed_at":"2026-08-11T20:29:54.824720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.807328Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(9), 10850–10869 (2023)","venue":null,"work_id":"d085be4a-7472-4820-8cbb-5b3ce7c39b4a","year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.292627Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:422ab975d4c0ae534dcbbb0394d186de01c10ca2221361dc5a2509f2604c25d6","observation_id":"00eecc1a-5602-4953-9d33-c5bae8142b0b","resolution":{"observed_at":"2026-08-11T20:29:54.811571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.793675Z","title":"In: Ranzato, M., Beygelzimer, A., Dauphin, Y., Liang, P.S., Wortman Vaughan, J","venue":null,"work_id":"a30a7b4d-5e7c-4b2b-940e-918b9d7aab8c","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.297408Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:6969a6ff03e98261ec21e87fa871a8feedc0020922d499ee4a5303b1bf49d9f4","observation_id":"5d95f13e-06f5-4dfd-9fc0-c792f8740592","resolution":{"observed_at":"2026-08-11T20:29:54.798261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.303267Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.303267Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:00bbc63a71a961617f460e1827364e5c6bdcd2b4d14c202b38e51b8b21ea1aab","observation_id":"5b923e0c-7104-41df-9900-92a9596b67a5","resolution":{"observed_at":"2026-08-11T20:29:54.303267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T20:29:54.307186Z","title":"arXiv preprint arXiv:2204.06125 1(2), 3 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.307186Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4889a114e2f705bc3c9cb706125f620ee56de7fda6573ba782243e17f0408bbd","observation_id":"b43d4af1-4782-4cc5-b34b-334e09f8e94e","resolution":{"observed_at":"2026-08-11T20:29:54.307186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07909","last_updated":"2024-11-08T06:19:33Z","snapshot_observed_at":"2026-08-09T15:37:28.200871Z","submitted_at":"2023-03-14T13:49:54Z","title":"Text-to-image Diffusion Models in Generative AI: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07909","snapshot_observed_at":"2026-08-11T20:29:54.311343Z","title":"arXiv preprint arXiv:2303.07909 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.311343Z"},"links":{"cited_paper":"/paper/2303.07909","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:a86666d6d25a95feec5de87d3344a434a6181527261e50dfedc9f72eea657e6c","observation_id":"2773e169-e9d7-4048-be4d-35a4990944d8","resolution":{"observed_at":"2026-08-11T20:29:54.311343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.770977Z","title":"In: International Conference on Machine Learning, 20 pp","venue":null,"work_id":"6d367cd3-5cc9-4f80-8c48-017dd1d2a602","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.316057Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0b1b9cd3f09e38fd20d8c9ec4e08e85526683e0a4ef22e9ffe0a993c6642bcdf","observation_id":"0b23dc04-a9b3-4eca-98a9-3cac7c4b62f6","resolution":{"observed_at":"2026-08-11T20:29:54.775332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00386","last_updated":"2022-03-01T12:11:32Z","snapshot_observed_at":"2026-08-12T08:47:54.218958Z","submitted_at":"2022-03-01T12:11:32Z","title":"CLIP-GEN: Language-Free Training of a Text-to-Image Generator with CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00386","snapshot_observed_at":"2026-08-11T20:29:54.320641Z","title":"arXiv preprint arXiv:2203.00386 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.320641Z"},"links":{"cited_paper":"/paper/2203.00386","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:506810f3083e8ad2c70a59f19ec7acd8bf4f323307232438938bc29d5d628a2f","observation_id":"7c4614a6-cdc5-4e16-86ca-d30e5eb20a41","resolution":{"observed_at":"2026-08-11T20:29:54.320641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03502","last_updated":"2023-10-05T12:29:41Z","snapshot_observed_at":"2026-08-09T05:04:50.087168Z","submitted_at":"2023-10-05T12:29:41Z","title":"Kandinsky: an Improved Text-to-Image Synthesis with Image Prior and Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03502","snapshot_observed_at":"2026-08-11T20:29:54.325321Z","title":"arXiv preprint arXiv:2310.03502 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.325321Z"},"links":{"cited_paper":"/paper/2310.03502","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:54d198f4c9e057ce1229b6288945a279788a0a9a5e1555df4691ab6dddaf0fcb","observation_id":"aee742a0-fa88-44c0-b47e-6898b4f601e4","resolution":{"observed_at":"2026-08-11T20:29:54.325321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.759448Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"6e0e734f-cdf1-41a4-95ee-d290f79147f7","year":2024},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.330238Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:df111a9e514818fbd8825b063fe27a325c8958687fc012eb10a87dc561c6cdf1","observation_id":"b2f5246e-512d-483b-8a08-4d6d6d8a6c08","resolution":{"observed_at":"2026-08-11T20:29:54.763169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.747997Z","title":"Hugging Face","venue":null,"work_id":"cadc023f-4390-44b1-8810-199844bfaece","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.334138Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:e5eb01514624ee2f0cf56599ea98347e513fb53ec6f3c60c402e502bc30a4fdb","observation_id":"e737de1d-ee89-4318-bfbd-050ac49bee5e","resolution":{"observed_at":"2026-08-11T20:29:54.752134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10647","last_updated":"2024-09-14T08:38:20Z","snapshot_observed_at":"2026-08-12T19:18:59.743422Z","submitted_at":"2023-10-16T17:59:28Z","title":"A Survey on Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10647","snapshot_observed_at":"2026-08-11T20:29:54.339111Z","title":"arXiv preprint arXiv:2310.10647 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.339111Z"},"links":{"cited_paper":"/paper/2310.10647","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:50e8a39558e29303106a3cce894da98acfef9937e7484c5c9615938487d99f06","observation_id":"6c2e3f56-952f-4a94-9a6c-3ad4f5b39a5b","resolution":{"observed_at":"2026-08-11T20:29:54.339111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.731382Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"096a1b79-eb88-41a8-82b4-18160e4d5aab","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.344081Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:9dac63334d7a84327733ac397f04ebd4706cf3ce8976cabbfaa7957d481b719d","observation_id":"2d207e72-3aa9-4abc-bdb2-c281e1f0dbf1","resolution":{"observed_at":"2026-08-11T20:29:54.736203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T20:29:54.348166Z","title":"arXiv preprint arXiv:2210.02303 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.348166Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4a242ee3d492302d89b7206407b9910c07be5b5aaa1f2f0862e15ca858d68e6a","observation_id":"99a00a15-9d7c-4106-aaa8-a1b3503d465f","resolution":{"observed_at":"2026-08-11T20:29:54.348166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.719543Z","title":"In: Proceedings of the 12th Annual ACM International Conference on Multimedia, pp","venue":null,"work_id":"c4ae7b5d-8988-4b38-b3f7-d624c0dc71c9","year":2004},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.352456Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:146bdf0c958198b731f466a7367f0271708494f6704ba0217f12ae80f141aa26","observation_id":"dc1d2b16-93fd-45a8-8ae0-f7515c84aaee","resolution":{"observed_at":"2026-08-11T20:29:54.723792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04001","last_updated":"2023-05-23T06:59:30Z","snapshot_observed_at":"2026-08-12T01:15:58.956782Z","submitted_at":"2023-05-06T10:26:56Z","title":"AADiff: Audio-Aligned Video Synthesis with Text-to-Image Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04001","snapshot_observed_at":"2026-08-11T20:29:54.356313Z","title":"arXiv preprint arXiv:2305.04001 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.356313Z"},"links":{"cited_paper":"/paper/2305.04001","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:13755f0367499ada13cb75aed34c75849b49b06c99d41905f5e05445015188ad","observation_id":"2fa31471-94e2-4c59-8004-4f6e7a7fa5b9","resolution":{"observed_at":"2026-08-11T20:29:54.356313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06654","last_updated":"2019-09-14T18:52:47Z","snapshot_observed_at":"2026-07-06T08:21:47.986256Z","submitted_at":"2019-09-14T18:52:47Z","title":"musicnn: Pre-trained convolutional neural networks for music audio tagging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06654","snapshot_observed_at":"2026-08-11T20:29:54.360572Z","title":"arXiv preprint arXiv:1909.06654 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.360572Z"},"links":{"cited_paper":"/paper/1909.06654","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d37ca2f145902c692eaa6230b9a3374d89f4686dc8271e5bc15ecf98d4137c49","observation_id":"b618e5c1-cae3-4c1b-a007-95014eb3f470","resolution":{"observed_at":"2026-08-11T20:29:54.360572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.705472Z","title":"In: Proceedings of the 2021 International Joint Conference on Neural Networks (IJCNN), pp","venue":null,"work_id":"9d58ee26-3774-4961-ae1f-1c997365a8e0","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.365152Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:e3d6b18df5704d13d062e5ec165d9c5e29a171ee32ec9125ba91cd19f0e9a8c2","observation_id":"19cb612a-a9f6-4efb-9e5d-34a91d1ea395","resolution":{"observed_at":"2026-08-11T20:29:54.709984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.692024Z","title":"In: Proceedings of the ICASSP 2022 IEEE International Confer- ence on Acoustics, Speech and Signal Processing (ICASSP), pp","venue":null,"work_id":"784ada2a-f11c-441b-b551-fb30974b6565","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.369157Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:ee65797fe7fdda2bf0ec5397fd47133e069bf37c3deea1cc819d1ad4decdfef4","observation_id":"d4258680-51f0-4095-a5bd-c9235c28fc0f","resolution":{"observed_at":"2026-08-11T20:29:54.696376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16372","last_updated":"2023-07-31T02:32:02Z","snapshot_observed_at":"2026-07-06T16:00:29.832559Z","submitted_at":"2023-07-31T02:32:02Z","title":"LP-MusicCaps: LLM-Based Pseudo Music Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16372","snapshot_observed_at":"2026-08-11T20:29:54.373108Z","title":"arXiv preprint arXiv:2307.16372 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.373108Z"},"links":{"cited_paper":"/paper/2307.16372","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:807f581aef5300b8357ebc702d59b0c3af31a0050fcedf19795a763eb8dacce6","observation_id":"ef2a7171-98f1-4fb8-842f-c7842861de31","resolution":{"observed_at":"2026-08-11T20:29:54.373108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08730","last_updated":"2024-04-02T13:35:59Z","snapshot_observed_at":"2026-07-06T16:19:13.935627Z","submitted_at":"2023-09-15T19:31:40Z","title":"MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08730","snapshot_observed_at":"2026-08-11T20:29:54.378047Z","title":"arXiv preprint arXiv:2309.08730 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.378047Z"},"links":{"cited_paper":"/paper/2309.08730","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:65beefcc28cc2cac95a8df6c4fe010182d0edabf42e087b2011b47e0daadda7f","observation_id":"276e7626-7318-4f4d-b915-f444dc6148c9","resolution":{"observed_at":"2026-08-11T20:29:54.378047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.678624Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"c5592a16-a33f-4054-b491-cf0f6caafa53","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.381890Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:81397e64be364309c11210774458bb006d2cb4390d60514153ebb946e7b9f5d3","observation_id":"78265776-e333-4a2b-8aa0-97c6030443e1","resolution":{"observed_at":"2026-08-11T20:29:54.683057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.665483Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"f4d0dc5a-d88b-4fed-a910-00c63b43ca81","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.385984Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0b1abec313694128d0811213965b48bc0ce3c64a68705cde56799209865e6f83","observation_id":"e7b345f3-9c53-4ee7-80c3-a6ed581e2465","resolution":{"observed_at":"2026-08-11T20:29:54.669328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.653456Z","title":null,"venue":null,"work_id":"27367f58-8f2e-44d2-a5d2-1659f75bfef9","year":2024},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.390061Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:63cb96deaab4cc098914a751d14d885b8d50815b6a3319c3392035c2ff07bc07","observation_id":"ff8d2097-71cf-4ea5-a0ce-84df90d36d68","resolution":{"observed_at":"2026-08-11T20:29:54.657418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.638881Z","title":"US Patent App","venue":null,"work_id":"b070655a-4eaa-4a45-b2c6-592e8bdb9edd","year":2005},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.394449Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:c1a57ad1a97746991fbdc6915fd1de6b6a5196a57c4073362ba38812b8a4c2d0","observation_id":"3ae55627-5675-4455-8328-6e6eca0669aa","resolution":{"observed_at":"2026-08-11T20:29:54.644545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.620985Z","title":"PhD thesis, Queen Mary, University of London (2001)","venue":null,"work_id":"3aa4bca5-7bb5-41a5-870e-7dcb16256710","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.398693Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d83498aee2614cc16e6504a9aecc906a9bf88824ef97f6af1092011e14b26bfe","observation_id":"e0e55f76-cf4b-4890-8a0e-b0bc26b1fd3d","resolution":{"observed_at":"2026-08-11T20:29:54.626604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.605824Z","title":"GitHub repository","venue":null,"work_id":"5cbeb817-54b6-4077-b2c9-da94e9096539","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.402443Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:196358e470d2a707463a05522d706915a4e3967fdb5badf8f013c1c13063b2d1","observation_id":"42f12d83-cd39-4f88-b570-1e2b3487a98e","resolution":{"observed_at":"2026-08-11T20:29:54.609991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.406442Z","title":"IEEE Transactions on Acoustics, Speech, and Signal Processing 26(1), 43–49 (1978)","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.406442Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:f89ffe99943c209ac642f95288a123d610aa1336467406b9133326a001900953","observation_id":"cc29fe55-d1fb-4b47-8680-ca61727c994f","resolution":{"observed_at":"2026-08-11T20:29:54.406442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.581656Z","title":"Revista Informatic˘ a Economic˘ a2(46), 94 (2008)","venue":null,"work_id":"3d4695ae-e30e-4b72-bbff-3f773123159d","year":2008},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.410227Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:23a2679610e795175b24efd0a043611473c48f6c9c5d9f81d692d8f079f6e6fa","observation_id":"b54e1bb5-ffb8-47a6-be61-90414a15019a","resolution":{"observed_at":"2026-08-11T20:29:54.586059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.567139Z","title":"Intelligent Data Analysis 11(5), 561–580 (2007) 22","venue":null,"work_id":"1109a87a-69a7-4517-862f-ef4013c2ffe8","year":2007},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.414352Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:e9f408d10370576b487ca2346345f963a92efa8df734672cd889864fcc60c050","observation_id":"f2efd128-e32c-4650-b767-3c4fa763782e","resolution":{"observed_at":"2026-08-11T20:29:54.572306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.05694."}