{"as_of":"2026-08-16T19:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d26e96f37c09ffab07b461fac2f9f0073a8ba239a347d0d42299f4cf84733d6","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:16:08.858565Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00813/citation-record","integrity":"/paper/2509.00813/integrity","json":"/paper/2509.00813/citation-record.json","paper":"/paper/2509.00813"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-05T13:16:07.662863Z","title":"van den Oord, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.662863Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:d0d87a460c3e3ee1c8c218d5784a6455f32f2018d5928199a16cdea7251fb63e","observation_id":"dce7a801-4223-499f-8457-887babd9e6c8","resolution":{"observed_at":"2026-08-05T13:16:07.662863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04281","last_updated":"2018-12-12T07:42:08Z","snapshot_observed_at":"2026-08-14T18:29:37.094691Z","submitted_at":"2018-09-12T07:15:26Z","title":"Music Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04281","snapshot_observed_at":"2026-08-05T13:16:07.749366Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.749366Z"},"links":{"cited_paper":"/paper/1809.04281","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:b90da87bd68416a635169f091b99f0b0890380b762f29d1ae90e7a0d5056530a","observation_id":"66025463-71e7-4db2-93c2-a3e1326619b1","resolution":{"observed_at":"2026-08-05T13:16:07.749366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.221694Z","title":"Huang, Y.-H","venue":null,"work_id":"c2d4edf5-aa01-4db5-a160-f177d0d6f80c","year":2020},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.786965Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:39b623e2966e1e64288dfc5cb325df8e4113538923df717b1684005e4514fbb2","observation_id":"5d32332a-18e1-4461-bf36-0c3b71fd8ffb","resolution":{"observed_at":"2026-08-05T13:16:09.223961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.214478Z","title":"Roberts, J","venue":null,"work_id":"0ef1cf09-fc2f-4c6c-86bb-ee75c0394ff3","year":2018},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.820137Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:a621802958f0e7089fae767be7db31ac141dc6ea7ef8a5c0d7da7523100148b1","observation_id":"84ae5698-c2f1-400a-a152-d84192c7dc54","resolution":{"observed_at":"2026-08-05T13:16:09.217109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.207121Z","title":"Payne, Musenet, https://openai.com/blog/musenet, 2019","venue":null,"work_id":"d6bc4f24-9686-48c0-84db-198a41b84935","year":2019},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:07.924616Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:b77b4e7909ec7b897122eea6f4b1e4fbeda11a349538d57db7ca9f2a7ed5dd7b","observation_id":"a74899b1-797e-4c60-b04d-c4620e0497d6","resolution":{"observed_at":"2026-08-05T13:16:09.209829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00341","last_updated":"2020-04-30T09:02:45Z","snapshot_observed_at":"2026-08-16T07:26:47.621702Z","submitted_at":"2020-04-30T09:02:45Z","title":"Jukebox: A Generative Model for Music","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00341","snapshot_observed_at":"2026-08-05T13:16:08.021311Z","title":"Dhariwal, H","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.021311Z"},"links":{"cited_paper":"/paper/2005.00341","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:d9d6e22f2b20daa364f269973591507d6ee1d5e1552c7245885edc53be6b67a1","observation_id":"dfdf4b5e-4822-46f8-a8a3-161b5d05ddd1","resolution":{"observed_at":"2026-08-05T13:16:08.021311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-08-14T02:16:19.922733Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11325","snapshot_observed_at":"2026-08-05T13:16:08.078687Z","title":"Agostinelli, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.078687Z"},"links":{"cited_paper":"/paper/2301.11325","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:2f1355a46fb4f4399c06b9a604e2a2c433b02d39dd756a35e2a7d4989392faa0","observation_id":"b301ec21-0bcd-4b2b-8bf8-7fd26685ef31","resolution":{"observed_at":"2026-08-05T13:16:08.078687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.199264Z","title":"Grötschla, A","venue":null,"work_id":"172cb6c1-0bff-4503-85a7-fe8fcb760caa","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.126387Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:0c9cc4c3fb0188a0b41da2d3d72386379417e83deeb3e9321179049809a1aba7","observation_id":"9d653753-1f83-4025-a96a-f7277427a59b","resolution":{"observed_at":"2026-08-05T13:16:09.201941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.191734Z","title":null,"venue":null,"work_id":"920b0fef-8a52-486b-a338-85a0467e949b","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.216294Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:cdc0794a398e269ad44ece4a5f20df823309df6c0daba6230cb58260911170c8","observation_id":"9cb4a3b5-4131-4f37-b156-910305ccc14e","resolution":{"observed_at":"2026-08-05T13:16:09.194279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16669","last_updated":"2025-03-20T19:31:04Z","snapshot_observed_at":"2026-08-16T12:48:08.873711Z","submitted_at":"2025-03-20T19:31:04Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","version":1},"cited_work":{"arxiv_id":"2503.16669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.16669","snapshot_observed_at":"2026-08-05T13:16:08.968653Z","title":"Aligning Text-to-Music Evaluation with Human Preferences","venue":"cs.SD","work_id":"8c1696e4-4754-4fdb-8fd1-8c83c32768b3","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.259508Z"},"links":{"cited_paper":"/paper/2503.16669","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:355cdcb1b3916d567ba601229cbe621b66507e149375205854c9dc2c521af512","observation_id":"0737ab32-876b-4bb6-9049-3c1c7d0db3b0","resolution":{"observed_at":"2026-08-05T13:16:08.972483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01374","last_updated":"2021-08-03T08:59:26Z","snapshot_observed_at":"2026-08-16T18:05:37.392596Z","submitted_at":"2021-08-03T08:59:26Z","title":"EMOPIA: A Multi-Modal Pop Piano Dataset For Emotion Recognition and Emotion-based Music Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01374","snapshot_observed_at":"2026-08-05T13:16:08.364068Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.364068Z"},"links":{"cited_paper":"/paper/2108.01374","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:78e60b27d0a79b1713302427cd0a5ed7c04fb9368e0e2e4f2288bb45168a4d9d","observation_id":"e056615a-1185-4b68-ba76-55803c85e0ec","resolution":{"observed_at":"2026-08-05T13:16:08.364068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.183788Z","title":null,"venue":null,"work_id":"33e7a0ab-ac57-4b5c-870f-dbc8129ebb6f","year":2019},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.425536Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:ce525c8033e3fcf8d174ad2dd27afc07c45b255062e56c9e92751da5ad27975e","observation_id":"b7e52106-b9b5-45c8-8c64-5426ab69d5e2","resolution":{"observed_at":"2026-08-05T13:16:09.186613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.176617Z","title":"Grekow, T","venue":null,"work_id":"f9a0ffc3-744e-471f-98e7-83796e431065","year":2021},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.553123Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:945510d9bcea98271f4c92d0f472918e2c44dcc890de7bef6383b276aa0c4c7b","observation_id":"270adc86-de4e-4202-9782-deeb0d2b2e7c","resolution":{"observed_at":"2026-08-05T13:16:09.179014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.169323Z","title":"Sulun, M","venue":null,"work_id":"f8b3e4ce-f1fc-4603-9a2c-15c9e1f6b3c5","year":2022},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.623991Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:c645e6fcc2cd3a45caf0d39f5533f0e50ceb555ee9af3798aa3f2d489a7d3ca8","observation_id":"30bbace2-6c48-4ad2-b24e-5677355dd27d","resolution":{"observed_at":"2026-08-05T13:16:09.172091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.162244Z","title":"Huang, K","venue":null,"work_id":"09074494-a365-41e7-b3e5-550e7ebea9d6","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.713555Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:c2d99d5f1010355fedbc95224e2dbfb0bbcb06cd1ad40227bd1f5d3d7ea64691","observation_id":"e70d3262-baa5-484b-8d1b-7ea2d1b1cb5e","resolution":{"observed_at":"2026-08-05T13:16:09.164631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.155005Z","title":"Turnbull, L","venue":null,"work_id":"92b7946c-0d08-4c3a-a2b4-1e0717c83a6d","year":2007},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.757141Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:8e3e48b21379755abb2549ccb59165da233fde77d6257594e971caf6b81f457b","observation_id":"83c8525f-0dc8-4b74-8d3e-a5f276e48b61","resolution":{"observed_at":"2026-08-05T13:16:09.157417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.147898Z","title":"Wang, J.-C","venue":null,"work_id":"7c4983b3-c93e-42b2-b164-2388fdb6e6c1","year":2014},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.807734Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:5a725607ca8368b418dc4ae67c82420825c12ae5386a72aba9ec61fb3ada8fcb","observation_id":"3b9916d1-a240-4103-a597-d8ddcb538166","resolution":{"observed_at":"2026-08-05T13:16:09.150589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.140942Z","title":null,"venue":null,"work_id":"1ccaac17-68c5-417a-bde7-22464144436b","year":2022},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.810737Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:434333daa6e925b3cf53cfd42cc575f11a88cbebb0b895cb0fcf4e6143e338be","observation_id":"c06411c7-ffea-4191-a4a8-b56c9f169d50","resolution":{"observed_at":"2026-08-05T13:16:09.143282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.133177Z","title":"Soleymani, M","venue":null,"work_id":"9567d192-95ad-42c9-9fc8-784d2b03eaae","year":2013},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.813455Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:e91618bb49e8eef23d2d771afb665b1275dba3358f50ea85c1d3414645d0ff07","observation_id":"1dc75f50-1efc-4ee7-bc91-e1ca8f18d7c0","resolution":{"observed_at":"2026-08-05T13:16:09.135728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.124887Z","title":"Aljanaki, Y.-H","venue":null,"work_id":"1e9f48f1-1dee-4474-a7e2-2be309683cc0","year":2017},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.816318Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:2a03ca44b0380fb1726dcf0e039d549de3e826c65355d9caa6f165f94343ea5e","observation_id":"6c249976-eb64-4417-bed8-dfdf1e86fd5b","resolution":{"observed_at":"2026-08-05T13:16:09.127649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.117634Z","title":null,"venue":null,"work_id":"06b7021f-7b0f-4fc4-89b5-430361461c6d","year":2011},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.818842Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:e7148234f1988819dc7374bf429ca3c25b25a7d9c0fa0c7c7da3702b537a3c8d","observation_id":"da07a324-6c7a-422f-94bc-ff3d84dae403","resolution":{"observed_at":"2026-08-05T13:16:09.120306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.09539","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.947011Z","title":null,"venue":null,"work_id":"279f5347-04e4-407e-a587-8c412c06cde4","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.821221Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:e8225842246c76aa945b7a60f06ffd72dcc31a77fc3ddd9f2ae146934534b331","observation_id":"03ed0fba-a768-4f20-8201-d4d01fca0255","resolution":{"observed_at":"2026-08-05T13:16:08.951935Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.109707Z","title":null,"venue":null,"work_id":"c9b49de2-5502-46b3-8f03-610a28a28d89","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.823701Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:eb4401b3c6b37146f548e89f27b3ba4bbd27c01af0ae5d753f6b0efe793e8aef","observation_id":"e381a360-5c7a-4a1b-af75-7dc2ac668da2","resolution":{"observed_at":"2026-08-05T13:16:09.112343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.101902Z","title":null,"venue":null,"work_id":"3b98c487-40e0-429c-8473-b11542465802","year":1980},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.826118Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:5c07e947a06c88ef7634a972b206b95292d5963b2b091084b1a328094434f96e","observation_id":"951b0df7-f6e1-44fa-9709-ed1e19133a4f","resolution":{"observed_at":"2026-08-05T13:16:09.104439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.094021Z","title":null,"venue":null,"work_id":"a6310ca5-a124-4a7c-82fd-2d2a944291f7","year":2011},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.828592Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:6cb49c92febaa857c2bd5fd68e5c1d17f5c9107078f964eedf1cb295d84ddd88","observation_id":"20261feb-7d76-47e2-89e6-613ea2439dae","resolution":{"observed_at":"2026-08-05T13:16:09.096510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.085949Z","title":null,"venue":null,"work_id":"1fa875bd-cb35-4001-99ee-09bbeaf95d10","year":2013},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.831316Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:307bf855cde8924278bce280d1c072bac4b2008208a2c62bd8d8e9d0b5ee1f75","observation_id":"286416a5-e8de-434a-a3a2-d868f109e49f","resolution":{"observed_at":"2026-08-05T13:16:09.088596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.077786Z","title":null,"venue":null,"work_id":"418216e9-b1f6-4d96-b659-e4cc9ce234c5","year":1999},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.833619Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:4f4284adaf33f96fd55b858cf59d9e070740a354358ec1257c4c0b9954479a6c","observation_id":"9cb1704d-0205-452a-953f-4ac30d56fb62","resolution":{"observed_at":"2026-08-05T13:16:09.080712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.069516Z","title":null,"venue":null,"work_id":"e52922d5-b347-4063-9e05-7205d04c393e","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.835995Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:31f03f9286fd0103733326857b44aacb16461a8fa2c65bc199e7dc407d37d14a","observation_id":"21770780-f01b-4927-8881-3c8317e9b653","resolution":{"observed_at":"2026-08-05T13:16:09.072360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.061371Z","title":"Copet, F","venue":null,"work_id":"e9c5e1c8-54c5-44d7-96d1-6506be783d3b","year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.838708Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:7dcf5929451aa2c116433bf3031c39252917ed6e44e8bd146669523f1a6d1922","observation_id":"d51ae088-b847-4f39-b858-c03e5d29b593","resolution":{"observed_at":"2026-08-05T13:16:09.064089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08355","last_updated":"2024-06-03T07:56:23Z","snapshot_observed_at":"2026-08-16T14:43:20.569125Z","submitted_at":"2023-11-14T17:54:38Z","title":"Mustango: Toward Controllable Text-to-Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08355","snapshot_observed_at":"2026-08-05T13:16:08.841052Z","title":"Melechovsky, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.841052Z"},"links":{"cited_paper":"/paper/2311.08355","citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:0eaabe05c4ae74bdd1e9ba90ba03e2136ece1a8868a79d368e06bc0e22b4b312","observation_id":"afb0178d-35fc-47ae-b92f-6849f77c9448","resolution":{"observed_at":"2026-08-05T13:16:08.841052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.052753Z","title":"Evans, J","venue":null,"work_id":"7104d944-c660-42b7-b70f-c595cfb2eec0","year":2025},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.843649Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:62b171292c4082d29ab3927e49cd129c7320be7b7f81e278458f2e71cffaf45f","observation_id":"2b320efe-4c96-410f-b6b5-52c9a214f87c","resolution":{"observed_at":"2026-08-05T13:16:09.055641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.044519Z","title":"Accessed: May-June, 2025","venue":null,"work_id":"3ede7117-df04-4ff4-98ca-c4162fee3fde","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.846119Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:757160d5b85ed6e71c82ec4c394dc9c68aba0680b9ec7396a493d39f2e3d3182","observation_id":"09912939-9ffe-430e-9714-e30650dec180","resolution":{"observed_at":"2026-08-05T13:16:09.047376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.036123Z","title":"Accessed: May-June, 2025","venue":null,"work_id":"e2d55e8e-4a06-45e5-91c3-0facde64aca1","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.848563Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:bdafd39bc847a047df6f016188e5cffa0e64cd600bde1774af0379ceceec6a34","observation_id":"a5064977-f3df-4845-a37d-3a68586e259e","resolution":{"observed_at":"2026-08-05T13:16:09.039052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.851290Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.851290Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:79e633bc4a08699f61ffbe784ace3a18bfe757750ed8513a14258356ba639f63","observation_id":"76b5642a-c6ab-4367-a7b3-76472c74ae5f","resolution":{"observed_at":"2026-08-05T13:16:08.851290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:08.853568Z","title":"Vaswani, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.853568Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:1d0ce822f6bab22c0710df7301ef518201ee6fc0b6c44823c0057c47e8d198ce","observation_id":"e42063d0-f024-4d67-9b1d-c7d281b09464","resolution":{"observed_at":"2026-08-05T13:16:08.853568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.017896Z","title":null,"venue":null,"work_id":"8e1a8d8e-8b41-4bc3-bf3f-d19e02916c7b","year":2024},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.856088Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:0580bf428665106d5f4effe0ce36bf7d3ac51ea784370ae56b53725d94034d2f","observation_id":"804a7458-b9d5-4c23-8da7-c3c4b3ecd1f0","resolution":{"observed_at":"2026-08-05T13:16:09.020451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:16:09.009216Z","title":null,"venue":null,"work_id":"4bd46546-3e87-413b-9316-7271a4acbf9a","year":2023},"citing_paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:16:08.858565Z"},"links":{"citing_paper":"/paper/2509.00813"},"observation_digest":"sha256:a0917da1946c99bd5e836ce7ad89c7377d197600815c7d05d2da025dd9fc3844","observation_id":"ca7958ef-85a5-4050-a16f-4998245fa4f5","resolution":{"observed_at":"2026-08-05T13:16:09.011878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00813","last_updated":"2025-09-04T07:41:31Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T07:27:32.604616Z","submitted_at":"2025-08-31T12:14:30Z","title":"AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2509.00813."}