{"as_of":"2026-08-16T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e2d1472a9302d9847a96c0c05fd055bb03dbc0dfb85d8f91ec2a11654423dff","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T22:17:12.659462Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T22:17:12.659462Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T22:26:37.249937Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"cited_work":{"arxiv_id":"2607.06986","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06986","snapshot_observed_at":"2026-07-09T22:26:37.249937Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","venue":"cs.SD","work_id":"b5eacc79-f177-42ad-b05c-5863bf544808","year":2026},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2607.06986","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:d039cea0c56a0bf8b18d30f091338a7751aef26aa611c6fa5c478e9fed436051","observation_id":"48adc4bf-ef01-4df3-b984-20ca00a93b05","resolution":{"observed_at":"2026-07-09T22:26:37.251075Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.06986/citation-record","integrity":"/paper/2607.06986/integrity","json":"/paper/2607.06986/citation-record.json","paper":"/paper/2607.06986"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"cited_work":{"arxiv_id":"2607.06986","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06986","snapshot_observed_at":"2026-07-09T22:26:37.249937Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","venue":"cs.SD","work_id":"b5eacc79-f177-42ad-b05c-5863bf544808","year":2026},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2607.06986","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:d039cea0c56a0bf8b18d30f091338a7751aef26aa611c6fa5c478e9fed436051","observation_id":"48adc4bf-ef01-4df3-b984-20ca00a93b05","resolution":{"observed_at":"2026-07-09T22:26:37.251075Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.606637Z","title":"Metal rock style, male vocal, distorted guitars, fast tempo","venue":null,"work_id":"3b959314-e0af-426b-b512-66454f0d74f4","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:cbf2f7099abeb7ad12caa65ecfca52c6852995e40119dd1df64dc179bb202f4b","observation_id":"4355baa3-9b8b-4203-af59-31a9bba4143c","resolution":{"observed_at":"2026-07-09T22:26:37.607779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.603363Z","title":null,"venue":null,"work_id":"041e668c-1466-4d17-b3e3-1ebedbb9116c","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:0325a958ef00fb613b7360fc1bc8c5721aadb6d4dcfbc4a0ccb7b9798c409b8f","observation_id":"1b23eaf2-47ad-4d83-af5e-8844fd80d7c6","resolution":{"observed_at":"2026-07-09T22:26:37.604487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.604991Z","title":null,"venue":null,"work_id":"b4d1cd55-10d8-4176-b444-5acd4fb48e90","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:df550e752224e997308ea2d5a71084c75f84256641d4cc33264af98a687ac435","observation_id":"0d81f4e5-e33c-4548-88e3-b0fdad91e8e6","resolution":{"observed_at":"2026-07-09T22:26:37.606085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.598121Z","title":null,"venue":null,"work_id":"68934a78-d10f-4a4f-9f15-b72e95ce1464","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:7994d4717e4441105f138d99fe927a262ce731cb084a908590ab50c4f6d10f35","observation_id":"4041766b-f883-48df-aa3e-c23be5651c03","resolution":{"observed_at":"2026-07-09T22:26:37.599294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.599851Z","title":"62576347)","venue":null,"work_id":"6fe2b4af-83bc-43b6-9a40-f31039de5530","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:c7ec181c064a038914dfe02884a0cdbce35993c18aed7c18a82d16fcf939a81a","observation_id":"4123743b-a33b-4c7e-866b-19728af8a7a6","resolution":{"observed_at":"2026-07-09T22:26:37.600960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.601504Z","title":"All technical content, ex- perimental design, results, and conclusions were produced and verified by the authors","venue":null,"work_id":"238de93c-27ac-43f4-8b05-89c52a3c9c61","year":null},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:4d467043c8f220bea14e40cce623a0dbe33880b35e15752d9517c10616054910","observation_id":"ae34dac1-61a6-47ef-8a2a-40ed93bca918","resolution":{"observed_at":"2026-07-09T22:26:37.602806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.610028Z","title":"Muskits: an End-to-end Music Processing Toolkit for Singing V oice Synthesis,","venue":null,"work_id":"b6f1adf2-7c6a-4ac1-b1e6-7febf275db83","year":2022},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:8560d92858ae3fb36100eab7eaab4bb7c44a8a2c666936fc6c5dac6108295cd3","observation_id":"94f8b4c0-b010-47b2-a627-e779dbf0150e","resolution":{"observed_at":"2026-07-09T22:26:37.611325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.617378Z","title":"Sequence-to- sequence singing voice synthesis with perceptual entropy loss,","venue":null,"work_id":"ec0c1717-ae78-444f-b4a8-7ae7e71593bd","year":2021},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:934a96c36341fa9b81e7af4419ff7aec2a8f0be5b80bc0cb7574d770731deb30","observation_id":"58483d41-10ed-4a87-a58a-b6bc0ae48ae6","resolution":{"observed_at":"2026-07-09T22:26:37.618652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:36.866466Z","title":"Visinger: Variational inference with adversarial learning for end-to-end singing voice synthesis,","venue":null,"work_id":"e64b59c7-5df3-448d-89f3-ace77e72c7ed","year":2022},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:2eb6a49647f2a53db6bbf7220884a5618a7fd64c38a5f931a872499a6c64b5cc","observation_id":"d3063b33-0522-4549-8e59-161f658a3949","resolution":{"observed_at":"2026-07-09T22:26:36.867518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.587291Z","title":"Diffsinger: Singing voice synthesis via shallow diffusion mechanism,","venue":null,"work_id":"1bb8e2c1-f7da-43a5-bf9c-69216ded785b","year":2022},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:6003c3135515a429a46602118825692ce0707c4ef92641cf0956432beda831f9","observation_id":"eb64628e-b8eb-433a-aa9d-5ed7f9682134","resolution":{"observed_at":"2026-07-09T22:26:37.588437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.592459Z","title":"XiaoiceSing: A high-quality and integrated singing voice synthesis system,","venue":null,"work_id":"7215f72c-2c71-4d84-b35a-6007cc650b38","year":2020},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:016b9fe1d41f8f0aaccf8781e6364b64787d6775bbe1aeeb55cf601754d58d73","observation_id":"80eb09ed-1e60-4190-8325-cc277f2df7fc","resolution":{"observed_at":"2026-07-09T22:26:37.593651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.595974Z","title":"VISinger2: High-Fidelity End-to-End Singing V oice Synthesis Enhanced by Digital Signal Processing Synthe- sizer,","venue":null,"work_id":"59a22986-c00e-44e9-a27f-46ffd89bfae7","year":2023},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:39803a998aede48b5e460bcba02f8ea453e13adc3e8a681902a1f59f1131f947","observation_id":"d8ef7de2-5d29-4363-bd34-3f274a241034","resolution":{"observed_at":"2026-07-09T22:26:37.597340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.582664Z","title":"TokSing: Singing voice synthesis based on discrete tokens,","venue":null,"work_id":"0dd0771d-2120-4862-b38a-0136a2c6090d","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:68757af2c8fc1a66ff24a24d8327dae5fe608772e46516030d47726eeea0944f","observation_id":"702aa7c5-0392-4617-9d06-c93e939e0ee6","resolution":{"observed_at":"2026-07-09T22:26:37.584049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.584912Z","title":"Expressivesinger: Multilingual and multi-style score-based singing voice synthesis with expressive performance control,","venue":null,"work_id":"37d9d504-0554-4e39-bc3c-629f1d62a9b0","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:1f54453837e28fed64e0475717c135cf5291bf1ba6194a7227fa72a4117b622f","observation_id":"14640abd-fa95-40ed-bf5d-3df870e3b4db","resolution":{"observed_at":"2026-07-09T22:26:37.586789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.594214Z","title":"Stylesinger: Style transfer for out-of- domain singing voice synthesis,","venue":null,"work_id":"5d83beef-785a-4e56-a693-635f4aa8679a","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:e1ee77f7939aea63e29601200fa4698ceaf2f04949ba59340b8c443018ab5c06","observation_id":"d3b4fc9e-2cc6-49f2-8b5a-6bc932618527","resolution":{"observed_at":"2026-07-09T22:26:37.595445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.590643Z","title":"Techsinger: Technique controllable mul- tilingual singing voice synthesis via flow matching,","venue":null,"work_id":"0cc7e054-5295-424b-8e3d-0d9ebd658ab7","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:b92a53be49ef4a96e4f9957171610b7d35ab15001f6946425e670a3bb63db771","observation_id":"4988cc13-9735-455e-833e-a362ecdd6821","resolution":{"observed_at":"2026-07-09T22:26:37.591937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.612047Z","title":"The science of singing voice,","venue":null,"work_id":"9a4da38a-d2a1-49b4-857b-5b0b0528d984","year":1990},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:7b73f69e03484f52c4bd19707150290cd8b437c24719f4c32d27f72d7c14f5f4","observation_id":"d717c3e8-86b8-4965-8813-26cd449960f2","resolution":{"observed_at":"2026-07-09T22:26:37.613189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.574196Z","title":"The do re mi’s of everyday life: the structure and personality correlates of music preferences","venue":null,"work_id":"0886077b-3271-4cd1-a2a6-fcc2877bfc91","year":2003},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:e83f4c797ccaeeaabc5def76bfcf731dcbf802ae7e76686bfc3f48c5e5430f76","observation_id":"7ca6eeee-f4ad-44e9-8d52-3e30c1c28d1a","resolution":{"observed_at":"2026-07-09T22:26:37.575400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.613726Z","title":"Utilizing human memory processes to model genre preferences for personalized music rec- ommendations,","venue":null,"work_id":"a42059eb-907f-4bc5-9bca-e7ec887582d9","year":2020},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:4677e05e11d9e64d2f751bfa9d1aae34ec1d19c297272c8e05b8936822ad8b05","observation_id":"ca3a00e9-c366-4de0-b65f-6a3a20e796c1","resolution":{"observed_at":"2026-07-09T22:26:37.614965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.615500Z","title":"M4singer: A multi-style, multi- singer and musical score provided mandarin singing corpus,","venue":null,"work_id":"619f41bd-22e7-4a76-87ab-5b3771651d9a","year":2022},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:f3ea7cd8b522780ff6151831c2d8ad70765d97c7f5e31c21102cdc28542d4914","observation_id":"3dd1e422-c6d2-498a-99ae-7ac6aa96b4ac","resolution":{"observed_at":"2026-07-09T22:26:37.616704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.608305Z","title":"Opencpop: A High-Quality Open Source Chi- nese Popular Song Corpus for Singing V oice Synthesis,","venue":null,"work_id":"41e03355-3b08-4ff9-ba36-e0d95ab82072","year":2022},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:5a9f29aafdbf3ad575c3465f1e4d4446dfdba2be146404a5a294a57c43cd8801","observation_id":"b36e99a3-13b0-4911-86e9-b846c7a302c5","resolution":{"observed_at":"2026-07-09T22:26:37.609514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:36.843569Z","title":"Singing V oice Scaling-up: An Introduction to ACE- Opencpop and ACE-KiSing,","venue":null,"work_id":"5cb04cae-88ca-41e9-a531-4123bef4a869","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:ec46004a9991512b9220ef9926bae663f5b7fef1f7e0f032a41935ba63475249","observation_id":"9bebdf8f-cd52-4b7d-a7e9-c21d71f53a70","resolution":{"observed_at":"2026-07-09T22:26:36.844684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:36.847278Z","title":"Tcsinger: Zero-shot singing voice synthesis with style transfer and multi-level style control,","venue":null,"work_id":"2362aa0d-1c4a-4726-9c32-0fee425d7538","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:7a342a1c73eaf454ff3a9f2147990c8c2ccf14bf06f4f392b641ddc1a7e3291e","observation_id":"a5135eba-bdbb-452f-bcf4-f9261b959ba9","resolution":{"observed_at":"2026-07-09T22:26:36.848508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.588960Z","title":"Tcsinger 2: Customizable multilingual zero-shot singing voice synthesis,","venue":null,"work_id":"99770521-ab02-4206-bc88-0d5e2939c2ab","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:953ec2f86c9091095123d907efb74c5aefac7150ee2afea95f95a575bd3b7c6d","observation_id":"130b19ad-f86d-4d15-9f34-b00385986667","resolution":{"observed_at":"2026-07-09T22:26:37.590093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.08638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:56:37.699753Z","title":"Yue: Scaling open foundation models for long-form music generation.arXiv:2503.08638","venue":null,"work_id":"d0baf14e-f5a5-426c-bc66-4abebd8513e5","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:6e17eeb403d0a18fc15566d458cc15d6ede24a87ee320584fbb7186b645accc4","observation_id":"621dd9ef-6303-4802-9d2f-ee0a954fbbeb","resolution":{"observed_at":"2026-07-09T22:26:37.248822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01183","last_updated":"2025-03-03T05:15:34Z","snapshot_observed_at":"2026-08-16T12:53:44.442537Z","submitted_at":"2025-03-03T05:15:34Z","title":"DiffRhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion","version":1},"cited_work":{"arxiv_id":"2503.01183","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01183","snapshot_observed_at":"2026-07-09T22:26:37.242824Z","title":"Diffrhythm: Blazingly fast and embarrassingly simple end-to-end full-length song generation with latent diffusion","venue":"eess.AS","work_id":"d189d936-843d-4f66-b6aa-1e9c623d9065","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2503.01183","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:f22a60d135ddcc81a8556d969293ec94727f0183f3a6e996e735951cf51f7bc1","observation_id":"f4ea0166-5380-4e9f-be30-1987bcfd8153","resolution":{"observed_at":"2026-07-09T22:26:37.244007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12890","last_updated":"2025-07-24T08:15:02Z","snapshot_observed_at":"2026-08-14T17:18:45.240690Z","submitted_at":"2025-07-17T08:18:55Z","title":"DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization","version":2},"cited_work":{"arxiv_id":"2507.12890","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.12890","snapshot_observed_at":"2026-07-09T22:26:37.245134Z","title":"Diffrhythm+: Controllable and flexible full- length song generation with preference optimization","venue":"eess.AS","work_id":"d2fd3db1-6a22-4653-b952-3d5ab22e7f05","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2507.12890","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:8e1727e9d47066afdfc53916c5110fb1a391d9dde8165c69b5bbfc2018b13905","observation_id":"a350c03f-06af-41ef-96a4-6cc022436976","resolution":{"observed_at":"2026-07-09T22:26:37.246339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13128","last_updated":"2025-05-30T06:59:18Z","snapshot_observed_at":"2026-08-16T12:57:12.998351Z","submitted_at":"2025-02-18T18:52:21Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","version":2},"cited_work":{"arxiv_id":"2502.13128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.13128","snapshot_observed_at":"2026-07-09T22:26:37.236016Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","venue":"cs.SD","work_id":"2f7deb23-326a-4caf-bbd6-544c5769f57f","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2502.13128","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:9872037cb0ce5fd090b85b97e710a9f31ac5899552ffe28cb503d662cd730e37","observation_id":"cb1d8c5d-955f-4499-a754-988016228d27","resolution":{"observed_at":"2026-07-09T22:26:37.237236Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.11183","last_updated":"2025-09-14T09:29:33Z","snapshot_observed_at":"2026-08-13T13:15:10.300855Z","submitted_at":"2025-09-14T09:29:33Z","title":"WeaveMuse: An Open Agentic System for Multimodal Music Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2509.11183","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.11183","snapshot_observed_at":"2026-07-09T22:26:37.238386Z","title":"WeaveMuse: An Open Agentic System for Multimodal Music Understanding and Generation","venue":"cs.SD","work_id":"55006bd6-c2f4-4d76-bd72-a1c9d57bbcf8","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2509.11183","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:993ae29d006c24720263c2ae56e3619518a44f3dc5a5b7424cdd69499836d025","observation_id":"e7ad5d21-a992-4e1d-9972-66b942a70648","resolution":{"observed_at":"2026-07-09T22:26:37.239572Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.581067Z","title":"Team, “Suno,” https://suno.com/, accessed: 2026.02.01","venue":null,"work_id":"e93983b1-773b-4b22-a085-51b03948923c","year":2026},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:462cdc3d03600284e314b331f044ae27dc1ac8cd322e7b4b7bd6430ca917b44b","observation_id":"1149d7d3-364e-4ab4-9a43-8dc8c1daa1a6","resolution":{"observed_at":"2026-07-09T22:26:37.582142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-16T19:40:28.523700Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:279a6d76757b497733ed6771ff19c2986726fe5721afc92b8894c89e7e7dd6fb","observation_id":"43ee101d-0cd0-400f-859e-b792549b1595","resolution":{"observed_at":"2026-07-09T22:26:37.241727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.579395Z","title":"Mel-band roformer for music source separation,","venue":null,"work_id":"def5aac1-32cd-4667-ad78-e230c3795b15","year":2023},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:52595a0797fb5df1e679f154297ebc3087f950789e114a975c88297448c0a02c","observation_id":"4986ce76-9fd5-4be8-afe5-b03fc3ea626d","resolution":{"observed_at":"2026-07-09T22:26:37.580525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:36.836168Z","title":"Stars: A unified framework for singing transcrip- tion, alignment, and refined style annotation,","venue":null,"work_id":"21097d11-fa44-4ea0-b5e8-53403386c9f3","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:a0328333d990d491f455614401e5ce0c5f36bc783886795177844f9a798d491e","observation_id":"556294a0-d793-4ee3-ab94-44e511f236ca","resolution":{"observed_at":"2026-07-09T22:26:36.837304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.577723Z","title":"Muq: Self-supervised music representation learn- ing with mel residual vector quantization,","venue":null,"work_id":"56f45d96-54f0-43fd-9995-cd41c292ac1c","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:f43c85a966c0a1107478cdc3d3dc272b1a0ad81efdb6ca20c357b5d54ae1bcb1","observation_id":"6cb41488-3077-44e3-a3a1-11df83c0a7a0","resolution":{"observed_at":"2026-07-09T22:26:37.578872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.00015","last_updated":"2018-03-30T18:09:39Z","snapshot_observed_at":"2026-08-14T19:30:36.364778Z","submitted_at":"2018-03-30T18:09:39Z","title":"ESPnet: End-to-End Speech Processing Toolkit","version":1},"cited_work":{"arxiv_id":"1804.00015","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.00015","snapshot_observed_at":"2026-07-09T22:26:37.228985Z","title":"ESPnet: End-to-End Speech Processing Toolkit","venue":"cs.CL","work_id":"2b462409-c3d7-408a-a756-89d7d5d855c1","year":2018},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/1804.00015","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:23fef5aaf96ff43b371c85ab4b83c43cba34ca665e9dcbbc9e1a55264f7e7253","observation_id":"9c6efeec-fd26-4662-acc5-d4850817dbe8","resolution":{"observed_at":"2026-07-09T22:26:37.230070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26542","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.252201Z","title":"V oice evaluation of reason- ing ability: Diagnosing the modality-induced performance gap,","venue":null,"work_id":"b57b712b-378b-457f-abd4-d61c7f75fdd3","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:32d2ba78f3dd97913da2f623a9813369f0f91f0d6943ab8d810892db1b07deaf","observation_id":"d65cea32-8ef7-4421-9f04-684892dc8eff","resolution":{"observed_at":"2026-07-09T22:26:37.253648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.572392Z","title":"Per- formance of chatgpt, gemini and deepseek for non-critical triage support using real-world conversations in emergency department,","venue":null,"work_id":"4704dbfc-e656-40c0-93a7-1c7f8c10687b","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:c862b7f0c5bdc9f2693a2236f9563171045340f378b51f26e0b6a7c8417c6c0f","observation_id":"0b941839-003c-4378-852b-784319812552","resolution":{"observed_at":"2026-07-09T22:26:37.573621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.575931Z","title":"Emergenttts- eval: Evaluating tts models on complex prosodic, expressiveness, and linguistic challenges using model-as-a-judge,","venue":null,"work_id":"5f67d5e6-306b-4482-b3be-6d492b32d9e4","year":2026},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:3e6f09d4d42ca2e79a7d762e89cb0e0f6409cc60c838c2e1fe6896e56eaaf221","observation_id":"368777f0-78c2-45a9-a1dc-0fb397d0df4c","resolution":{"observed_at":"2026-07-09T22:26:37.577178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:5f4d4a6815975a3b1e4dc0b7c048e80fc465d31f08efedfd3936526b3b666251","observation_id":"8ca49f26-8659-4a6c-a896-76b655b15681","resolution":{"observed_at":"2026-07-09T22:26:37.232414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10911","last_updated":"2024-06-20T11:26:08Z","snapshot_observed_at":"2026-08-16T13:42:34.320541Z","submitted_at":"2024-06-16T12:15:28Z","title":"SingMOS: An extensive Open-Source Singing Voice Dataset for MOS Prediction","version":2},"cited_work":{"arxiv_id":"2406.10911","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10911","snapshot_observed_at":"2026-07-09T22:26:37.224445Z","title":"Singmos: An extensive open- source singing voice dataset for mos prediction","venue":"cs.SD","work_id":"c133e283-e77c-41f4-ba95-2caeb65e0942","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2406.10911","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:798114d7a7b270c6c51045de7f6e0b50cbd1e506d94456f12b412aeaa126a2b6","observation_id":"fe46f174-0544-4d33-b9ec-ad8eb2efe2df","resolution":{"observed_at":"2026-07-09T22:26:37.225604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01812","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.233509Z","title":"Singmos-pro: An comprehensive benchmark for singing quality assessment","venue":null,"work_id":"bd0f47f2-0178-478f-b7ab-e4239bc63527","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:f48258e722140c8d526d73bfa647d37a2b67d372f0caa60d0f337c071da1a97e","observation_id":"b1e00698-1d0c-46dd-9d99-41e1e4e66f99","resolution":{"observed_at":"2026-07-09T22:26:37.234876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03715","last_updated":"2026-04-24T06:25:24Z","snapshot_observed_at":"2026-07-06T19:46:02.181982Z","submitted_at":"2024-11-06T07:29:28Z","title":"MOS-Bench: Benchmarking Generalization Abilities of Subjective Speech Quality Assessment Models","version":2},"cited_work":{"arxiv_id":"2411.03715","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.03715","snapshot_observed_at":"2026-07-09T22:26:37.226736Z","title":"MOS-Bench: Benchmarking Generalization Abilities of Subjective Speech Quality Assessment Models","venue":"cs.SD","work_id":"a983c507-ca16-4cf9-aead-0496e3e1c6d8","year":2024},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"cited_paper":"/paper/2411.03715","citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:1cef0e6e8ab7c69f09ec909a3539c67f3baba9e7b2b69fa60063010d6c917f5b","observation_id":"3ca07d96-5db2-445d-821a-9f0febff2fe3","resolution":{"observed_at":"2026-07-09T22:26:37.227860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.570711Z","title":"Versa: A versatile evalu- ation toolkit for speech, audio, and music,","venue":null,"work_id":"ee691813-f559-4374-8d28-b5831b1d99c5","year":2025},"citing_paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-09T22:17:12.659462Z"},"links":{"citing_paper":"/paper/2607.06986"},"observation_digest":"sha256:0c7fb84ce23fb6e98c0f9b2f75c13e320e8cbea47c671d378b5d883af7cc9070","observation_id":"ec2f3b8a-ffab-4f1e-a65a-bbf33436a9bc","resolution":{"observed_at":"2026-07-09T22:26:37.571866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06986","last_updated":"2026-07-08T04:15:51Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T16:03:14.282680Z","submitted_at":"2026-07-08T04:15:51Z","title":"MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":12,"verified_fuzzy":28},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2607.06986."}