{"as_of":"2026-08-10T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bdc06da6b7a2f05c2a0e13f008f76bcdf9d3b38a26d1395dfa20f84065213c78","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:13:10.712428Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T03:57:04.932763Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T03:58:03.090735Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"cited_work":{"arxiv_id":"2506.22237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22237","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-tuning midi-to-audio alignment using a neural network on piano roll and cqt representations","venue":null,"work_id":"04084cc3-b56e-4e11-9499-87fe7a7d1934","year":2025},"citing_paper":{"arxiv_id":"2605.20014","last_updated":"2026-05-19T15:42:12Z","snapshot_observed_at":"2026-08-07T09:07:40.422115Z","submitted_at":"2026-05-19T15:42:12Z","title":"Precise and Simple Audio-to-Score Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T03:57:04.932763Z"},"links":{"cited_paper":"/paper/2506.22237","citing_paper":"/paper/2605.20014"},"observation_digest":"sha256:40d5b2ecc4cbaa6734554b2e0caf609640a1ff7d20afb53cacf8dd21d3b84daa","observation_id":"174b1cf3-a38e-49cd-b148-bc80619e8629","resolution":{"observed_at":"2026-05-20T03:58:03.094438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22237/citation-record","integrity":"/paper/2506.22237/integrity","json":"/paper/2506.22237/citation-record.json","paper":"/paper/2506.22237"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:08.792218Z","title":"Automatic music transcription: An overview,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:08.792218Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:43b0c909d9bbe49044176318bb992e88ff14973e8d4fbedea3e76b9cf31ff72f","observation_id":"aad9b8ab-121a-4c6b-b97b-c8e3c8c7d4d9","resolution":{"observed_at":"2026-08-06T22:13:08.792218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:15.613234Z","title":"Polyphonic audio matching for score following and intelligent audio editors,","venue":null,"work_id":"64bbc09d-9a43-432a-a347-7bdae70a90a8","year":2003},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:08.821776Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:f75e61ce69c9c978c990b3f3b62e04d0108b7ddb7e9ed9053ff0b27e3464c98b","observation_id":"21a54710-9a14-478c-8ecf-16d33210f683","resolution":{"observed_at":"2026-08-06T22:13:15.697720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:15.362409Z","title":"Polyphonic audio matching and alignment for music retrieval,","venue":null,"work_id":"0ad620b3-f4dc-4ce8-935b-aa3ad5e0f928","year":2003},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:08.889211Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:1142cb72dcda0fabffb5f09fee270c5a09b7dfbad43b2a057c020a379a199d74","observation_id":"20c72a65-ea9c-4445-865c-2f2c558145c5","resolution":{"observed_at":"2026-08-06T22:13:15.508036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:15.012010Z","title":"High resolution audio synchronization using chroma onset features,","venue":null,"work_id":"aafd7d30-5f94-4148-9982-c4cc1ee27844","year":2009},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:08.974224Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:f20fb107a875e9e83eebe1de9568e0361b49c6b28c4771a004ff92241182b3ed","observation_id":"8d013b0b-6f9b-4118-869c-49544912ae80","resolution":{"observed_at":"2026-08-06T22:13:15.185677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:14.716987Z","title":"Memory-restricted multiscale dynamic time warping,","venue":null,"work_id":"06034b41-66f2-4550-8614-21af8e66aaae","year":2016},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.047208Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:e1771a5cecc12103d226e55f14f8ae5d0c96e30a98388144703945c2f58d93ef","observation_id":"af08cf6a-0c6a-4e53-854b-84a16835359f","resolution":{"observed_at":"2026-08-06T22:13:14.865279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:14.421613Z","title":"Improved score-performance matching using both structural and temporal informa- tion from midi recordings,","venue":null,"work_id":"a4f1059e-4bff-452b-84d5-a5b51d29c3a5","year":2011},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.113797Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:5a38c1b731acc5670920dafb2a7cc4fd1e516b26bca3a421ebbc83b37b3e095b","observation_id":"b8839e59-8c74-4a7d-86fc-ed28ee82769d","resolution":{"observed_at":"2026-08-06T22:13:14.568157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:14.124438Z","title":"Improved score-performance alignment algorithms on polyphonic music,","venue":null,"work_id":"db7a3d25-d6fc-47d6-aa33-6d452630ba72","year":2014},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.180083Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:f868b4518ab49394439dabe9f524880b1f67a49fd97410ee060a1c8a440ef101","observation_id":"34de866f-d3ef-48e4-bb3a-5d1cb0f756d2","resolution":{"observed_at":"2026-08-06T22:13:14.238954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.04480","last_updated":"2017-11-13T09:15:19Z","snapshot_observed_at":"2026-08-09T12:34:11.860703Z","submitted_at":"2017-11-13T09:15:19Z","title":"Audio-to-score alignment of piano music using RNN-based automatic music transcription","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.04480","snapshot_observed_at":"2026-08-06T22:13:09.229235Z","title":"Audio-to-score alignment of piano music using rnn-based automatic music transcription,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.229235Z"},"links":{"cited_paper":"/paper/1711.04480","citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:e78c2e167cf01f8c17e3419d8a2005d79fd546babcb061fefde47c2b6286a63a","observation_id":"a381917a-1eeb-4094-afbb-f7dd43afb32b","resolution":{"observed_at":"2026-08-06T22:13:09.229235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:13.949993Z","title":"An improvement on audio-to-midi alignment using triplet pair,","venue":null,"work_id":"d340b527-529d-4c94-b385-13f83714204b","year":2019},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.306209Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:3c4664d6e730f001b0ae51dd7688d4c7b89126f738f26c44adee315169f7efdd","observation_id":"b044ba98-8fea-4196-824f-0f9343535cbc","resolution":{"observed_at":"2026-08-06T22:13:14.058397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:13.687834Z","title":"Learning frame similarity using siamese networks for audio-to-score alignment,","venue":null,"work_id":"e337169b-905d-4845-8c13-cb6ce059908d","year":2020},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.369411Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:32797615fd8e5db8acb322f9cb5e4fa3b0594484b474bbc9b97105e77a11280e","observation_id":"79a210f0-e6b3-4574-8c75-52bf85270f29","resolution":{"observed_at":"2026-08-06T22:13:13.811694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:13.502811Z","title":"High resolution guitar transcription via domain adaptation,","venue":null,"work_id":"c4fb33ed-4a04-4b16-b56a-083c3fb1ffe2","year":2024},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.441820Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:43ee6c99f87ae4d222646f7697507f748b147146cd43379e608184ba70ae9228","observation_id":"e21a9067-52f1-4582-8278-8f39baa74a59","resolution":{"observed_at":"2026-08-06T22:13:13.621555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:13.301845Z","title":"Unaligned supervision for automatic music transcription in the wild,","venue":null,"work_id":"f89cc521-c9de-4b72-93ad-4f38a40e5947","year":2022},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.514423Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:a0724ccff9f71e5eb19630f08960bb2882dd48785bb74768dc323cd5cdd3bea3","observation_id":"e5e9c0a0-0609-45c3-b21a-21f47c97edf9","resolution":{"observed_at":"2026-08-06T22:13:13.403690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12247","last_updated":"2019-01-17T19:45:00Z","snapshot_observed_at":"2026-07-06T07:11:13.925078Z","submitted_at":"2018-10-29T16:48:53Z","title":"Enabling Factorized Piano Music Modeling and Generation with the MAESTRO Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12247","snapshot_observed_at":"2026-08-06T22:13:09.555630Z","title":"En- abling factorized piano music modeling and generation with the maestro dataset,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.555630Z"},"links":{"cited_paper":"/paper/1810.12247","citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:1ce9f726081e31ec8e0b5f9250819abffa495383e45f6b5c045e47cd7ec22159","observation_id":"67565bfe-acfe-4ea1-bc4e-07504dd281a1","resolution":{"observed_at":"2026-08-06T22:13:09.555630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:13.143234Z","title":"Pop2piano: Pop audio-based piano cover generation,","venue":null,"work_id":"4c9d64a7-ed60-4b31-9d3e-ed5573ce46cb","year":2023},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.608815Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:17a816fb53a62aca959c2f2bd323085d259ccb120abe6ebf9e9c34c4af2e8759","observation_id":"e3b9d687-02f7-4fe8-8064-c7e7e91c0ab4","resolution":{"observed_at":"2026-08-06T22:13:13.226164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:12.941960Z","title":"Multipitch estimation of piano sounds using a new probabilistic spectral smoothness principle,","venue":null,"work_id":"011eca85-fca8-4e38-a090-745a3c031c4b","year":2010},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.661909Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:1d2c3b676ae205b3889c5006d3849d45987f02e94cff11cd18275d8602592625","observation_id":"94faa456-115d-4603-89ca-efdcc041c0f3","resolution":{"observed_at":"2026-08-06T22:13:13.033629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:12.769012Z","title":"librosa: Audio and music signal analysis in python,","venue":null,"work_id":"57927601-0f66-4d8f-a793-88ff37826e3a","year":2015},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.727047Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:628ebed31b25c2f7df23aeb561f75b3eaa40b2ef5cd933b1855a5916139cd8da","observation_id":"8d0d3eb9-ad2e-4856-b885-379190929aad","resolution":{"observed_at":"2026-08-06T22:13:12.833734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:12.572851Z","title":"Dual task monophonic singing transcription,","venue":null,"work_id":"c03947d8-b134-409c-8e8e-861f069e65e5","year":2022},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.787825Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:8a68ec29d503755296b5ecda1ad3240d4a765bc9698198046adcd153c5fae75e","observation_id":"0d0914e9-42e2-4f87-bc45-294f0d4f7c6f","resolution":{"observed_at":"2026-08-06T22:13:12.660594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:12.349050Z","title":"Timing variations in music performance: Musical communication, perceptual compensa- tion, and/or motor control?","venue":null,"work_id":"d3bca847-0b6b-4c6d-9487-85cf5c5326bd","year":2004},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.884304Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:a809337c2c9363a1b2702345d49a399242f7420babe0c7277ffbfefbd544b11d","observation_id":"013ef9d5-7da0-4ab8-8c97-a148c666e155","resolution":{"observed_at":"2026-08-06T22:13:12.495211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:12.071804Z","title":"Music performance,","venue":null,"work_id":"97deacf7-4392-45f4-995f-a2c4b686e5d2","year":1997},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:09.981428Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:7a270c746bca7ed0e231de1d1edd04d32d6b04e9d9a678d8db5f3b0087f9b9b4","observation_id":"0bcc7b31-3885-4910-a28b-2c249337c969","resolution":{"observed_at":"2026-08-06T22:13:12.202880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:11.904911Z","title":"Estimating onset and offset asynchronies in polyphonic score-audio alignment,","venue":null,"work_id":"11ad9463-7774-4e36-acfa-e2f427447c96","year":2014},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.065594Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:22e50bb084717c8939b1bd3215396fe644ea268b6b9201049911272be31c98f2","observation_id":"69159061-672b-42e1-abac-688c5e2a100a","resolution":{"observed_at":"2026-08-06T22:13:11.973834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:11.650161Z","title":"Audio-to-score alignment using deep automatic music transcription,","venue":null,"work_id":"a804ba43-fc82-4df2-bada-3c2ac73d948d","year":2021},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.068589Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:4ded9346b77c13d31a5d34863d387578930322fbbfc4a1978d51f2ddb9c8caf3","observation_id":"3c2dfb5f-faa7-43ca-b542-e15235b9cb82","resolution":{"observed_at":"2026-08-06T22:13:11.811523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T22:13:10.071852Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.071852Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:8087cb6541d1e1a683439f64424dad1016afb4425ef4d56f4b70a2fbd025b00e","observation_id":"a012c25f-7b18-468c-8d89-acc1042ac39b","resolution":{"observed_at":"2026-08-06T22:13:10.071852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:11.462788Z","title":"mir_eval: A transparent implementation of common mir metrics","venue":null,"work_id":"a0f9762b-1f5f-4ba9-a26e-bc3b2fa1662a","year":2014},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.152054Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:ff4f00f9d089a6bd95ec3bb8a9c89ca969b1cb9cb927b762eabba38c4d33be7f","observation_id":"089ba7c6-41db-4d9f-a7bd-79f2a3595a5a","resolution":{"observed_at":"2026-08-06T22:13:11.552712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:11.322181Z","title":"Sync toolbox: A python package for efficient, robust, and accurate music synchronization,","venue":null,"work_id":"76b98ceb-f914-447b-b6db-b7138625fb51","year":2021},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.400902Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:da62a9bb8a5f9a36b9555df7f06ec1a3536b61b7939db5a6b97c10596e75693a","observation_id":"01c793de-e32c-4e53-81d7-56dcf21bc92e","resolution":{"observed_at":"2026-08-06T22:13:11.393797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:11.074842Z","title":"Sources of timing variations in music performance: A psychological segmentation model,","venue":null,"work_id":"08953528-917e-4208-83b0-2aa7990c17d1","year":1998},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.587423Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:20ab3aff95f7478299087315ff0867ed0a7a8ed9f69d228d356626fe10f48050","observation_id":"8f1a3161-ddc0-45a6-a2d4-3e7bbbbc0502","resolution":{"observed_at":"2026-08-06T22:13:11.232200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:13:10.853978Z","title":"Guitarset: A dataset for guitar transcription","venue":null,"work_id":"977e9389-9776-4a8e-88b9-fcf08c0b0ecb","year":2018},"citing_paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:13:10.712428Z"},"links":{"citing_paper":"/paper/2506.22237"},"observation_digest":"sha256:4a47f4616f7f0da29834bcefc00d9a6386656e753506b803c12e6bc644e4b1a2","observation_id":"239f4afb-2e7c-4336-8850-b7a46cb12e8d","resolution":{"observed_at":"2026-08-06T22:13:10.929043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.22237","last_updated":"2025-06-27T13:59:50Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T15:22:19.068720Z","submitted_at":"2025-06-27T13:59:50Z","title":"Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2506.22237."}