{"as_of":"2026-08-07T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc76226acbd1e80bb729ebb0b9128634ac6e929bf8345896e3a74b1ebeb4db27","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:10:28.815628Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:10:28.639038Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08800","snapshot_observed_at":"2026-08-04T20:10:28.639038Z","title":"PianoV AM: A Multimodal Piano Perfor- mance Dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.639038Z"},"links":{"cited_paper":"/paper/2509.08800","citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:916b99476434ccc3fb3726b67b008995aa0a4953f4ec16be25b01c37ad73e6ff","observation_id":"964ebae7-ac1f-476f-a4ab-02bd470b67f9","resolution":{"observed_at":"2026-08-04T20:10:28.639038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.08800/citation-record","integrity":"/paper/2509.08800/integrity","json":"/paper/2509.08800/citation-record.json","paper":"/paper/2509.08800"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08800","snapshot_observed_at":"2026-08-04T20:10:28.639038Z","title":"PianoV AM: A Multimodal Piano Perfor- mance Dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.639038Z"},"links":{"cited_paper":"/paper/2509.08800","citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:916b99476434ccc3fb3726b67b008995aa0a4953f4ec16be25b01c37ad73e6ff","observation_id":"964ebae7-ac1f-476f-a4ab-02bd470b67f9","resolution":{"observed_at":"2026-08-04T20:10:28.639038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.645157Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.645157Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:15083d2bcfb4fd96101099ec15846500be475d18f81e2315561856b7657be8b3","observation_id":"130c9273-fe3a-4f95-983c-176b736ffe0b","resolution":{"observed_at":"2026-08-04T20:10:28.645157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.650077Z","title":"3.1.1 Acquisition Workflow The acquisition workflow comprises the following steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.650077Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:75095a5a1e5a7d1b4f2d3e51d36c82b1ed0db8a087f8f8367de817c6e0196b2c","observation_id":"e06943d8-dcc6-4b63-8fc1-c82a2b9ceb09","resolution":{"observed_at":"2026-08-04T20:10:28.650077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.655087Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.655087Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:2fa0de28e03d9574fc0c4ee6873f8f19318234da88e010120a0cee0f585c28c4","observation_id":"479029ee-adcd-4d06-bc8c-22bca00587b7","resolution":{"observed_at":"2026-08-04T20:10:28.655087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.660319Z","title":"The algorithm first processes performance videos to map hand landmarks to potential finger candidates for each MIDI note","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.660319Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:ff562262c593af45dc6363ee39210bb0ab8c355d4e24232a0bd5ce80ee26b9a0","observation_id":"2ab4bd4d-121a-43c4-8dec-6fdc4096b406","resolution":{"observed_at":"2026-08-04T20:10:28.660319Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.665998Z","title":"The audio-visual experiments are specifically designed to assess the visual modality’s contribution to enhancing performance under challenging acoustic conditions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.665998Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:4e0a86c3bd9f5826259127a502f7af88de329c25fc7e785909a8f549b5972021","observation_id":"28e94f89-c224-403d-8168-0ce4ce341eb4","resolution":{"observed_at":"2026-08-04T20:10:28.665998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.671360Z","title":"While this approach streamlines data acquisition, the dataset exhibits biases in performer identity, pedal usage, and composer representa- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.671360Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:b59d326ba4bcf76c17d187b9ef16bf39dfee346811c0ff5f3f6530e0bda8249d","observation_id":"9d330d66-2e51-4b24-b903-73e5b5562438","resolution":{"observed_at":"2026-08-04T20:10:28.671360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.676419Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.676419Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:67098c073a12c38d40a67cd46421439e820d4274bd24f6faf5836edf8fe2d00f","observation_id":"bdc06b54-5473-42fd-b41a-a739d1ec05be","resolution":{"observed_at":"2026-08-04T20:10:28.676419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.682160Z","title":"KH2023-235)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.682160Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:7237361e79041784d96cc2101a95ff252c6064e1c5028c1cd413cf069b96b5f6","observation_id":"70693e38-78a4-4dcb-b710-38ba3bbe857f","resolution":{"observed_at":"2026-08-04T20:10:28.682160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.687452Z","title":"This research was supported by the National Research Foundation of Ko- rea (NRF) funded by the Korea Government (MSIT) under Grant RS-2023-NR077289 and Grant RS-2024-00358448","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.687452Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:2154576ee88c4777f37817ed39172433f8dfb452d75afc5d5dec42e2e7f411b5","observation_id":"075ea472-648f-4e77-9ee9-7be1c2d7fbef","resolution":{"observed_at":"2026-08-04T20:10:28.687452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.692336Z","title":"Hearing and seeing musical expression,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.692336Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:c47e8a7f4a34b9614e591b2a4b47cc114265ac792a26ed29fbfcd496ab9547ac","observation_id":"8cc3f061-05cb-42f4-90ab-6aec9944d7b6","resolution":{"observed_at":"2026-08-04T20:10:28.692336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.697840Z","title":"When the eye listens: A meta- analysis of how audio-visual presentation enhances the appreciation of music performance,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.697840Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:23dfad5f2fd7392e8fe82de4cc0df3554509a4bf485f44998fdfcbdac3ce7e8b","observation_id":"e45a5372-11d2-40dc-9bad-100072cd9547","resolution":{"observed_at":"2026-08-04T20:10:28.697840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.703313Z","title":"Cre- ating a multitrack classical music performance dataset for multimodal music analysis: Challenges, insights, and applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.703313Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:cd556e3375c79f235f51852673f9783aed6e439d3188d0aee08ffa45a4ef353a","observation_id":"498b406c-95ef-4508-ac8a-905e7c9ef5ef","resolution":{"observed_at":"2026-08-04T20:10:28.703313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.708145Z","title":"Audiovisual analysis of music perfor- mances: Overview of an emerging field,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.708145Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:4a99ac1fa351afc6912cf28f47dbb52bb4206e39ace6cf5bc3038e1f4abeda6b","observation_id":"a212f02a-763a-4cf2-b389-ddedf14b862a","resolution":{"observed_at":"2026-08-04T20:10:28.708145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.713010Z","title":"Sight to sound: An end-to-end approach for visual piano transcription,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.713010Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:1a52659239e89b08a78ee62a997da3c24b378ce76dfd70aae4e2507552dfac31","observation_id":"cd4a110f-970f-4e44-af6a-7da794954850","resolution":{"observed_at":"2026-08-04T20:10:28.713010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.717747Z","title":"A crnn- gcn piano transcription model based on audio and skele- ton features,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.717747Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:e5ed80add15e8bb2d41849a3536915e3db7f4ea59b39284823d7c8d253446446","observation_id":"7e9dde21-1c57-485e-ad1a-59baafbd79db","resolution":{"observed_at":"2026-08-04T20:10:28.717747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.722499Z","title":"Audiovisual source associa- tion for string ensembles through multi-modal vibrato analysis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.722499Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:1114a5ecaa8e7054d9a8845ae7183834caf0a40693579f17772f538aac981933","observation_id":"e4b311b7-a105-4823-b065-3063cb4308a8","resolution":{"observed_at":"2026-08-04T20:10:28.722499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.727250Z","title":"A cap- pella: Audio-visual singing voice separation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.727250Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:14908551d93e2384301e277b6c0843fd253f390cf0bab9587699dfd37391e47e","observation_id":"d8c293d1-aff6-462d-a191-e264c9922483","resolution":{"observed_at":"2026-08-04T20:10:28.727250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.731772Z","title":"Identifying melodic motifs and stable notes from gestural informa- tion in indian vocal performances,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.731772Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:d082dee7f298c7d5f16334980e523053537aa4bbea075ec8806a15393c996bc5","observation_id":"72e34c64-5ced-4c36-afae-fd56884a2c14","resolution":{"observed_at":"2026-08-04T20:10:28.731772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.736198Z","title":"Enabling factorized piano music modeling and generation with the MAESTRO dataset,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.736198Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:42c9ade109fd621ac661671ee0a490579bc8ab46833ed316392f572de6728bf5","observation_id":"958d63e9-86ef-4131-ae13-37ccf668433a","resolution":{"observed_at":"2026-08-04T20:10:28.736198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.740883Z","title":"Maps - a piano database for multipitch estimation and automatic transcription of music,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.740883Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:d9e7ba3b5fb2aa787cc1092e4efa23a628bbc8c3566d55b55156338c1b5ea595","observation_id":"154fa59a-a7df-4d63-8e36-2179d8006208","resolution":{"observed_at":"2026-08-04T20:10:28.740883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.745204Z","title":"Statistical learn- ing and estimation of piano fingering,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.745204Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:a8225125ec4b19a8c7faf42b612c3837125db968d42b01b730489ada6a03cd2d","observation_id":"94fc33e2-5136-45fd-8d21-8f0bb28dd819","resolution":{"observed_at":"2026-08-04T20:10:28.745204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.749621Z","title":"Automatic piano fingering from partially an- notated scores using autoregressive neural networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.749621Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:b6c74fdb698824643c9df36e0c32891e6715a8964017e1e9c200326162ba27f9","observation_id":"310a130e-ebcd-4748-bb57-670cd37d4764","resolution":{"observed_at":"2026-08-04T20:10:28.749621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.754701Z","title":"Onsets and frames: Dual-objective piano transcription,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.754701Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:78289a0da91adf5fbebb7ea731271564ad4a2455a8c52ddee0b72fabdd46b128","observation_id":"579dc6d4-0886-4450-9419-669ad5656f6c","resolution":{"observed_at":"2026-08-04T20:10:28.754701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.759108Z","title":"High- resolution piano transcription with pedals by regressing onset and offset times,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.759108Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:39fe78e0279e33c4ade81210de89378ada73aadcd84addabba211b24ebe9f09b","observation_id":"3716dc2f-9ea8-4f7d-8335-c50aeb62fdad","resolution":{"observed_at":"2026-08-04T20:10:28.759108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.763614Z","title":"Hppnet: Modeling the harmonic structure and pitch invariance in piano transcription,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.763614Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:2b84ae03533b6dc66bb0fefe156ac9dc9449fc1d0bc742dac600c444ad1e0458","observation_id":"e46bf531-8af9-4043-af7c-1d685a80753f","resolution":{"observed_at":"2026-08-04T20:10:28.763614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.768338Z","title":"Scoring time intervals using non- hierarchical transformer for automatic piano transcrip- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.768338Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:3aa3867adadf1e2ef84aa6c9cea00ea2fcec9ed81e04c264eca4601fb4c764d6","observation_id":"b940e44e-5279-4361-8ce0-5a79a698c595","resolution":{"observed_at":"2026-08-04T20:10:28.768338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.772730Z","title":"A data-driven analysis of robust automatic piano transcription,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.772730Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:b1223d8f6c2e2654f7fd97b3621db18399ecb0e3ae87b3af1115467655ac49c7","observation_id":"e3a010c2-ad2b-4566-8242-b74d699f9366","resolution":{"observed_at":"2026-08-04T20:10:28.772730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.777423Z","title":"Automatic piano music transcription using audio-visual features,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.777423Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:f1c81cbb2047ebe9328b97a7b1d3f708926bf8cf626cf6ff39305c1678df6a02","observation_id":"8ee34163-3fdd-4261-835a-6b6359cdf65b","resolution":{"observed_at":"2026-08-04T20:10:28.777423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.781806Z","title":"An audio-visual fusion piano transcription approach based on strategy,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.781806Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:3393e41bf4f20edf24c06ed29bd6e306a514f5453c470186dc06781965eff11f","observation_id":"03a36bc5-43bf-471f-b833-6922cd34c4c2","resolution":{"observed_at":"2026-08-04T20:10:28.781806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.786343Z","title":"A two-stage audio-visual fusion piano transcription model based on the attention mechanism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.786343Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:9d2802acf13ccffba236b056d62a7e3cfb1197118f74238fafe5464dd4ce5a58","observation_id":"f8f0f161-50f0-4567-868f-8b646cf72239","resolution":{"observed_at":"2026-08-04T20:10:28.786343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.790846Z","title":"pyloudnorm: A simple yet flexible loudness meter in python,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.790846Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:6badbfb11cf5f432f56a8c2a56a3a1a2d574f34b88f5407382270890f2053e7d","observation_id":"a7a41f6a-88f5-4923-bde4-844b26dc220c","resolution":{"observed_at":"2026-08-04T20:10:28.790846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10214","last_updated":"2020-06-18T00:19:13Z","snapshot_observed_at":"2026-08-05T13:45:10.909926Z","submitted_at":"2020-06-18T00:19:13Z","title":"MediaPipe Hands: On-device Real-time Hand Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10214","snapshot_observed_at":"2026-08-04T20:10:28.795347Z","title":"Mediapipe hands: On-device real-time hand tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.795347Z"},"links":{"cited_paper":"/paper/2006.10214","citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:237b9e0d20f9caddbe8b711c451d536d7cbd54d2a7c0f26f71f888dbb4a9a6c2","observation_id":"c994a984-933c-415d-8984-045e538233c7","resolution":{"observed_at":"2026-08-04T20:10:28.795347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.800894Z","title":"Mir_eval: A transparent implementation of common mir metrics","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.800894Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:61b439fe6e5c0ce936b392746959f584a2248072217de6109e01b0c38ec32a5e","observation_id":"1c437708-224f-4e05-abdf-82e9e8bcf9a6","resolution":{"observed_at":"2026-08-04T20:10:28.800894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.806234Z","title":"Towards robust transcription: Exploring noise injection strategies for training data augmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.806234Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:db97f52974e43f6f297482eb9f7ace73747f2033f6b1df6d605eff3e85b9380b","observation_id":"20f6b00f-5052-4abe-902f-ed93f626b216","resolution":{"observed_at":"2026-08-04T20:10:28.806234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.810724Z","title":"ViTPose++: Vision Transformer for Generic Body Pose Estimation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.810724Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:300d658c3feb6beb676d23f39bbd2560becd9e7242f908ac54c0b70c0df5d9f3","observation_id":"839cc456-2c13-409e-8a4c-78bcd30128f7","resolution":{"observed_at":"2026-08-04T20:10:28.810724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:10:28.815628Z","title":"Hamba: Single-view 3d hand reconstruction with graph-guided bi-scanning mamba,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:28.815628Z"},"links":{"citing_paper":"/paper/2509.08800"},"observation_digest":"sha256:17c60f92500ee59f4b24b461b6e70e18d295c02e59dcd305822002308626e9a3","observation_id":"a62f0ef3-e0c6-4317-939f-0234f785a273","resolution":{"observed_at":"2026-08-04T20:10:28.815628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08800","last_updated":"2025-09-10T17:35:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-04T20:10:28.280777Z","submitted_at":"2025-09-10T17:35:58Z","title":"PianoVAM: A Multimodal Piano Performance Dataset"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2509.08800."}