{"as_of":"2026-08-05T14:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c19214cc04ece4ea8bb99701b1717bc1b50678951d1d220b39993ee5cf05193","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T15:25:26.576792Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T15:25:26.576792Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-25T15:25:58.956344Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"cited_work":{"arxiv_id":"1906.10996","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.10996","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","venue":"cs.IR","work_id":"448ab213-e66e-459c-be19-d8480904e7b0","year":2019},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"cited_paper":"/paper/1906.10996","citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:260dcdcd3f2390d841bd71a1a5eccedf816929b3b6fd7355583a706b6648e518","observation_id":"7c793992-3474-4b24-909c-63af84cc5dfd","resolution":{"observed_at":"2026-05-25T15:25:58.959665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1906.10996/citation-record","integrity":"/paper/1906.10996/integrity","json":"/paper/1906.10996/citation-record.json","paper":"/paper/1906.10996"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"cited_work":{"arxiv_id":"1906.10996","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.10996","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","venue":"cs.IR","work_id":"448ab213-e66e-459c-be19-d8480904e7b0","year":2019},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"cited_paper":"/paper/1906.10996","citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:260dcdcd3f2390d841bd71a1a5eccedf816929b3b6fd7355583a706b6648e518","observation_id":"7c793992-3474-4b24-909c-63af84cc5dfd","resolution":{"observed_at":"2026-05-25T15:25:58.959665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"91a1282d-9885-4981-a29e-cbb634a31dee","year":null},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:07b30f1d4ad298ee208a81889fde5efdd44c2d2e13da06ece55dbdeb2bcadc7f","observation_id":"02b39ee0-856a-4c2a-8bf8-2ceaeaa78076","resolution":{"observed_at":"2026-05-25T15:25:59.878998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"tempo” (more pre- cisely: the perceived “speed","venue":null,"work_id":"65a5e8c8-6626-4dc3-a00f-a04665b75cdb","year":2019},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:d20cd330c18cd6a7bd89994ad433f432c870ade414eb3fa22117671af3a3506b","observation_id":"3640109c-4a5b-4b4f-935c-2f21c649bb17","resolution":{"observed_at":"2026-05-25T15:25:59.885555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In our end-to-end audio– sheet music retrieval application, the results improved sub- stantially compared to the state of the art","venue":null,"work_id":"b2a84ae2-fc10-4845-82c4-36417760533c","year":2020},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:ce0d45495a31e46f25f3c67b7297d59fd5d26ccc9448fccd3c9caf02ef99ff3b","observation_id":"e42a157c-e093-4735-b27d-cde13a9e6866","resolution":{"observed_at":"2026-05-25T15:25:59.871846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Look, lis- ten and learn","venue":null,"work_id":"83324e21-40d4-4d5e-aa97-ede89615c212","year":2017},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:059125b377e07ea6cd774a51342526218f0a34deecf32532dc966f88932731fa","observation_id":"4f3f44cc-1ace-4301-b757-db1201a6fdf8","resolution":{"observed_at":"2026-05-25T15:25:59.793257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast identiﬁcation of piece and score position via sym- bolic ﬁngerprinting","venue":null,"work_id":"912e25ec-d233-46bf-8000-d84cc9ee24e6","year":2012},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:f5204eb48b7ccd030ca29e7460eee12d0fd2e7d8b41f0ca47b0b18a440de3d95","observation_id":"bc1ceb2f-05c1-4cc6-bae0-8180f49fb214","resolution":{"observed_at":"2026-05-25T15:25:59.799855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":"a2624bea-2b1c-45a5-abc6-d7ac7a531b5c","year":2015},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:0343103a1166e3935eadf73e9fc9e4a51e8dcc27f9d780fc6f7d49804887cf11","observation_id":"9c95b116-a452-4141-ad4c-3e9ff95dd5b5","resolution":{"observed_at":"2026-05-25T15:25:59.832742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrieving audio recordings us- ing musical themes","venue":null,"work_id":"59b97e81-93c3-45ea-9b57-3ac4af2451c0","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:caa382b5cab4ccb9d802b399dc0c33f6c4a2d57d2fa49d45e107c17104cc6c83","observation_id":"d728b99f-d868-49f1-b054-e3340afe6e60","resolution":{"observed_at":"2026-05-25T15:25:59.796535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Dictionary of Musical Themes","venue":null,"work_id":"d069afcf-066c-4f28-81e6-ba61bd14394c","year":1975},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:ac4448e7c6baf51e974029886864c96422a908e9af2fb800dc6a9f76c3bd24c2","observation_id":"3109e456-b8f3-4a72-a0e5-4e7a4afb23aa","resolution":{"observed_at":"2026-05-25T15:25:59.822857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Polyphonic piano note transcription with recurrent neural networks","venue":null,"work_id":"6bef2d9b-5ade-42b2-84c1-8c3e76a4a0bf","year":2012},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:15f32eee18e02f103bc33a9342545c278e50369d8404d0dccab834db12bb2aaa","observation_id":"333c5bbb-1aec-4af1-8666-5b81ade1c672","resolution":{"observed_at":"2026-05-25T15:25:59.803201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simonsen","venue":null,"work_id":"1fc9c230-f8ad-4eb3-9c87-bc9552665fac","year":2015},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:8a3fa31a9111c3357d431e00d823b9efeb07a69260b988d4620e970950371121","observation_id":"46a36704-dd78-4fdd-bc58-de2a3862be26","resolution":{"observed_at":"2026-05-25T15:25:59.857346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Le, and Oriol Vinyals","venue":null,"work_id":"adfca3db-0fbd-4965-a54e-482ac240f643","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:a65a34c31da15b150bc73d2408039ee497d0c08543f66dfbfcbbcfda3dcfdb01","observation_id":"af7c4f40-2b94-466b-9085-a3503250003b","resolution":{"observed_at":"2026-05-25T15:25:59.845624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An attack/decay model for piano transcription","venue":null,"work_id":"3547b3fb-e723-4026-a27d-6dd9ea8e4f48","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:2f907d5aa2dfc2d1d250cbec8a8e6661cf2150b29e51b5789920b30908e86602","observation_id":"9ef098d4-0736-4414-96ee-0459e1e01a32","resolution":{"observed_at":"2026-05-25T15:25:59.812703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07289","last_updated":"2016-02-22T07:02:58Z","snapshot_observed_at":"2026-07-06T04:37:28.029641Z","submitted_at":"2015-11-23T15:58:05Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","version":5},"cited_work":{"arxiv_id":"1511.07289","doi":"10.48550/arxiv.1511.07289","metadata_source":"pith","pith_arxiv_id":"1511.07289","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","venue":"cs.LG","work_id":"619b409a-ddb8-4401-b55e-d8ca367322ce","year":2015},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"cited_paper":"/paper/1511.07289","citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:0e6eb5519d31e6b3388f5f563797c4fa190feaccf7f5d419b88a89c4b090eae2","observation_id":"6ee5a995-851b-4f8b-a902-9f47a0f574c1","resolution":{"observed_at":"2026-05-25T15:25:58.947200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning audio–sheet music correspondences for cross-modal retrieval and piece identiﬁcation","venue":null,"work_id":"4334ac80-dea0-44b5-a63b-ad06038d5e40","year":2018},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:93721ca496f201199e83392ff5b018e7ed112c1108946605406f052a7ecb7cac","observation_id":"88e99aaf-ed7a-42b0-85b0-31ff4b13139c","resolution":{"observed_at":"2026-05-25T15:25:59.806607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention as a perspective for learning tempo-invariant audio queries","venue":null,"work_id":"03531d5b-5dc7-45a9-a99f-f52b882352a1","year":2018},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:185f0a72f51dbbca3034bf67ab62813dea3fb5284998adc1e0aeeb848d6d82e5","observation_id":"9c24cd7a-f144-419c-bb8e-472b3daa3bfc","resolution":{"observed_at":"2026-05-25T15:25:59.838580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-end cross- modality retrieval with CCA projections and pairwise ranking loss","venue":null,"work_id":"759cda88-b161-4e14-a520-73d6fb46fe0a","year":2018},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:887dbb3d795976c893872c27469e46d94c77ec14822d650d1565978ade3ec64e","observation_id":"5049bd3c-bf2c-45e9-b0d0-f6b9251560e2","resolution":{"observed_at":"2026-05-25T15:25:59.882259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sheet music-audio identiﬁca- tion","venue":null,"work_id":"87e9bf16-c1e0-4771-bb91-1e12a6765ae1","year":2009},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:8a068a8633b5c7bf3683736db6a104cc0ea11deec00f2fb4f140229ca5312487","observation_id":"450c9b46-17fa-4acb-8b24-c0d4c816a194","resolution":{"observed_at":"2026-05-25T15:25:59.864603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Further steps towards a standard testbed for Optical Music Recognition","venue":null,"work_id":"9b6ffb7a-399b-4a79-a3c9-147b595e2d4a","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:4a048af0bd19d21883fe2b298b13b24c24c797a5625c423f61672d8ea535ebde","observation_id":"bd84b631-3dfd-4132-a155-64821e84ee1f","resolution":{"observed_at":"2026-05-25T15:25:59.842115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Onsets and frames: Dual- objective piano transcription","venue":null,"work_id":"cdb6ede4-c15d-49a6-8dba-ba740a43d9ed","year":2018},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:5772fda4f590895435c1245ebbc4e0a55b0f9fbb808ab7d2593cf2439e0a4790","observation_id":"030e427e-0b08-4e33-affd-08ea0063c611","resolution":{"observed_at":"2026-05-25T15:25:59.815838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging printed music and audio through alignment using a mid-level score representation","venue":null,"work_id":"4368ae6e-8022-45b6-a0a6-9fcd90b31e07","year":2012},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:705ec5b07a081a4cf25c0d5ea4b569aba5e91a4e351b8aa5929a05c7d4130973","observation_id":"a5b5aa08-c30a-4278-a15a-dbcf04f0a45d","resolution":{"observed_at":"2026-05-25T15:25:59.860981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep polyphonic ADSR piano note transcription","venue":null,"work_id":"39a8940e-1c96-4cca-b956-d7827c75c3a9","year":2019},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:5e528a769070fc0eba5043b7082bbe12386ba50b67dc9853f44f0164fb3c3b53","observation_id":"b98bdce3-ff3e-41e8-a1c9-1a29b1bcdb03","resolution":{"observed_at":"2026-05-25T15:25:59.809513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the potential of simple framewise approaches to piano transcription","venue":null,"work_id":"48920680-19ad-4a05-99f8-cde3969d76bb","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:3154a62219dbb7320382ff37f6c095dd66247c02825a4fb4135a68ebf0a0f50e","observation_id":"0ead705c-eceb-4421-bcb2-6bed4caba65d","resolution":{"observed_at":"2026-05-25T15:25:59.826519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1411.2539","last_updated":"2014-11-10T19:09:41Z","snapshot_observed_at":"2026-07-06T04:00:05.122784Z","submitted_at":"2014-11-10T19:09:41Z","title":"Unifying Visual-Semantic Embeddings with Multimodal Neural Language Models","version":1},"cited_work":{"arxiv_id":"1411.2539","doi":null,"metadata_source":"pith","pith_arxiv_id":"1411.2539","snapshot_observed_at":"2026-07-02T15:17:07.122405Z","title":"Unifying Visual-Semantic Embeddings with Multimodal Neural Language Models","venue":"cs.LG","work_id":"400e54cd-2c42-418c-82b8-c43bf44e46c8","year":2014},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"cited_paper":"/paper/1411.2539","citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:0d7d8434308779975256a2eeb21eca778d1ed891fd95d3c6da2a2892e55c3e98","observation_id":"42c7da38-d271-426e-ba25-b57b0e0d5522","resolution":{"observed_at":"2026-05-25T15:25:58.953423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automated syn- chronization of scanned sheet music with audio record- ings","venue":null,"work_id":"6e1261d6-a5c7-44ff-9e8e-b316a3fe2e18","year":2007},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:a7ab35d0d8602715e4419c92f1065f71642c746e2664773b22997b4ca23545f3","observation_id":"1adf266c-e3aa-42e2-b425-5c196cfb72b0","resolution":{"observed_at":"2026-05-25T15:25:59.853791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-modal music re- trieval and applications: An overview of key method- ologies","venue":null,"work_id":"7b1eccb5-daf7-4d33-9935-b5048b24bd3c","year":2019},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:4d55d503d6bb1d4e28e3d01342b11b16db98b25c0e6be13e3bdc72971d3941da","observation_id":"c597bb1f-90d8-414c-b21a-02ce912ede2e","resolution":{"observed_at":"2026-05-25T15:25:59.819297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention and augmented recurrent neural networks","venue":null,"work_id":"d558851e-4997-424c-ad26-1bf4e6e82ce2","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:40a0aea370270fc0041591f9132036570611ebd84f3b9969e124cdfe99643251","observation_id":"8bce24c9-1cea-4966-8757-e2c08bc53e8b","resolution":{"observed_at":"2026-05-25T15:25:59.849978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"New ap- proaches to optical music recognition","venue":null,"work_id":"cd3f321b-c79b-4e71-8825-bf7f52b36eba","year":2011},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:2565fae90673eefbdd9e3d26471c08f9ca681e8f173f9d42d35321282f0397c3","observation_id":"e4c3f49e-117c-4227-9db0-0f889b01b43f","resolution":{"observed_at":"2026-05-25T15:25:59.868270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f46d253e-38ee-4eeb-a812-385be8081fd7","year":2012},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:42e160d59a9c9695eef1dff52169d2b9ba350323246605da589f076030b2f964","observation_id":"d45414f6-202d-4b54-99cf-2f23d3b903dc","resolution":{"observed_at":"2026-05-25T15:25:59.829823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An end-to-end neural network for polyphonic piano music transcription","venue":null,"work_id":"6f02eaaf-7504-48b1-b304-b54458482360","year":2016},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:13933c1e8f4565277fbe2c7f7e60cdf1d6ecae06459f3fccced253cb6b041d26","observation_id":"e9e3840a-bc1b-4cd8-8dcb-673edf943c27","resolution":{"observed_at":"2026-05-25T15:25:59.875633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatic drum transcription for polyphonic record- ings using soft attention mechanisms and convolutional neural networks","venue":null,"work_id":"7c8071ab-baa6-459a-95ae-1b5b5b9f831a","year":2017},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:0ef2553df6a0cdecf22f26692160234b330d4e9f058b38f2d3b0b28399c779f2","observation_id":"bdc39332-7b9a-46ef-bb78-3c741ffa125a","resolution":{"observed_at":"2026-05-25T15:25:59.790080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aec6aa96-91b4-4d94-86a9-da8676dcde7a","year":2015},"citing_paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T15:25:26.576792Z"},"links":{"citing_paper":"/paper/1906.10996"},"observation_digest":"sha256:b6613a4e91774ddcd331ba3f7a8bc0544280da2e7afe46058dd07fac6fc825a2","observation_id":"b465b7bb-edff-483f-a2a0-dd87f5387022","resolution":{"observed_at":"2026-05-25T15:25:59.835425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1906.10996","last_updated":"2019-06-26T11:52:49Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-07-06T08:02:57.296778Z","submitted_at":"2019-06-26T11:52:49Z","title":"Learning Soft-Attention Models for Tempo-invariant Audio-Sheet Music Retrieval"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:1906.10996."}