{"as_of":"2026-08-10T14:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e79f13ee8db982e8d72205e42da3fea8480ea0aadd69e5782eb43e102951eba","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:14:10.731223Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.03482/citation-record","integrity":"/paper/2507.03482/integrity","json":"/paper/2507.03482/citation-record.json","paper":"/paper/2507.03482"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.118734Z","title":null,"venue":null,"work_id":"8560674f-648c-40a4-8269-3ff480110d80","year":2023},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.506985Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:c5d2988e9c82e8cf92e46140c91bbded63f28a14dc57599e0b8abd24b25bc6b9","observation_id":"1d6b1160-15e3-4b69-bde9-05b402e6adf4","resolution":{"observed_at":"2026-08-06T20:14:11.122742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.105420Z","title":null,"venue":null,"work_id":"8c48a314-2483-4daf-85ff-8e707cc3aefa","year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.530038Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:76459b2c0a9ed66b4cf73922450214abad35a9ece474ddb30aab5864f483445f","observation_id":"5502b68e-c2b3-4750-add8-9a042e072c8a","resolution":{"observed_at":"2026-08-06T20:14:11.109407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.092336Z","title":null,"venue":null,"work_id":"b2662842-33ae-4ba1-9af2-6f8cdbc752e0","year":2004},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.592765Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:b1720fcc8e2623cdb065795fdba576984016d74752bce72fbdbe769d467b6348","observation_id":"7a486d6d-c71e-486d-b16e-b74e2b8440de","resolution":{"observed_at":"2026-08-06T20:14:11.096483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.078424Z","title":null,"venue":null,"work_id":"a816cf97-f4bb-4996-9d0f-c1ccc61e04fc","year":2011},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.612155Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:ade5708da02a8b150460c04cf4375f564de4611b60266c7eef018a79b2f61ecf","observation_id":"f432cef8-cdea-4e2f-9d37-034b79771470","resolution":{"observed_at":"2026-08-06T20:14:11.082767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.065402Z","title":null,"venue":null,"work_id":"ce0603d4-da15-449c-b0c4-0a29c32cbf07","year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.641088Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:676f0555391822a2896b31c7dfbed62d449ae9b3aef12c99e8cc62bd288b10fe","observation_id":"5463cd36-6bf2-490b-bf5c-12db795a2bd3","resolution":{"observed_at":"2026-08-06T20:14:11.069453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-06T20:14:10.645738Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R’e","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.645738Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:12dab33a19e3801b1b705a2dc1bce0937ecf8293cd5dea2e883bcd2e46ea8cd9","observation_id":"466c5980-c36c-44fa-9f75-f23c936c71a6","resolution":{"observed_at":"2026-08-06T20:14:10.645738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-06T20:14:10.650837Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.650837Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:c596a45a90ba57b6dd2feafc7d8e152f4a4b03fad1db5e87bc6a6e468f342740","observation_id":"9e32c18a-8d8d-4858-bf32-13d962b3d811","resolution":{"observed_at":"2026-08-06T20:14:10.650837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.01279","last_updated":"2017-04-05T06:34:22Z","snapshot_observed_at":"2026-08-02T21:47:02.126634Z","submitted_at":"2017-04-05T06:34:22Z","title":"Neural Audio Synthesis of Musical Notes with WaveNet Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.01279","snapshot_observed_at":"2026-08-06T20:14:10.654969Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.654969Z"},"links":{"cited_paper":"/paper/1704.01279","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:91176ee396fab88840db880fa59307ecd2d93c25ee2b78f94b6a8999478fc921","observation_id":"94254fbc-ef9f-4fc8-b13c-b9ab4cd0d99d","resolution":{"observed_at":"2026-08-06T20:14:10.654969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.052868Z","title":null,"venue":null,"work_id":"c9d1f9c4-3bb9-4094-b250-b12e9f020ee8","year":2002},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.659374Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:0236e3eb9f7143ced8fdc556dd1fc38e559154d6ed97e48a92ac9f0ef39c7346","observation_id":"83773889-73ef-4abe-8a13-fd41c6697529","resolution":{"observed_at":"2026-08-06T20:14:11.056678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T20:14:10.664092Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.664092Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:4c12c7dcf9e7482a4e919798457a879a257dd5cdf994fe5e1d2f1990687b7aa8","observation_id":"38f6d3e4-7233-4e86-911c-998220d2cfdd","resolution":{"observed_at":"2026-08-06T20:14:10.664092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.039890Z","title":null,"venue":null,"work_id":"c44b501a-9c2e-4cc5-ba76-1166ea2b3e78","year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.668115Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:eb3e57de5569b0017b023ea23ae92effb4dcf8b09e5a8a48ca76a0001e19ef77","observation_id":"392c7e2e-e4b8-41df-bd82-8e1cdef93778","resolution":{"observed_at":"2026-08-06T20:14:11.043630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.026802Z","title":null,"venue":null,"work_id":"c8ab1a2a-e80e-4b27-8256-16c7088eb9db","year":null},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.671956Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:216f58febc5576d8e5ce2d98d0bf1f408f965aea5efc1840dd4fc3678e51e65d","observation_id":"76ecb78b-a6e0-41b4-8db8-8f174f874a75","resolution":{"observed_at":"2026-08-06T20:14:11.030635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.999447Z","title":null,"venue":null,"work_id":"08352430-3827-4b99-b34b-e8b7a769641d","year":2023},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.680114Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:447190b843097aaac4799a6fba66d904006a9e9106f9f73f6301bdacd1200800","observation_id":"ebe48eb0-5b5d-4843-8d88-f18a941e01d6","resolution":{"observed_at":"2026-08-06T20:14:11.003422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.986376Z","title":null,"venue":null,"work_id":"98edabce-4617-4f32-a5d1-a4cdf4f24083","year":2009},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.683732Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:d71c4dbd05263d5e6cca21efeced68e5403be2071686fd0067df695cb21bd917","observation_id":"9a322512-919e-45bc-a52c-bc2cfb5cd5db","resolution":{"observed_at":"2026-08-06T20:14:10.990636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00107","last_updated":"2024-12-27T12:28:34Z","snapshot_observed_at":"2026-08-06T16:16:34.606158Z","submitted_at":"2023-05-31T18:27:43Z","title":"MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00107","snapshot_observed_at":"2026-08-06T20:14:10.687382Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.687382Z"},"links":{"cited_paper":"/paper/2306.00107","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:d6f18097bd3cebc619a532edca2c2fa07f816239edea6280a48d1818b36211a1","observation_id":"094ec0fb-8f30-4326-9ff4-c0b2f93231c3","resolution":{"observed_at":"2026-08-06T20:14:10.687382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.971796Z","title":null,"venue":null,"work_id":"b0e5ea59-4260-4bea-8d6c-83a10570b8a4","year":2015},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.691320Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:5037de932ad84be2f0f32a6d91628d1d33f3ba68628495dbd88888868cd5710f","observation_id":"743bdf32-7e71-4df1-a058-ea39a1336350","resolution":{"observed_at":"2026-08-06T20:14:10.976423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.957958Z","title":null,"venue":null,"work_id":"31d1d2f6-1db3-4458-9b22-1ad58312ffe4","year":2009},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.695190Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:afe1e5b47bc22f2efdd803a0873bc08bc6f357872c90c19f6399265ac5326e2b","observation_id":"d9877935-cb19-4290-b4f0-c1f762463161","resolution":{"observed_at":"2026-08-06T20:14:10.961709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.944269Z","title":null,"venue":null,"work_id":"c2cad7cb-c7d3-4ae3-ab44-526dc723d0e0","year":2022},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.698998Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:61f62d067de16e6461ae41116bea2cc2d1476c6fa0e373ea4d2889de9cb6e490","observation_id":"09123a80-4169-4c4a-88a2-ca462c3c929d","resolution":{"observed_at":"2026-08-06T20:14:10.948208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15505","last_updated":"2023-10-12T07:55:05Z","snapshot_observed_at":"2026-07-06T16:24:17.829828Z","submitted_at":"2023-09-27T09:13:40Z","title":"Finite Scalar Quantization: VQ-VAE Made Simple","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15505","snapshot_observed_at":"2026-08-06T20:14:10.702902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.702902Z"},"links":{"cited_paper":"/paper/2309.15505","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:f8e2cb5a426207dbb13c07fbc094eb95b8a04058f024254a489a483443b10bb5","observation_id":"f91e9428-1ee5-4336-940d-6711466d2494","resolution":{"observed_at":"2026-08-06T20:14:10.702902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.930655Z","title":null,"venue":null,"work_id":"e15feffe-c8b0-415a-9818-9e547d7de6b7","year":2019},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.707698Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:9f5bd8e6f233d4e1262fdc4992769f77e28a1e437d3e00e58e2e11a1c9996c6e","observation_id":"ac25f86c-455a-40b4-99c2-cd7aeca2310a","resolution":{"observed_at":"2026-08-06T20:14:10.934580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.917769Z","title":"Valero-Mas, and Xavier Serra","venue":null,"work_id":"2564e623-8e64-415a-8a62-6fa8bf8c24aa","year":2025},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.711571Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:b7d2dbcacccf3eb7a4aa3e09c65a77b8f3ddbbb2472bc9fd3cbf4a5e92899d77","observation_id":"a0de8a89-1054-4dc3-bd8e-659d531dd9db","resolution":{"observed_at":"2026-08-06T20:14:10.921546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.904366Z","title":null,"venue":null,"work_id":"ceb28c97-6153-4a5e-95f2-a0550e6f49cc","year":2021},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.715454Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:6d5371659de900fdc2c36fdb9c92bb9a9e80d741bd50f66d8c3162014c4c104f","observation_id":"bfe0476e-71fc-46ea-9795-f0473a9bb5e7","resolution":{"observed_at":"2026-08-06T20:14:10.908297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.719605Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.719605Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:bcdca41b5c06715489c10fa740c17fc66af9f3fa9246810fd1e7d92c7de1a88b","observation_id":"46f61108-1bf1-49b7-a6ee-ba64671a6bb2","resolution":{"observed_at":"2026-08-06T20:14:10.719605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.881306Z","title":null,"venue":null,"work_id":"4e403894-9b92-4ac8-97c9-b0c9d357c1ae","year":2024},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.723807Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:86c67ea419b838ed2947202d86dfde28067dc5f0fa9e6c3debba0768646c18b3","observation_id":"cc924cf7-199d-4d85-a549-b2913319903c","resolution":{"observed_at":"2026-08-06T20:14:10.885305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:10.865439Z","title":null,"venue":null,"work_id":"2552c1eb-1e98-4a57-89ca-92b74cfc1331","year":2024},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.727472Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:1efd38db2da5300fb200b3c6eb7f9c18d337b17aa888ecdae840f454cc6152dc","observation_id":"aaefccaa-d36d-41cb-a6bb-5fd66e05f6c5","resolution":{"observed_at":"2026-08-06T20:14:10.870828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10504","last_updated":"2022-07-20T22:31:00Z","snapshot_observed_at":"2026-07-06T10:06:22.268771Z","submitted_at":"2020-10-20T17:58:13Z","title":"Pushing the Limits of Semi-Supervised Learning for Automatic Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10504","snapshot_observed_at":"2026-08-06T20:14:10.731223Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.731223Z"},"links":{"cited_paper":"/paper/2010.10504","citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:04be0fe67762fa2ce0c705462ce836478c48332202f18f689d0d4c57c59ec73e","observation_id":"64f6980f-7ad9-4342-a4ba-947767239bc0","resolution":{"observed_at":"2026-08-06T20:14:10.731223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:14:11.012594Z","title":"In2020 International Joint Conference on Neural Networks (IJCNN)","venue":null,"work_id":"bf072aad-4743-484e-87ad-d84482a6bb69","year":null},"citing_paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:14:10.676198Z"},"links":{"citing_paper":"/paper/2507.03482"},"observation_digest":"sha256:b7a659a98da0d8b10824eb34c0a4dfa841cb8cba9ac4b597cd81eaf8ab5de050","observation_id":"d92e348c-8e0c-49bf-898e-1feeec150917","resolution":{"observed_at":"2026-08-06T20:14:11.017630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03482","last_updated":"2025-07-04T11:19:47Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T09:03:43.797704Z","submitted_at":"2025-07-04T11:19:47Z","title":"OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2507.03482."}