{"as_of":"2026-08-08T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee4be58061661ad2c55bcf4c3121b65e3194971499ea998b41744262176c3869","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:58.861961Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:58.680579Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T18:36:58.919922Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"cited_work":{"arxiv_id":"2507.07764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07764","snapshot_observed_at":"2026-08-06T18:36:58.919922Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","venue":"cs.SD","work_id":"94a75125-ef8a-4c6a-9cc9-128b4727c2f2","year":2025},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.680579Z"},"links":{"cited_paper":"/paper/2507.07764","citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:09b9e0d059e7b7f519e8ad1818ee106922eb696dadf94fb77c2840895dd274dd","observation_id":"4d58c5a9-f745-42ae-af63-f8ab1724d28e","resolution":{"observed_at":"2026-08-06T18:36:58.925752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07764/citation-record","integrity":"/paper/2507.07764/integrity","json":"/paper/2507.07764/citation-record.json","paper":"/paper/2507.07764"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"cited_work":{"arxiv_id":"2507.07764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07764","snapshot_observed_at":"2026-08-06T18:36:58.919922Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","venue":"cs.SD","work_id":"94a75125-ef8a-4c6a-9cc9-128b4727c2f2","year":2025},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.680579Z"},"links":{"cited_paper":"/paper/2507.07764","citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:09b9e0d059e7b7f519e8ad1818ee106922eb696dadf94fb77c2840895dd274dd","observation_id":"4d58c5a9-f745-42ae-af63-f8ab1724d28e","resolution":{"observed_at":"2026-08-06T18:36:58.925752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.465495Z","title":"grass” versus “sand","venue":null,"work_id":"f028e55f-b39a-46dc-bb69-212e64b22809","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.684264Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:5e64761067838536cfeb14611359bce41c05eacf964f5407c0005c60f9aa3ce5","observation_id":"21a9d760-f539-44b9-bf9b-f451be889239","resolution":{"observed_at":"2026-08-06T18:36:59.468696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.455962Z","title":"[13] and Vahidi et","venue":null,"work_id":"13b75e45-dacf-41ce-b91b-a91578ace658","year":1977},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.687436Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:6d498db9079a9e0c8c86f2824a3310e2022da85a5bdfb1d6e64488bb261d5222","observation_id":"3f264bcc-79ca-43f4-ba59-411246531da8","resolution":{"observed_at":"2026-08-06T18:36:59.458948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.435978Z","title":"We choose to report triplet agreement instead, as it is a more intuitive metric to interpret than the other two","venue":null,"work_id":"01385bdf-5d64-4b3f-827c-10afa29b71f4","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.694685Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:4bc8c74f8e7cdad150f1fb5068d3159757492843bc3d924cc0a0ef3b52143929","observation_id":"4c42faf4-44e9-49c1-ba62-1f14dd48e108","resolution":{"observed_at":"2026-08-06T18:36:59.440097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.426137Z","title":null,"venue":null,"work_id":"ab4cc027-3b91-43b8-87f8-87e454501e18","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.697917Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:2ccf28357f282367225b72890389315d22c5d54e07f5876b79b6f921e7ab02d1","observation_id":"3a2ab18a-adca-42b9-9102-d73d6a2aea9a","resolution":{"observed_at":"2026-08-06T18:36:59.429431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.415431Z","title":null,"venue":null,"work_id":"ab65790f-78d3-4086-b573-ccabb04c79f4","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.701117Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:813c300d6994dfc2878d8173deac322e34fb5b277db4803c2e6203115e74ed62","observation_id":"27428951-4c7b-4d03-89fa-2780caa54953","resolution":{"observed_at":"2026-08-06T18:36:59.419510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.703881Z","title":"This work is supported by the EPSRC UKRI Centre for Doctoral Training in Artificial Intelligence and Mu- sic (grant number EP/S022694/1)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.703881Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:58b25eb0388481acad241de619fcd7d7efa724beb85d9a616a9a025ff3842145","observation_id":"0cabdfbb-42f6-427f-9cad-5ad7d0d7d267","resolution":{"observed_at":"2026-08-06T18:36:58.703881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.328499Z","title":"Timbre space as a musical control struc- ture,","venue":null,"work_id":"48e409a0-c0da-45ae-8ae6-9b779f6c4024","year":1979},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.730744Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:5910b1f4968069ba4e79ff2a69eca463d46c77cbc9b88407ab15734cee844ec6","observation_id":"b13c45fc-493d-455f-955b-ba5d23169219","resolution":{"observed_at":"2026-08-06T18:36:59.331488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.405954Z","title":"From clarinet control to timbre perception,","venue":null,"work_id":"11a3972b-4c89-4d6d-9b60-df8f0c9a63a3","year":2010},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.706867Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:0b9d5dcf07b44d0423873ea9d4bb7504bf5925334459e8d8ba158c4e96ef7404","observation_id":"ed9fb144-040f-4fef-9701-fd080c5689ed","resolution":{"observed_at":"2026-08-06T18:36:59.409112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.397097Z","title":"Music in our ears: the biological bases of musical timbre perception,","venue":null,"work_id":"67697b82-f62b-4a5e-89ba-ade982e8e54e","year":2012},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.709430Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:40e9533edee2256b937b2a7b8f50c917de35c8c7180657eba643f386ef2cef8f","observation_id":"ef5c04ba-c8e7-41f8-9c5c-e448e5b299dd","resolution":{"observed_at":"2026-08-06T18:36:59.400302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.387148Z","title":"An in- terlanguage unification of musical timbre: Bridging semantic, perceptual, and acoustic dimensions,","venue":null,"work_id":"ec322939-8d86-41bf-a325-74bc2eaddf41","year":2015},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.712277Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:8d8224b9c0431789ff8229bfaa67e88ae28e5a87d04743634ee24436a25c5186","observation_id":"c6c9ab90-86b6-42c1-810a-d7301c9eef1f","resolution":{"observed_at":"2026-08-06T18:36:59.390475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.376927Z","title":"The perceptual representation of timbre,","venue":null,"work_id":"54e54854-61bf-4225-9879-dba986ad06d0","year":2019},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.715080Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:efa1e594a03f69eafd9c114daba5f89fc590330b29bf343dce0dc79fc64971e2","observation_id":"6184c584-7ac8-4524-a395-541dc75f0ea2","resolution":{"observed_at":"2026-08-06T18:36:59.380538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.366665Z","title":"Acoustic structure of the five perceptual dimensions of timbre in orchestral instrument tones,","venue":null,"work_id":"ee6595c4-e175-44ab-9b97-4f685335c4b1","year":2013},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.719462Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f56ae371321b76009546cabe480524d34251120d5fe3e3139fb31b2bb4bc05eb","observation_id":"8a3eb368-2814-43c1-a8a0-db83f2e99adb","resolution":{"observed_at":"2026-08-06T18:36:59.370665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.356425Z","title":"Neural au- dio synthesis of musical notes with wavenet autoen- coders,","venue":null,"work_id":"3207aad8-1911-4b57-b6fa-485367250d12","year":2017},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.722677Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f63c3942e3222a28bca75ef054ee4d7bf3949bafe5f5da76a8a69368fb703417","observation_id":"dc7ac105-070b-432b-8e31-f5b8e680ee37","resolution":{"observed_at":"2026-08-06T18:36:59.359978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.346168Z","title":"DDSP: Differentiable digital signal processing,","venue":null,"work_id":"b1603945-12e5-4689-b704-816a49c1ec7b","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.725439Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:0db41b8e97b35b3185ce5d12845e08e8965d9aea2ef263468e50238277ac72f8","observation_id":"b0e23782-208d-4c81-930c-3c161f8942f5","resolution":{"observed_at":"2026-08-06T18:36:59.349572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.252496Z","title":"Timbre dissimi- larity metrics,","venue":null,"work_id":"34d9ecd9-d778-4f18-83f7-56feaa4e4b0a","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.753737Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:b954a502cd110e7e44716bd6b8e36ac90ce8cdd408166692aaed65d36c91d86d","observation_id":"5e262ed1-f9d6-4e9d-b343-61ca98c80c1d","resolution":{"observed_at":"2026-08-06T18:36:59.255243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.243354Z","title":"A differentiable perceptual audio metric learned from just noticeable differences,","venue":null,"work_id":"c229db6b-c39b-46ea-a125-30a7ec392092","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.756915Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:feae1239ce4411b8023a6c83c24ab1ba9dde24758a8e070a10db7a3ca6178388","observation_id":"b3ea3803-ad72-4e67-bc96-390ee45e6528","resolution":{"observed_at":"2026-08-06T18:36:59.246463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.319732Z","title":"Generative timbre spaces with variational audio synthe- sis,","venue":null,"work_id":"729e47c1-1653-44f1-bac9-3973e2858fab","year":2018},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.733354Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:dba7b45e553b5ee8d11038646083891c3fbd11ee5c58fdfccd73373d4afba40b","observation_id":"260430ac-1971-491f-8d60-d64ef1542079","resolution":{"observed_at":"2026-08-06T18:36:59.322613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.310236Z","title":"Time–frequency scattering accurately models auditory similarities between instru- mental playing techniques,","venue":null,"work_id":"b9764f8f-d65c-47f2-b96f-083a741046d5","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.736096Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:aace6a320339ebcdbe4f424e0e0304a8bbce2417e53a2d4f6da3f4a86b53b59e","observation_id":"c6e3b248-7d3e-4827-9ab2-99c134a41677","resolution":{"observed_at":"2026-08-06T18:36:59.313835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.301793Z","title":"Free sorting task,","venue":null,"work_id":"56556cb9-b66d-4e21-8fd8-e0e7f9900f4a","year":2014},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.738717Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:2466e1cd422a02528f6b30959ff2ac88d8c611c4dcead505dd1daa711e98463c","observation_id":"713156b3-1e30-4721-b1c3-0703c614e60b","resolution":{"observed_at":"2026-08-06T18:36:59.304590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.292614Z","title":"Perceptual musical simi- larity metric learning with graph neural networks,","venue":null,"work_id":"34000f16-1c26-4064-b2c6-d3991bf52c20","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.741580Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:d896fcb788b68e60473a8ab8cd15566476809fa35c43b86653fb25a7f6304e89","observation_id":"a1e33ae8-92c5-41e6-bd22-3430f783f8bb","resolution":{"observed_at":"2026-08-06T18:36:59.295819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.282653Z","title":"Learning metrics on spectrotemporal modulations re- veals the perception of musical instrument timbre,","venue":null,"work_id":"67f83bd2-e444-42f4-80b3-e36981918006","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.744230Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:29900a9d55084ed676ff919443b2f59ac24acf9e5e09219910559640e06912d9","observation_id":"91322ee0-d39f-47d5-b1c3-c7da611df263","resolution":{"observed_at":"2026-08-06T18:36:59.285931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.271993Z","title":"On the robustness of mu- sical timbre perception models: From perceptual to learned approaches,","venue":null,"work_id":"e77d6aab-b0f6-42bf-a603-e30901b1c567","year":2024},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.747362Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:63c14b4a8774aafed8121202563a0554dbecf02550ced3e2111dcf697e63c199","observation_id":"43a1bf73-06d9-4362-a35f-dd83376b3860","resolution":{"observed_at":"2026-08-06T18:36:59.276158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.262668Z","title":"Acous- tic representations for perceptual timbre similarity,","venue":null,"work_id":"b6108706-0ba9-44ef-b950-637b8013cf0a","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.751122Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:63e22aae1fec06d178dd55356ee29a3594d6d5f40e558d09349ed7270469ae28","observation_id":"1ab47ee6-3ad7-44e7-9946-dd69869ac8d6","resolution":{"observed_at":"2026-08-06T18:36:59.265587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.169748Z","title":"Isolating the dynamic attributes of musical timbrea,","venue":null,"work_id":"4c4613f0-46a6-4f6e-aecc-b9ea5e9514df","year":1993},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.782630Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:b6dba8d00941b80cb3989ae1b353d80499091709d2061cc0f85e6b1a7c5e04a1","observation_id":"19f577fc-98ff-4944-a3f2-f470487423a2","resolution":{"observed_at":"2026-08-06T18:36:59.172595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.159523Z","title":"Opolko and J","venue":null,"work_id":"a12ff1a5-aefb-4ada-a0f1-101e26ecf7aa","year":1987},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.785463Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:4e37f28da811a84977af36abe5eb798a479a7856b35a3861a7347673e9c69085","observation_id":"bffe6cec-7c9d-4bb1-9829-8fa3e5393366","resolution":{"observed_at":"2026-08-06T18:36:59.162667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.233726Z","title":"Cd- pam: Contrastive learning for perceptual audio simi- larity,","venue":null,"work_id":"cd4757b3-ba4c-457e-99ef-4d5dcfce8672","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.759905Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:9ee9f659e903e744ddf863906643f30217a1cfeb9ae621128fcf1e4da636f660","observation_id":"8d54478f-02ef-426c-a628-fbf922b3b02a","resolution":{"observed_at":"2026-08-06T18:36:59.236907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.224252Z","title":"The unreasonable effectiveness of deep fea- tures as a perceptual metric,","venue":null,"work_id":"60383644-fff9-42ae-94e9-68bc30a7b1d7","year":2018},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.762647Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:9a74044a08a78799d240cbfad062cdd2899b557734218150f67eb51fa23f5fb0","observation_id":"0fffcc33-174e-4aed-a656-eb14eaf49465","resolution":{"observed_at":"2026-08-06T18:36:59.227547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.214359Z","title":"Dreamsim: Learning new dimen- sions of human visual similarity using synthetic data,","venue":null,"work_id":"9b6248d6-a48b-4048-9d4a-1a340bf5d164","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.765889Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:7a4667e34301d3793155dfaca33374368d381c5564315f46e7e3bfeee29ae760","observation_id":"867b3abd-7b1d-4ea8-b773-d8d898b9a95e","resolution":{"observed_at":"2026-08-06T18:36:59.218000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.205364Z","title":"Improving neural network representations using human similarity judgments,","venue":null,"work_id":"3994eb67-79a0-4261-b9ad-13746c2a8133","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.769812Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:413077e3fac8e49e62ffa29086a99296f97d32f83ea11a9b10f7f589b17b7a16","observation_id":"f9fdc42a-475d-4387-9bde-2bf0a648ed99","resolution":{"observed_at":"2026-08-06T18:36:59.208353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.196499Z","title":"Things-data, a multimodal collection of large-scale datasets for investigating object representations in human brain and behavior,","venue":null,"work_id":"f34385d1-90b0-4c64-9c0d-6e89536b925b","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.774180Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:76051fbad28bc62f0bd29863ab5053868d8d879912e69e661607b3ecfa2a765d","observation_id":"ea926a09-7f56-4ecf-a5df-c50fa8b35f5c","resolution":{"observed_at":"2026-08-06T18:36:59.199770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.187134Z","title":"Multidimensional perceptual scaling of musical timbres,","venue":null,"work_id":"c3bc1c27-90f0-4409-b61f-479046ff1c72","year":1977},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.777120Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:9945858d45c5ca5e72a820c199e6aa8e3c07a5cb478aef4887e35d4787a006be","observation_id":"407b7681-cb8e-4409-8151-188bca9a0c36","resolution":{"observed_at":"2026-08-06T18:36:59.190549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.178578Z","title":"Perceptual effects of spectral modifications on musical timbres,","venue":null,"work_id":"77c758a5-5c69-49a0-b105-eb8adfa764ec","year":1978},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.780042Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f3830e8524f3c0c4f43a134c29e5ab54c4cd18348ca0cdddb8b475760a7406d1","observation_id":"9e787ca1-04fd-42cc-b22f-e5570ce2e486","resolution":{"observed_at":"2026-08-06T18:36:59.181397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.082656Z","title":"Tim- bre space representation of a subtractive synthesizer,","venue":null,"work_id":"ec0edda5-a0d0-4687-b450-b030134bd151","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.812133Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:fa02c58f2e6ca5e0aeb7206f56256fc7c3c37cf30c9c1a06ec39a33ac832d0c0","observation_id":"f9394321-0ef4-43de-b375-e8f5236c0442","resolution":{"observed_at":"2026-08-06T18:36:59.085817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.446136Z","title":"While some dynamic variations can be observed, loudness is typically reported to have been normalized by expert listeners","venue":null,"work_id":"b19b35a6-5f5a-4f48-b5de-05c8dd1521cc","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.690528Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:306568e55da53164fc95ee8f03afa56efdc991f206ceb70a9e277fecb6d99554","observation_id":"e744213d-1208-4a17-91cc-fcaac773e984","resolution":{"observed_at":"2026-08-06T18:36:59.449895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.149950Z","title":"Perceptual scaling of synthesized musical timbres: Common dimensions, specificities, and latent subject classes,","venue":null,"work_id":"68e90bb8-93e2-4951-9975-aec2613606fc","year":1995},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.788046Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:dc5be6d8a24b8d1bb2e93866780cb6d172789525523f3761e93832d6d9e1d46e","observation_id":"a1d26859-7daa-48ac-95e0-ed08819e1be5","resolution":{"observed_at":"2026-08-06T18:36:59.152866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.140540Z","title":"A common perceptual space for harmonic and percussive timbres,","venue":null,"work_id":"a2642a39-4b46-4b0b-b3b6-f8283f46a730","year":2000},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.791807Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:fe2b038410472d000d1e8e3372de55cbf097ff79156ddfc0bf049aeeb58e4968","observation_id":"8b84a18e-1501-4fdb-8e06-a7a9acb82f17","resolution":{"observed_at":"2026-08-06T18:36:59.144098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.131354Z","title":"RWC music database: Music genre database and mu- sical instrument sound database,","venue":null,"work_id":"2bcf0661-66d4-4040-a119-de31ff89f8c0","year":2003},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.795026Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:dc3aba6aa18b29bc1f38870f0aada34412404dbc4be1f0b7306d85b781a38245","observation_id":"064f6951-85cc-4682-b4c7-fc7f6ea8c213","resolution":{"observed_at":"2026-08-06T18:36:59.134166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.121533Z","title":"Opolko and J","venue":null,"work_id":"8f471c6b-30a1-4a8e-ab63-e55696133a3c","year":1987},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.798554Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f40dd6a900298784c7f735cd2d35d2cba8b6fed503d4f9a805f076e88f0733dc","observation_id":"4f815ff7-34bb-4317-9c6e-61796420cccd","resolution":{"observed_at":"2026-08-06T18:36:59.123980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.112292Z","title":"Acoustic and categorical dissimilarity of musical tim- bre: Evidence from asymmetries between acoustic and chimeric sounds,","venue":null,"work_id":"47f9d68c-78c8-4a95-8a03-c845abb895b9","year":1977},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.801745Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:dce24911ba1f47823890f06018be04545eab01da0c48379bb07177becce1e6a5","observation_id":"ffefdcde-3ca6-4474-8add-8c1b01e8b78a","resolution":{"observed_at":"2026-08-06T18:36:59.115310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.102189Z","title":null,"venue":null,"work_id":"50978296-3098-41aa-b233-f962328a23cb","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.805038Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:0e73dbb6e9b2a66eb00162260b15e4056f80374f80e7cc3fd265bf6c8b9d434a","observation_id":"b8d056f8-8fb9-495b-8160-69eb82793b27","resolution":{"observed_at":"2026-08-06T18:36:59.105928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.092492Z","title":"Brightness perception for musical instrument sounds: Relation to timbre dis- similarity and source-cause categories,","venue":null,"work_id":"8ee71562-0451-415f-a441-598101ecf438","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.808756Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:ca00c59143e431f87e588da88fcba7b593577df2f95885fb07682d83f0ab27e1","observation_id":"493fe897-970c-4737-8390-dcae890f45d1","resolution":{"observed_at":"2026-08-06T18:36:59.095886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.997372Z","title":"Joint time– frequency scattering,","venue":null,"work_id":"366418c8-2d6f-42aa-8b56-26cbdacd946f","year":2019},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.838126Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f267e45772e21a29238cbb95f7c5fb1a320bdc0f8f36eaedbd3488f095e51e4b","observation_id":"da169174-1e02-4fdb-8ea2-572942f25794","resolution":{"observed_at":"2026-08-06T18:36:59.000165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.073524Z","title":"pyloudnorm: A simple yet flexible loudness meter in python,","venue":null,"work_id":"c1e1e27d-28b0-4b22-b740-071e69c06ca2","year":2021},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.814758Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:1acc582f8f9a81a38235382353cbb4429a66af6f5cfd029c18ce51bdaf68be46","observation_id":"9ccba66c-6a72-4ae6-a509-472b2e9d8047","resolution":{"observed_at":"2026-08-06T18:36:59.076437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.063296Z","title":"TorchMetrics - Measuring Repro- ducibility in PyTorch,","venue":null,"work_id":"04c14113-b4ad-4aff-853b-c66cfe7a7f88","year":2022},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.817819Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:2f6e81f2e9c5e14e98a64bb0c35d354f13d925e3d874ff8b95c697cc147a6ab5","observation_id":"0d66b09a-c9c3-438b-9c17-0f49e1a25d98","resolution":{"observed_at":"2026-08-06T18:36:59.067184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.053591Z","title":"Hyperbolic image embeddings,","venue":null,"work_id":"c3c745b1-f648-4259-b670-68b5698c48e6","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.820856Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:7a8dc8b69159aa5dc1955a973e3e9392ff128666f7a1845e1220cab1b37e0a4d","observation_id":"7f32aa2d-9797-4aa5-9c39-f7e6e09a632f","resolution":{"observed_at":"2026-08-06T18:36:59.056869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.044678Z","title":"Adapting frechet audio distance for generative music evaluation,","venue":null,"work_id":"3e9d6816-ebb3-4f75-813b-371a6f623314","year":2024},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.823364Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:fb6e1536458e736deb2bf3ac80aaf0f5a40967d23967f4da1373723055971618","observation_id":"a741b94c-0110-4504-b916-cfd12bb39fa0","resolution":{"observed_at":"2026-08-06T18:36:59.047649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.034545Z","title":"Deep resid- ual learning for image recognition,","venue":null,"work_id":"fc8b44ed-08cc-459d-bb19-3285c285fb6d","year":2016},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.826198Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:6aadd5bda548e4cea9ad8bc84070122b691a23c07feff8b962209d4e8f32f212","observation_id":"a8b1cf02-1ef2-48d3-9158-a7613a3fc841","resolution":{"observed_at":"2026-08-06T18:36:59.037962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.025254Z","title":"Image style transfer using convolutional neural networks,","venue":null,"work_id":"6c25b4f1-b29a-4948-9f86-109fbb82a01d","year":2016},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.828777Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:48d8c1d54c0a2b15a25c12c40cb46238338ad652ba160d3d482c16bc00de2383","observation_id":"0646fb30-9360-47e7-bbd7-9bcfd873b712","resolution":{"observed_at":"2026-08-06T18:36:59.028198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.016068Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization,","venue":null,"work_id":"6c2d575e-3b0a-486c-a6a4-cc06511ae7f2","year":2017},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.831139Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:cd4ef488e5234de6c4819b9c393f661c4f9bd84b5969ad2e63f7d895818d76c8","observation_id":"fd3b7f84-536a-42c9-8eec-4658919923e1","resolution":{"observed_at":"2026-08-06T18:36:59.019176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.006654Z","title":"Kymatio: Scattering transforms in python,","venue":null,"work_id":"69756ea3-8251-4ab4-a48a-0efecd642769","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.835006Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:abb0dd9bb6ba2e0cce2ec55d5e4d7cbd668be97a08295f986888d0fa69376a5d","observation_id":"7eedff74-ad9d-4b16-8a5c-0f92f4e44c51","resolution":{"observed_at":"2026-08-06T18:36:59.009634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05767","last_updated":"2024-02-06T21:42:03Z","snapshot_observed_at":"2026-07-06T16:17:07.927369Z","submitted_at":"2023-09-11T18:50:21Z","title":"Natural Language Supervision for General-Purpose Audio Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05767","snapshot_observed_at":"2026-08-06T18:36:58.841041Z","title":"Natural language supervision for general-purpose audio representations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.841041Z"},"links":{"cited_paper":"/paper/2309.05767","citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:6d43d1ab231439efd431a024d3f99f8fe12e0d4ea6f6d44cd1ca532d7fcac7c6","observation_id":"8c7295bf-8c98-4fc3-92bc-ed14beb24e5f","resolution":{"observed_at":"2026-08-06T18:36:58.841041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.987127Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":"3d17b171-341b-48f0-8623-1ba9924f7768","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.843961Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:dc67177e7d0acde5e598ea87b394d6d59a0f0e024d85eab8886780f508ab2755","observation_id":"d4a3cb11-d2c3-4c4a-812a-7c9676397a09","resolution":{"observed_at":"2026-08-06T18:36:58.990443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-03T16:47:47.192907Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-06T18:36:58.847114Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.847114Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:5958ce6711fa736e68c84789f5326edd57172f3c23ae92968494d73e8eac8248","observation_id":"fb84d5aa-d730-4e61-9b86-a438fa67f758","resolution":{"observed_at":"2026-08-06T18:36:58.847114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.975685Z","title":"High-fidelity audio compression with im- proved rvqgan,","venue":null,"work_id":"dfa91e88-39a7-411c-a290-4ab5616f1dd2","year":2023},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.850721Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:f330efbd1d6949679f8420f855e0516ec7c98d5ffc78320c47db6e2c56e8535a","observation_id":"feb209ac-43a1-43e7-a382-0b1f4de197b3","resolution":{"observed_at":"2026-08-06T18:36:58.979365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.965583Z","title":"Music2latent: Consistency autoencoders for latent audio compression,","venue":null,"work_id":"19bae76d-22a6-4f6c-8b0c-1786f15bf0f1","year":2024},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.853998Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:6480cfe45883aff11f5cbe5e1f1394adf3c5c4860d65235d47afa5a0a02a584b","observation_id":"a7f6b7ec-7879-4521-88ce-1700817fd7d8","resolution":{"observed_at":"2026-08-06T18:36:58.968651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.954434Z","title":"Learning complex basis functions for invariant representations of audio,","venue":null,"work_id":"5ff389d0-2528-4182-8101-2a373710fceb","year":2019},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.856677Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:1d7841be2c79ea2c1a2d14d840aa8cdf2ebbc90ed3dfb822b5abef739ea72fc7","observation_id":"d74b70dd-2d8a-4c4f-b01a-9ce7411d75d2","resolution":{"observed_at":"2026-08-06T18:36:58.957744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.944795Z","title":"Maps-a piano database for multipitch estimation and automatic transcription of music,","venue":null,"work_id":"cb5a6e36-0e9a-4ed0-86ab-796f3a0aa2fc","year":2010},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.859146Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:27cb2121ae842acd1bc0281136683e65b4a9eeaa36cd3d8248dbf160880d4e56","observation_id":"f8690965-7c15-4afe-9b4f-2ba69619e6a3","resolution":{"observed_at":"2026-08-06T18:36:58.947874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:58.933447Z","title":"I’m sorry for your loss: Spectrally-based audio distances are bad at pitch,","venue":null,"work_id":"f619088d-c187-4e9b-8ec1-b84241e80803","year":2020},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.861961Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:cd363f0c4225afb1cfe959c264c0dca333a54159ab065a27c522b4cfb317c73c","observation_id":"abb8d2c5-63f3-478c-9369-3eca8c0f5b44","resolution":{"observed_at":"2026-08-06T18:36:58.937329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:59.337254Z","title":"Available: https://openreview.net/ forum?id=B1x1ma4tDr","venue":null,"work_id":"7c3ac67f-50cf-4c1b-8108-95fcc82a84df","year":null},"citing_paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:58.728060Z"},"links":{"citing_paper":"/paper/2507.07764"},"observation_digest":"sha256:bc11661e9936d6c7591a282bcbdef69a34705355fe61574bd22b89f87a7192f4","observation_id":"6ad20e14-4c52-4be0-8fe2-12b7618a400b","resolution":{"observed_at":"2026-08-06T18:36:59.340187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07764","last_updated":"2025-07-10T13:41:59Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T18:30:26.717637Z","submitted_at":"2025-07-10T13:41:59Z","title":"Assessing the Alignment of Audio Representations with Timbre Similarity Ratings"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":53},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2507.07764."}