{"as_of":"2026-08-09T01:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd4f91271cd26c7bf4a6b75c788dee1f1d57bc12162976b8454289446d851ea0","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:51:47.139538Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:41:17.172433Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T01:53:28.882358Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24901","snapshot_observed_at":"2026-08-02T22:41:17.172433Z","title":"Unmute the patch tokens: Rethinking probing in multi-label audio classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.172433Z"},"links":{"cited_paper":"/paper/2509.24901","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:f1d5833621b2670dcc7c3287c91035c2ad19cc0e012e5f36255d29f93acad590","observation_id":"6c12c591-c1b3-4fbe-ba14-1d56292205f6","resolution":{"observed_at":"2026-08-02T22:41:17.172433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"cited_work":{"arxiv_id":"2509.24901","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.24901","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unmute the patch tokens: Rethinking probing in multi-label audio classification","venue":null,"work_id":"1e32f6c3-f8ae-4d02-87fe-edf7f2a0b1a0","year":null},"citing_paper":{"arxiv_id":"2605.14231","last_updated":"2026-05-14T00:56:51Z","snapshot_observed_at":"2026-08-01T16:03:09.685528Z","submitted_at":"2026-05-14T00:56:51Z","title":"AudioMosaic: Contrastive Masked Audio Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T01:52:01.164694Z"},"links":{"cited_paper":"/paper/2509.24901","citing_paper":"/paper/2605.14231"},"observation_digest":"sha256:c42f5e9b906517d3349f5979874d717abb59373ffd04143597569b4e0591102b","observation_id":"05f792ba-a12e-4388-9066-1c2db1efbf8a","resolution":{"observed_at":"2026-06-01T03:02:52.993424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.24901/citation-record","integrity":"/paper/2509.24901/integrity","json":"/paper/2509.24901/citation-record.json","paper":"/paper/2509.24901"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-04T13:51:44.534864Z","title":"11 Under review Adrien Bardes, Quentin Garrido, Jean Ponce, Michael Rabbat, Yann LeCun, Mahmoud Assran, and Nicolas Ballas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:44.534864Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:81e903492df071ad3e9cfa35b814444a8ce8eccbebd2c709eee200ac24154b7f","observation_id":"5c9991aa-4113-4371-83e7-9dfd0ec48e07","resolution":{"observed_at":"2026-08-04T13:51:44.534864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00475","last_updated":"2022-04-23T20:12:00Z","snapshot_observed_at":"2026-08-02T22:15:33.611696Z","submitted_at":"2020-10-01T15:07:25Z","title":"FSD50K: An Open Dataset of Human-Labeled Sound Events","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00475","snapshot_observed_at":"2026-08-04T13:51:44.964946Z","title":"FSD50K: An Open Dataset of Human-Labeled Sound Events.arXiv:2010.00475,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:44.964946Z"},"links":{"cited_paper":"/paper/2010.00475","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:1b2758a56e63af46817ed3336301242954b18c3561b91043e61629741ee9f047","observation_id":"483a9fdf-7bb7-4c01-96f0-73ed0886bf1b","resolution":{"observed_at":"2026-08-04T13:51:44.964946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:45.073835Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:45.073835Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:b8d16564b8d91bcf5a11f6dcc96735c5441983ab6f1024eb8ef69d27f85bc4b9","observation_id":"b9403435-813d-4cd1-b711-585b9cdc84b3","resolution":{"observed_at":"2026-08-04T13:51:45.073835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:46.998603Z","title":"The jump in performance fromJ= 1,J= 5andJ= 10is notable on all datasets, though the impact varies on the task (multi-class vs","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.998603Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:e01bc093490f3c7a0bf0460bd64fd71a4c7ed88d6c4a2b8c9dd65823b28fe105","observation_id":"acf87fba-89c4-4b71-b83b-22b55499c320","resolution":{"observed_at":"2026-08-04T13:51:46.998603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10054","last_updated":"2022-02-21T09:03:34Z","snapshot_observed_at":"2026-08-04T02:30:25.691953Z","submitted_at":"2022-02-21T09:03:34Z","title":"Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10054","snapshot_observed_at":"2026-08-04T13:51:45.510904Z","title":"Xian Li, Nian Shao, and Xiaofei Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:45.510904Z"},"links":{"cited_paper":"/paper/2202.10054","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:fb706fc4537fc79f0e99c92d1b2ef5f15cb617cc9ce6a9ea55ec3a6432288efb","observation_id":"2d31acf5-fc77-4ee5-933a-46ffcc4ee100","resolution":{"observed_at":"2026-08-04T13:51:45.510904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:45.932701Z","title":"Bill Psomas, Ioannis Kakogeorgiou, Konstantinos Karantzalos, and Yannis Avrithis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:45.932701Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:ba8d66d17e2eac94802f8f87543f660d22bd4a0ff9ac658ec2cae3c0726130f9","observation_id":"1126efe5-53a2-4b65-87e5-648bebe1ceef","resolution":{"observed_at":"2026-08-04T13:51:45.932701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:46.105002Z","title":"Attention, please! revisiting attentive probing for masked image modeling.arXiv:2506.10178,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.105002Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:f41b8da8349948f9dafaacd86c3f613da0fdd991878cf69c42dba88c1a1fdddf","observation_id":"939ccac5-4938-4078-8a55-adea5dd32e84","resolution":{"observed_at":"2026-08-04T13:51:46.105002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12880","last_updated":"2025-08-19T13:35:29Z","snapshot_observed_at":"2026-08-07T16:01:29.625185Z","submitted_at":"2025-04-17T12:13:25Z","title":"Can Masked Autoencoders Also Listen to Birds?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12880","snapshot_observed_at":"2026-08-04T13:51:46.257438Z","title":"Can masked autoencoders also listen to birds?arXiv:2504.12880, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.257438Z"},"links":{"cited_paper":"/paper/2504.12880","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:574a5213508843b76af9abf8ffd958ec9b0aaa9ba1380cbdd92e60e724c59d2d","observation_id":"fa0e470b-4070-421c-ba6d-1b6d1550011b","resolution":{"observed_at":"2026-08-04T13:51:46.257438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-07-06T06:32:32.083176Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-04T13:51:46.603532Z","title":"Speech Commands: A Dataset for Limited-V ocabulary Speech Recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.603532Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:8094976311b661f1288c0a4527f19e0d58cd5a40f618011cbca821fd839c6b8d","observation_id":"92cc30c8-ef08-4fa3-9ed2-37e0f72b5b32","resolution":{"observed_at":"2026-08-04T13:51:46.603532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:46.832485Z","title":null,"venue":null,"work_id":null,"year":1918},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.832485Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:bad35171283d36475ab738bf41110748ce119b13c936b4294acb0801bcf68a10","observation_id":"f9cddc22-e859-425f-93d3-30d1bf297250","resolution":{"observed_at":"2026-08-04T13:51:46.832485Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:47.139538Z","title":"up,\" \"down,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:47.139538Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:8c1f9dbbf157182bf187a90212c158fc540ca2d3fd4bc4c49876cfb1aeca48ef","observation_id":"d8e40391-f916-4f65-87c9-9a6acb77d6d3","resolution":{"observed_at":"2026-08-04T13:51:47.139538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03022","last_updated":"2022-05-29T17:51:53Z","snapshot_observed_at":"2026-08-08T22:27:15.105238Z","submitted_at":"2022-03-06T18:13:09Z","title":"HEAR: Holistic Evaluation of Audio Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03022","snapshot_observed_at":"2026-08-04T13:51:46.382975Z","title":"Schuller, Christian J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:46.382975Z"},"links":{"cited_paper":"/paper/2203.03022","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:ad4c6e287a124f7492aa38bd59f67d7e7f8878ea6bc2fad32951efefe3492982","observation_id":"f1de531d-941d-462b-956b-d309b4b07675","resolution":{"observed_at":"2026-08-04T13:51:46.382975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08833","last_updated":"2021-05-31T10:32:39Z","snapshot_observed_at":"2026-08-05T23:14:42.372787Z","submitted_at":"2021-02-17T15:41:38Z","title":"DESED-FL and URBAN-FL: Federated Learning Datasets for Sound Event Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08833","snapshot_observed_at":"2026-08-04T13:51:45.181707Z","title":"Johnson, Wolfgang Lorenz, Michael Taenzer, Stylianos Mimilakis, Sascha Grollmisch, Jakob Abeßer, and Hanna Lukashevich","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:45.181707Z"},"links":{"cited_paper":"/paper/2102.08833","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:992c439f839395e36414e5326f924549fe2eeeb87fd1d7d76c0d7321d18a8f4c","observation_id":"61d63d61-a0cd-4ba1-927c-a37d6f3cbadb","resolution":{"observed_at":"2026-08-04T13:51:45.181707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:45.648135Z","title":"Leonardo Pepino, Pablo Riera, and Luciana Ferrer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:45.648135Z"},"links":{"citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:b7b2521e5f89355a3702ab3e993804c60aea30fe6ff99c336c7aa227f9d81c7b","observation_id":"0bb5a247-e98e-45e9-a2fd-f5546afb9ee6","resolution":{"observed_at":"2026-08-04T13:51:45.648135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-04T13:51:44.715869Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation.arXiv:1308.3432,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:44.715869Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:6cafbd089411302c45fafbc0575a67f5419212550cdb09849b8e6a5222cb0125","observation_id":"4bf3bd0f-d82b-46bc-85f3-ce44dff427fd","resolution":{"observed_at":"2026-08-04T13:51:44.715869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06992","last_updated":"2024-06-13T04:38:02Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:44:54Z","title":"Scaling up masked audio encoder learning for general audio classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06992","snapshot_observed_at":"2026-08-04T13:51:44.825761Z","title":"Scaling up masked audio encoder learning for general audio classification.arXiv:2406.06992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:44.825761Z"},"links":{"cited_paper":"/paper/2406.06992","citing_paper":"/paper/2509.24901"},"observation_digest":"sha256:3b57ba995e2fa9dc5b8414f0618bb64b0a3b87b8ed766a1e60509235afa90842","observation_id":"491785a8-3459-4e14-8b06-35b25e30ec36","resolution":{"observed_at":"2026-08-04T13:51:44.825761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 2 inbound Pith citation observations for arXiv:2509.24901."}