{"as_of":"2026-08-08T23:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6fda28e46c0ce909e5bd7a6e7ea53403783c5d873c4b3785867ac5510309e60","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:28:35.807111Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:28:31.282921Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:28:36.324978Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"cited_work":{"arxiv_id":"2507.02666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02666","snapshot_observed_at":"2026-08-06T20:28:36.324978Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","venue":"cs.SD","work_id":"a41e1ebe-46d4-45cc-87d4-aac4f5771946","year":2025},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.282921Z"},"links":{"cited_paper":"/paper/2507.02666","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:c2008157ac4cef688157e96b76b8aa39761f6e357d55fdb96a9ad80ebd98e9c5","observation_id":"8dafb6f8-cc68-4304-a0d1-eb76830be4ab","resolution":{"observed_at":"2026-08-06T20:28:36.496175Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02666/citation-record","integrity":"/paper/2507.02666/integrity","json":"/paper/2507.02666/citation-record.json","paper":"/paper/2507.02666"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:43.377585Z","title":null,"venue":null,"work_id":"2ab89d03-a883-4339-ad9a-2af126e7572b","year":null},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.222335Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:00352f3af5d8687ffb39decb02683f7345b4d1bb8a63031fd0b2ae7da3842127","observation_id":"a749fecc-7a27-45e6-9c7b-5514bbc48342","resolution":{"observed_at":"2026-08-06T20:28:43.464366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"cited_work":{"arxiv_id":"2507.02666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.02666","snapshot_observed_at":"2026-08-06T20:28:36.324978Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","venue":"cs.SD","work_id":"a41e1ebe-46d4-45cc-87d4-aac4f5771946","year":2025},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.282921Z"},"links":{"cited_paper":"/paper/2507.02666","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:c2008157ac4cef688157e96b76b8aa39761f6e357d55fdb96a9ad80ebd98e9c5","observation_id":"8dafb6f8-cc68-4304-a0d1-eb76830be4ab","resolution":{"observed_at":"2026-08-06T20:28:36.496175Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:43.101868Z","title":null,"venue":null,"work_id":"fbd4c799-063f-4858-9568-c9713cc4f485","year":null},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.374781Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:616b2bb9c6cf772d8d235b9ae96b7aa9379c66d8139fc9ace51a5440b687dbe4","observation_id":"8ca7fc68-4b68-45e5-91e1-66db08b608a8","resolution":{"observed_at":"2026-08-06T20:28:43.206079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:42.874756Z","title":"-” indicates that the data was not reported in the original paper. “Acc","venue":null,"work_id":"7bf3a187-5ab7-4552-9015-e149cf8d2b1b","year":null},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.461180Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:9ba16a46f85acccefbb333e3c3c977df4579954aff97694ac08b6aab139c44a5","observation_id":"8f10dea6-8666-491c-9049-e7098317f556","resolution":{"observed_at":"2026-08-06T20:28:42.989121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:42.627193Z","title":"By defining such irrelevant information as noise and drawing inspiration from differential denoising techniques, we design a dual-softmax based differential attention mecha- nism","venue":null,"work_id":"b092d69d-d31f-4f4a-b9e4-1cc3deaee743","year":null},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.558065Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:2e627fb710d4cd63a8ef9dd33f112f75e246e9d6a78bd88abebaffe5a3b1d3be","observation_id":"bb4cc9e5-9692-47bf-91cb-eae6a01f1a7b","resolution":{"observed_at":"2026-08-06T20:28:42.757882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:42.383669Z","title":"Masked autoencoders are scalable vision learners,","venue":null,"work_id":"ab06284c-dc70-4018-bc8b-cbd3d5022aaa","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.668474Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:6a10373f066bbd20e6c850912a9a7e8dda7b51cb20319eda0da4e47b2f1ceb68","observation_id":"6f538e54-0c0f-4588-9658-9d86361c4b8e","resolution":{"observed_at":"2026-08-06T20:28:42.503940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:42.171585Z","title":"Bert: Pre- training of deep bidirectional transformers for language under- standing,","venue":null,"work_id":"7c0e00c9-4627-4588-a44b-cb83abac025e","year":2019},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.830515Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:26fc79575a9a8f1e522a0e23bd52b9b28151c03944bdcb09004871ca76a526dd","observation_id":"cb7bb7a5-687c-489b-9427-ec7f04d91678","resolution":{"observed_at":"2026-08-06T20:28:42.272561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00387","last_updated":"2024-08-31T08:33:13Z","snapshot_observed_at":"2026-07-06T19:08:39.942067Z","submitted_at":"2024-08-31T08:33:13Z","title":"Progressive Residual Extraction based Pre-training for Speech Representation Learning","version":1},"cited_work":{"arxiv_id":"2409.00387","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.00387","snapshot_observed_at":"2026-08-06T20:28:36.007990Z","title":"Progressive Residual Extraction based Pre-training for Speech Representation Learning","venue":"eess.AS","work_id":"9f0601a2-e505-4edc-9d18-1f0e3278d14e","year":2024},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:31.948048Z"},"links":{"cited_paper":"/paper/2409.00387","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:695b57a0bfb3f1e0246835a5244a62020ee9fd762048981886398d1238b8d522","observation_id":"c90a53b3-3f9b-4d52-a3c8-4c4a2ac19a4a","resolution":{"observed_at":"2026-08-06T20:28:36.139009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:41.931456Z","title":"Hubert: Self-supervised speech rep- resentation learning by masked prediction of hidden units,","venue":null,"work_id":"e5c0075e-62c8-4c0f-8f04-f82db83309e6","year":2021},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.126260Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:f2d8fd1eb585f8e1585b1069a752f51e68ce2887d2bd1ae39737cc118bf74d79","observation_id":"da253594-02a9-487a-9236-2eee7d372e6d","resolution":{"observed_at":"2026-08-06T20:28:42.063611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:41.707495Z","title":"wav2vec 2.0: a framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":"8b621a87-fe16-4b95-997b-07302698ddae","year":2020},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.274563Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:1ff3b23b903301f9631dd5fa58c6aae6e0547d5db924cb1a49f6a01417979d6d","observation_id":"afcfbcf2-0914-44a5-8298-845b3c00c2ec","resolution":{"observed_at":"2026-08-06T20:28:41.831381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:41.472770Z","title":"Ssast: Self- supervised audio spectrogram transformer,","venue":null,"work_id":"862f3001-efee-490b-b12f-7b4485a7dfda","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.430571Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:f82c7bbfb831de041efd60ef446abf559a6b30e314cfbce8926c1d813e759d2f","observation_id":"04d63030-e970-49ec-babb-1162d4c6c91a","resolution":{"observed_at":"2026-08-06T20:28:41.577894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:41.231516Z","title":"Masked autoencoders that listen,","venue":null,"work_id":"8e323681-a3e2-4619-8b19-21aa796ab0ba","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.634714Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:af3dd4bf9cbe0923c73e2caebf5882d4a7e0cf619ae956c9ff021f47722481c7","observation_id":"914af37c-28fd-4eef-81e5-259442407311","resolution":{"observed_at":"2026-08-06T20:28:41.335845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:40.998399Z","title":"Efficient self- supervised learning with contextualized target representations for vision, speech and language,","venue":null,"work_id":"ca4690d0-6c04-4019-a6ea-956f217126bd","year":2023},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.783169Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:8109cc9625fc217c2ff212b5dcbbf42c1e5c885f81ea8ed1e7336173c93adb2f","observation_id":"2e8b71a1-1d16-4412-9e65-d3949fa990f4","resolution":{"observed_at":"2026-08-06T20:28:41.083573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:40.811527Z","title":"Eat: Self- supervised pre-training with efficient audio transformer,","venue":null,"work_id":"228fb95c-fe57-4d50-b7b6-a10c49cad54f","year":2024},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:32.923679Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:d387f6a6273aa0bd3965f0280fbfd2731ab8269ae2556b63c9094891b58d407f","observation_id":"3fa660ad-9dd4-4021-80a0-1acf8c125bbf","resolution":{"observed_at":"2026-08-06T20:28:40.897608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:40.589705Z","title":"Attention is all you need,","venue":null,"work_id":"6fd1755d-7eb1-4895-84ba-49c1d9479dd0","year":2017},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.071139Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:65210ac59c56a48476fbf24e0ffa97ada18550f5a231ec98e7c7ecf69143170a","observation_id":"5e0203c3-3d5c-4f14-afd8-44f521a4dbb9","resolution":{"observed_at":"2026-08-06T20:28:40.704767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:40.367774Z","title":"Beats: audio pre-training with acoustic tokeniz- ers,","venue":null,"work_id":"1a54a801-58a3-4d65-bae9-968a3bd43946","year":2023},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.192286Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:01c00bcba27341e166f87fb908946a79c40aa0d9add0164fe31fce23a5d4acc3","observation_id":"d7eaaa9e-0c11-4765-bca9-c51b03c39380","resolution":{"observed_at":"2026-08-06T20:28:40.458739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:40.184491Z","title":"An image is worth 16x16 words: Transform- ers for image recognition at scale,","venue":null,"work_id":"389e7cf6-b3ab-469b-99bc-2cd8252e33a3","year":2021},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.345089Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:454881f2f23bed01d8e04217b5bec87127f14d170a5b8afc30a9e54adda8ebbc","observation_id":"b81b1671-74d8-4721-b57c-f1d863b62c55","resolution":{"observed_at":"2026-08-06T20:28:40.261995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:39.973250Z","title":"Lost in the middle: How language mod- els use long contexts,","venue":null,"work_id":"81c4993e-0f57-4886-a707-3da6da55b422","year":2024},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.491769Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:151325ec16983520f83f91caa84d29de67a3cedaa39688e5ee835d1291532df9","observation_id":"0fce3238-da73-4f58-9818-df52c0a03fdc","resolution":{"observed_at":"2026-08-06T20:28:40.072318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:39.755838Z","title":"Is attention interpretable?","venue":null,"work_id":"d09babc0-fee4-49de-8d73-1ed519753d09","year":2019},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.644890Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:43e9215c0a135c1a993b9ab05a0dd71182a38d47b78130506cb7f29664bdd238","observation_id":"ad71e619-2f55-4c73-9d09-0e444eb99e7a","resolution":{"observed_at":"2026-08-06T20:28:39.888480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-03T16:01:59.392774Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-06T20:28:33.798137Z","title":"Differential transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.798137Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:bd3ca6ecefeb212b650b6faeb72bd58e22249372ed39fd72534bdbd048d669e6","observation_id":"5905a8ce-cce7-483c-975b-37b382bca4a5","resolution":{"observed_at":"2026-08-06T20:28:33.798137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:39.556695Z","title":"A wideband differential low-noise-amplifier with im3 harmonics and noise canceling,","venue":null,"work_id":"0229a9a0-c868-4b59-86c9-15852fe8a039","year":2015},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:33.932669Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:3f513a5e09920f4e566609786207200108f46e6531713cc3957717e93999d670","observation_id":"95ec8a69-aefa-487f-9a52-afc843e93a3f","resolution":{"observed_at":"2026-08-06T20:28:39.630957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:39.337421Z","title":"A novel concept of smart headphones using active noise cancellation and speech recognition,","venue":null,"work_id":"b6533223-bbb0-45f9-9862-c870f1cde2b8","year":2015},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.071321Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:5b591604710b9fca4ed54c5c3c6fcdd04ac7cdd10f5e362a4f224930ec9c390f","observation_id":"8f8ff9fe-067c-4818-828a-d8406bf632c9","resolution":{"observed_at":"2026-08-06T20:28:39.463913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:39.187884Z","title":"An exponen- tial moving average algorithm,","venue":null,"work_id":"4f74ba2f-b199-41fd-8357-dc9fd6b117f8","year":2012},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.229767Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:cff4e7686308a8348509fd04c36fe318c23ae69941a392f964c57a69a44bb29d","observation_id":"88d5ed6c-1eca-4d75-99e6-90979ac4d453","resolution":{"observed_at":"2026-08-06T20:28:39.255170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:38.873142Z","title":"data2vec: A general framework for self-supervised learning in speech, vision and language,","venue":null,"work_id":"2cf44951-103b-40ac-a722-2173ae315694","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.372367Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:cb547c6d2859561d0799288a1d840197bd8fe74e6dd8d26e7254b544d2af2419","observation_id":"e512e3de-1fd6-4368-a31c-d84caba40da0","resolution":{"observed_at":"2026-08-06T20:28:39.002956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-06T20:28:34.505310Z","title":"Gaussian error linear units (gelus),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.505310Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:0916dc69f4454a900da7967c8e9dd54f70ab1c998af92d5ffa71fe7414a310dd","observation_id":"9792aad9-7666-422a-88e0-2771d2e69316","resolution":{"observed_at":"2026-08-06T20:28:34.505310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:38.638787Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"728f165f-5a14-4f93-80d1-6611e25616f8","year":2017},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.652537Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:cd84afd742fc5fb4cfa9716b957bdcbb7fc11323db8722b4db991a3fade3d492","observation_id":"5925838f-fb38-40ff-ab2e-f9d984364f54","resolution":{"observed_at":"2026-08-06T20:28:38.770992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-07-06T06:32:32.083176Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-06T20:28:34.828736Z","title":"Speech commands: A dataset for limited-vocabulary speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:34.828736Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:e8e6f40383970aea02b583ea92f6a1c5bb3d39743542fc35f8c21ea6d34aff41","observation_id":"3c13d0e1-1e4c-4b56-8b90-b96052288b6d","resolution":{"observed_at":"2026-08-06T20:28:34.828736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:38.317282Z","title":"Esc: Dataset for environmental sound classifica- tion,","venue":null,"work_id":"efdee3d8-74c5-4e26-89f2-616b5810c43a","year":2015},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.015561Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:dcee30cf8e02cfb761d61b4d317aafc7bbc9dd722db77a470e6be06fe0eeb8cb","observation_id":"0ea7cfa5-d2df-4229-8e76-ac37763d11eb","resolution":{"observed_at":"2026-08-06T20:28:38.503231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:38.022563Z","title":"Ast: Audio spectrogram transformer,","venue":null,"work_id":"37b3e9fc-1dfe-4fa3-81ee-467fc7c2ce7a","year":2021},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.175188Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:8df56df66a1f9e59c59c6d7fda5ed7dadce3e8c8d66d3b9a85061d25619d1010","observation_id":"50fd7244-3494-4c5f-b670-bd941b5c9b5f","resolution":{"observed_at":"2026-08-06T20:28:38.159983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:37.655024Z","title":"Attention bottlenecks for multimodal fusion,","venue":null,"work_id":"9d7821bf-5932-4ab3-9b58-cd0b0fd58d62","year":2021},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.382149Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:f4d866bd47ff8bd454668467aa073b3990c4074bf61e0333d478a144454bbf1e","observation_id":"9d31c932-05e0-4a4b-a4eb-330476e18091","resolution":{"observed_at":"2026-08-06T20:28:37.850107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:37.298728Z","title":"Effi- cient training of audio transformers with patchout,","venue":null,"work_id":"04df61f5-ccb9-4f9a-b853-476f92d9a10c","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.545464Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:9e022f37d0e159b9a4f966732b1c786a5a96fc667367cf32c86fa5b825153b29","observation_id":"511bcd7e-44eb-4d14-8f1b-9b4958906c96","resolution":{"observed_at":"2026-08-06T20:28:37.484722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:36.993047Z","title":"Conformer-based self-supervised learning for non- speech audio tasks,","venue":null,"work_id":"cb0946c9-6016-485d-a318-698204838318","year":2022},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.695590Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:32431ed10e6b146fbf4e2e16b36c4ca39b8ac02882059ad58d8c95f5f09b39af","observation_id":"20bae886-755b-4177-b485-246e717883e9","resolution":{"observed_at":"2026-08-06T20:28:37.127599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:28:36.648684Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":"ed64a839-2b70-404f-9580-939dbb8b5604","year":2015},"citing_paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:28:35.807111Z"},"links":{"citing_paper":"/paper/2507.02666"},"observation_digest":"sha256:ea1bedfa91f3ef865690812d75c2d67e4a43e3357c88d4f29d421674a8711456","observation_id":"b9464ad4-038e-4b8f-b1a1-82856d3e764e","resolution":{"observed_at":"2026-08-06T20:28:36.766015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02666","last_updated":"2025-07-03T14:29:43Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T04:56:47.698276Z","submitted_at":"2025-07-03T14:29:43Z","title":"ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2507.02666."}