Pith. sign in

Paper Citation Record · LEDGER

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering

As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2607.08800.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.08800 v1

Coverage vector

measured 34 of 34 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-13T06:40:47.064894Z

measured 34 of 34 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

34 of 34 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved34
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3141d366-95db-46a1-b5af-39f0bbe6ce36 · outbound

This paper cites Audio flamingo: A novel audio language model with few-shot learning and dialogue abilities.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Audio flamingo: A novel audio language model with few-shot learning and dialogue abilities

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:33be38cbfb8c5816f8b4d1b6ee069328a2b7c962f6d0c5adcc072453ce8e14fa

Observation e4af976e-d5d4-4f96-acf3-729c44b78b4e · outbound

This paper cites SALMONN: Towards Generic Hearing Abilities for Large Language Models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering SALMONN: Towards Generic Hearing Abilities for Large Language Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:dc20e93c569cbe3bea55480201e26752036bc9da803d5e5da84ea81f546ee63a

Observation a572e75a-d3b7-4493-aee3-20f497bcf805 · outbound

This paper cites Qwen2-Audio Technical Report.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Qwen2-Audio Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:184d4d65f7115aba029f41d0553e93d3d70ce79821993fb3d2c3615c413201da

Observation 36686df0-b898-4084-857a-3298764186fc · outbound

This paper cites Music flamingo: Scaling music understanding in audio language models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Music flamingo: Scaling music understanding in audio language models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:dc6a313a6087a14dfacdd223d60d10a9caf5e9ed71b55e4807a8b31ee384c8d8

Observation d53abd26-f7d9-44e5-90dd-5fd12224af35 · outbound

This paper cites Robust speech recognition via large-scale weak supervision.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Robust speech recognition via large-scale weak supervision

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:8e7ab0721b3b2b0ea40af216161e72d3b034f4d7d65e97ea55b8c88f734df710

Observation 30c12158-ca6c-4ecc-a762-e35f3f1fc86c · outbound

This paper cites CLAP learning audio concepts from natural language supervision.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering CLAP learning audio concepts from natural language supervision

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:53aa5b553d0d3c2bb10be1a9896da63dec51fbbeafa1ece5e7f1bdf8fce76080

Observation 94b61a9c-e131-48c1-b4e2-060520a10fc2 · outbound

This paper cites GPT-4 Technical Report.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering GPT-4 Technical Report

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:e2da5e10d56ec54d3863185f19c47091de899a5c07f43159551720a5047031f1

Observation 497bd5ba-8d1f-4666-bfaf-897214b33930 · outbound

This paper cites GPT-4o System Card.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering GPT-4o System Card

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:0baa407a01080af1d180d4ca013abb9aa617810b460271447c4f76e589da6897

Observation 1f5c90b6-0282-4607-ad68-7e64290021a4 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Gemini: A Family of Highly Capable Multimodal Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:82def895376b16c18b13937436099b8358733a16fb38b274e1b259f1f5338d30

Observation 336152a5-29f1-4a4e-920f-705d969699a9 · outbound

This paper cites BAT: Learning to Reason about Spatial Sounds with Large Language Models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering BAT: Learning to Reason about Spatial Sounds with Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:e868673ebc542044055e4bced52f3fccabe703a3c3ca0cecb3604413b454fbcb

Observation 2ea61db3-61a6-4c46-bf4c-b0a5f561e0a4 · outbound

This paper cites OWL: Geometry-aware spatial reasoning for audio large language models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering OWL: Geometry-aware spatial reasoning for audio large language models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:616584e28734a4fee137fa0d20c2f190a00580fb48e2d6c8f22670b3e58be852

Observation 2ecffda7-00fe-45b7-a76c-47f3f713826f · outbound

This paper cites Beats: Audio pre-training with acoustic tokenizers.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Beats: Audio pre-training with acoustic tokenizers

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:d41337066389e858e29bcaad3b190f776ad8e1da8ed0ae7aaf60b402f3770641

Observation 28e69ef7-b6e1-4c24-825a-25692626ab6e · outbound

This paper cites Layer Normalization.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Layer Normalization

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:d44aa7a81d10c293dcb292d40c7dc6f2d592bdc4379361b6c51973399e3d454e

Observation 9f877949-22cd-4c6c-8d34-dd75d76d6f98 · outbound

This paper cites Root mean square layer normalization.Advances in Neural Information Processing Systems, 32, 2019.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Root mean square layer normalization.Advances in Neural Information Processing Systems, 32, 2019

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:4dc8ac5d684d75a1637ddbc194576a0ea2380491ce7cc940ecd4fcd06e61b2b4

Observation 4f5ee3ff-fb0a-4882-869f-c9c097847636 · outbound

This paper cites GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:7af4e7e5b0d10da7b1d5e76fcd8a3d3aff6fd1c4be8e95c7d5ece1641bb3ccae

Observation e7ef35ac-48f8-4aee-8447-9218db54996f · outbound

This paper cites wav2vec 2.0: A framework for self-supervised learning of speech representations.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering wav2vec 2.0: A framework for self-supervised learning of speech representations

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:1eb7f6910eae7a073b1f7e6180332b88bbb56a7de5895010a3c17bb3204c77bc

Observation f8958af7-7a14-43f0-b15b-a33e8479c934 · outbound

This paper cites Hubert: Self-supervised speech representation learning by masked prediction of hidden units.IEEE/ACM Transactions on Audio, Speech, and Language Processing, 29:3451–3460, 2021.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Hubert: Self-supervised speech representation learning by masked prediction of hidden units.IEEE/ACM Transactions on Audio, Speech, and Language Processing, 29:3451–3460, 2021

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:dbf5e8e0575b5f47dcea9dab6d08520a1075bcb4f5f30e2a352717488a569ee8

Observation 288b36cd-e95e-4b26-b3c7-663dd5b33071 · outbound

This paper cites The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:a9639baa05ce15b130e12d07df46b5b489d8d45a419a2757709e4c431b951870

Observation 2365060b-cabb-408f-9874-a1a9419f67b2 · outbound

This paper cites ASAudio: A Survey of Advanced Spatial Audio Research.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering ASAudio: A Survey of Advanced Spatial Audio Research

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:9370db8d0f889e3adbb135374813faea48952072740b9607434261b7250461e5

Observation e47c89a9-877e-40db-96f1-b23ec854f35f · outbound

This paper cites Stereo Sound Event Localization and Detection with Onscreen/offscreen Classification.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Stereo Sound Event Localization and Detection with Onscreen/offscreen Classification

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:81a56e335344b3f68cae80a7643b6446584e9d93971a0a9b788f9184d24c68e0

Observation 6e08b097-96ae-4402-b35c-1dad1b6692ff · outbound

This paper cites Can Large Language Models Understand Spatial Audio?.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Can Large Language Models Understand Spatial Audio?

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:5f6f6c7888633c497e77347c286288f1ef1134f4cea56477f768850ab1bf8fa2

Observation 9747cc0e-34df-429c-8f0d-4d905ab203fc · outbound

This paper cites SA VVY: Spatial awareness via audio-visual LLMs through seeing and hearing.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering SA VVY: Spatial awareness via audio-visual LLMs through seeing and hearing

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:135f95cd172d379fac51ee8634731be56f1690b2ac6cef183d620b7984aeb283

Observation 97deb7aa-e88f-46e4-8513-950327ffe0dc · outbound

This paper cites Phasecoder: Microphone geometry-agnostic spatial audio understanding for multimodal llms.arXiv preprint arXiv:2601.21124, 2026.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Phasecoder: Microphone geometry-agnostic spatial audio understanding for multimodal llms.arXiv preprint arXiv:2601.21124, 2026

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:d9e02336864ad13fdc83058fa78a1ba3696524e7a7d1d115e7e50d19122d77aa

Observation 6f28fbe7-f804-44dc-ab79-3608fb686fa3 · outbound

This paper cites Spatial audio question answering and reasoning on dynamic source movements.arXiv preprint arXiv:2509.14666, 2025.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Spatial audio question answering and reasoning on dynamic source movements.arXiv preprint arXiv:2509.14666, 2025

Reference 24

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:6273ec55416b308a25c0c54df9cd38131cd16a5dbff7732771324bd9729a5745

Observation 518c1d3a-3848-45ad-884b-85f7309e7a42 · outbound

This paper cites Bartoldson, Bhavya Kailkhura, Avi Schwarzschild, Aniruddha Saha, Micah Goldblum, Jonas Geiping, and Tom Goldstein.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Bartoldson, Bhavya Kailkhura, Avi Schwarzschild, Aniruddha Saha, Micah Goldblum, Jonas Geiping, and Tom Goldstein

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:460640c5f4dd03c0a647b59875b173f7780bc17d32a86f43b010979076eea92e

Observation 7bb164e9-a4e6-4245-8a43-3beedb367c1a · outbound

This paper cites Towards evaluating the robustness of neural networks.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Towards evaluating the robustness of neural networks

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:e34e1af22093bb84b278c844932da99a4b24ac44d79eaf06c1b6c0c86620fd82

Observation a1c2482f-5d4a-4427-9747-b45d6f560001 · outbound

This paper cites The mechanism of stochastic resonance.Journal of Physics A: mathematical and general, 14(11):L453, 1981.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering The mechanism of stochastic resonance.Journal of Physics A: mathematical and general, 14(11):L453, 1981

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:01ed4561d05cd456504869f14c05f113eeebef9b1be65767f99ebfbe32a97492

Observation 69f37a8c-5c5d-4244-99fe-ee3c4b033bb6 · outbound

This paper cites Dither in digital audio.Journal of the Audio Engineering Society, 35(12):966–975, 1987.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Dither in digital audio.Journal of the Audio Engineering Society, 35(12):966–975, 1987

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:23c9c334be20b286514480ef211f833ee78d81cb64b62b58decd1246f004ce71

Observation 09bfcea0-ab86-418c-bee0-f14c08f87e99 · outbound

This paper cites Sigmoid-weighted linear units for neural network function approximation in reinforcement learning.Neural Networks, 107:3–11, 2018.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Sigmoid-weighted linear units for neural network function approximation in reinforcement learning.Neural Networks, 107:3–11, 2018

Reference 29

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:0d777db260e373b5855d3c4f8a972eed895ba9045ff0a031f6382029d8d8657e

Observation 7bc366f8-9b8d-4759-abe9-65c5094df11e · outbound

This paper cites Gaussian Error Linear Units (GELUs).

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Gaussian Error Linear Units (GELUs)

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:c5d8808eb8a633b50fe29ea341f21d4635e96dc1b84cc08b3f48375848e095d7

Observation ce3c7165-0008-48e8-8bf3-161b41e1ef33 · outbound

This paper cites Shortcut learning in deep neural networks.Nature Machine Intelligence, 2(11):665–673, 2020.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Shortcut learning in deep neural networks.Nature Machine Intelligence, 2(11):665–673, 2020

Reference 31

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:12177422b393373335c9c35c22819cd2dede9cb31c827ee05887d615b3e7c588

Observation c640400b-f969-43d3-85a7-05fb7fd6e319 · outbound

This paper cites Gemmeke, Daniel P.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Gemmeke, Daniel P

Reference 32

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:91976d58305eced01a0989bcc0ea1facfdca814095c07361fd45df12e0f1df51

Observation f905f1b8-2603-4fbe-9f0c-cb9e500d2ed5 · outbound

This paper cites QLoRA: Efficient finetuning of quantized LLMs.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering QLoRA: Efficient finetuning of quantized LLMs

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:892b53532a1cf5a3add83c3e9f4c792e4c8c4d15f9475ef4e1a96a4a1129160e

Observation 98df9a73-031f-4871-ae1a-18a7d6c17776 · outbound

This paper cites Music” and “Speech.

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering Music” and “Speech

Reference 34

Resolution
unresolved
no resolver link, observed 2026-07-13T06:40:47.064894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T06:40:47.064894Z digest=sha256:63e199fd25c0aae41896e482f47811c54b61a08625c9a0c4e7d5d6dc277905e9

Pith citing papers

No inbound Pith citation observations are available.