Pith. sign in

Paper Citation Record · LEDGER

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 3 inbound Pith citation observations for arXiv:2506.05140.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.05140 v2

Coverage vector

measured 71 of 71 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T10:28:45.760195Z

measured 74 of 74 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-11T23:50:12.369547Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-13T20:58:15.805732Z

Reference resolution

71 of 71 outbound references displayed

  • verified exact0
  • verified fuzzy53
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d255a0df-3d68-409c-b1c0-c4e4b494e658 · outbound

This paper cites A Survey of Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models A Survey of Large Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.289563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.289563Z digest=sha256:06194be16f391812ecd1ca1ca0427298a321c0a2751cae3d56344eb38e8c388e

Observation 09a13ad8-30a3-4816-90a7-3fe3e762fe76 · outbound

This paper cites The Llama 3 Herd of Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.368889Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.368889Z digest=sha256:73118530c65f00a96c9207a97a40fd83f0301e30eccf2b9db6d1dcf55b3334c6

Observation 3e11c524-40f8-470b-ace5-40f1b20f116c · outbound

This paper cites GPT-4o System Card.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models GPT-4o System Card

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.425083Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.425083Z digest=sha256:77f18de8edf159fdbf99b352ad3b52291f43e3385a9d8d044f90c30a9ebdec6b

Observation 74343a86-4951-42cf-b9ba-192289de4466 · outbound

This paper cites Listen, think, and understand,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Listen, think, and understand,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.449419Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:39.511419Z digest=sha256:f673bba09dd679a568c89ae7ab96b785e05586ee7dc92e1bb6019b5300a68b4e

Observation 06c2db3d-8dc4-43c5-93ed-13457067cb84 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.609105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.609105Z digest=sha256:b04dfbd8a9c9df8f4f9b94dcd0d67667b5239814ff29331c29b058ce0b5f4b32

Observation f9d1cb11-b26b-4789-89c6-6ab6f631035e · outbound

This paper cites Qwen2-Audio Technical Report.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Qwen2-Audio Technical Report

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.675867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.675867Z digest=sha256:cd8a630714386029897c78133569adb225bece5471ab770a2adf2ca4b526eb61

Observation 0aa6d605-d714-4d2c-aec3-1d12316476a5 · outbound

This paper cites Developing instruction-following speech language model without speech instruction-tuning data,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Developing instruction-following speech language model without speech instruction-tuning data,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.244037Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:39.744849Z digest=sha256:428d3e5e5ebf2c43606710992ed209099e17a9ff6ec3cf02841bd8553a6c8e28

Observation 268f2fec-eaef-4029-b141-05f4e0660226 · outbound

This paper cites Gama: A large audio- language model with advanced audio understanding and complex rea- soning abilities,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Gama: A large audio- language model with advanced audio understanding and complex rea- soning abilities,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.069942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:39.817469Z digest=sha256:2b54672e3d9f83d7ec4fd8c20eb60ce4004d45105375c824b8b47e756a742d97

Observation e83d794b-92f2-4d92-bab5-8f4112697b21 · outbound

This paper cites Desta: Enhancing speech language models through descriptive speech-text alignment,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Desta: Enhancing speech language models through descriptive speech-text alignment,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.881715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:39.893515Z digest=sha256:d79f09363fe2f942becd0917d966b6b3b159036f283578685c92197b30a2379a

Observation b1ef3cf5-5cc5-493c-b006-a94f6d3ef0fe · outbound

This paper cites Speech- copilot: Leveraging large language models for speech processing via task decomposition, modularization, and program generation,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Speech- copilot: Leveraging large language models for speech processing via task decomposition, modularization, and program generation,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.670146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:39.944369Z digest=sha256:b38280ce1c01fc23313282e33954b71808b3e413639d73a32b595163d6d8327b

Observation 80086a8e-fdc5-4f4e-a2bb-53e7a2c60d6c · outbound

This paper cites Joint audio and speech understanding,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Joint audio and speech understanding,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.460892Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.030275Z digest=sha256:8c4a9b3b29671b123d17ab644f441af844acb73bcf5e20e0e3b94eca66e4d372

Observation 42ea304d-b4fb-4fa3-a560-e4a5fcde6884 · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models SALMONN: Towards generic hearing abilities for large language models,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.289586Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.127663Z digest=sha256:40f27ff6f8d1ad0314a5b71a0be988dd7c252e3050e8ea6b5797856a3eaa10d6

Observation 7288f801-6165-4eab-aa62-3ccff0ea25e8 · outbound

This paper cites Blsp-emo: Towards empathetic large speech-language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Blsp-emo: Towards empathetic large speech-language models,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.099265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.209530Z digest=sha256:15d1c578c6e37c64da04abc9074499b41031d1091e95139ae29328c1ca7d0388

Observation d3296e3e-e49b-46ab-8237-1dc6ffb0ccf7 · outbound

This paper cites Wavllm: Towards robust and adaptive speech large language model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Wavllm: Towards robust and adaptive speech large language model,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.892249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.279680Z digest=sha256:74e4357252e4f183f6d59b6bda767c00c915675ae56027b8b962a37309f88662

Observation d6326ed4-33da-4b47-a841-0c12665efe2a · outbound

This paper cites Dynamic-SUPERB phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Dynamic-SUPERB phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.718898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.359251Z digest=sha256:e9792592a09798ba256bcd1b158d7eec440c85075b0e87ba19fed274fca8135a

Observation 4e271325-a613-4d92-ab4b-3f8917f15ed5 · outbound

This paper cites AIR-bench: Benchmarking large audio-language models via generative comprehension,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models AIR-bench: Benchmarking large audio-language models via generative comprehension,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.568234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.445257Z digest=sha256:7bac6cc07b8b454b01213c24e22679232ddda829a6a45bb26e9cd49b8f15c466

Observation 261eee84-01c6-4106-9279-3b23d98e4978 · outbound

This paper cites MMAU: A massive multi- task audio understanding and reasoning benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models MMAU: A massive multi- task audio understanding and reasoning benchmark,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.372004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.534392Z digest=sha256:e0c6ef14e4efdbdfe71d308c639f75b91659ef347bbf69698639c3cd5369a4fe

Observation ae3d2463-73c5-43c8-8ffa-27f2a4a310bd · outbound

This paper cites SD-eval: A benchmark dataset for spoken dialogue understanding beyond words,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models SD-eval: A benchmark dataset for spoken dialogue understanding beyond words,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.212745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.610768Z digest=sha256:762b12463449d047be29c6b714dba4b48cfe078cec3609334f842b9154c08e43

Observation 3f1de721-b173-43c7-861d-358b2804662d · outbound

This paper cites Audiobench: A universal benchmark for audio large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Audiobench: A universal benchmark for audio large language models,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.957156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.679645Z digest=sha256:ff58eb7d74e270786f4b9c51613789bf3d206e6b8f4a48fd93b35a3ce2a9a432

Observation 6cf1eb72-eeaf-4b9d-8c4c-2781d612b8b9 · outbound

This paper cites Sakura: On the multi- hop reasoning of large audio-language models based on speech and audio information,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Sakura: On the multi- hop reasoning of large audio-language models based on speech and audio information,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.774159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:40.743369Z digest=sha256:0a350fa5d6cee1cb502b30888cb92997dee0bb5edcd54f4bcd13e1174434506c

Observation 3c7cc759-9795-4eb5-945d-edce1eeb0748 · outbound

This paper cites Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:40.806283Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:40.806283Z digest=sha256:9dc79e75adc68722e6a5cc1a9d90b22c8b4747067f06660968c0435d7c776321

Observation 63a5ae1d-f3b6-4eb2-8f1b-02d5633e1e7e · outbound

This paper cites A Preliminary Exploration with GPT-4o Voice Mode.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models A Preliminary Exploration with GPT-4o Voice Mode

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:40.942515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:40.942515Z digest=sha256:8653857cf65bdd00194b65f5657ffcce8b3ca961087ee562617e67f0c186b237

Observation 08f9681f-dccd-4625-9f1f-ae80d6dbca1b · outbound

This paper cites Language-specific neurons: The key to multilingual ca- pabilities in large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Language-specific neurons: The key to multilingual ca- pabilities in large language models,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.628004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.060069Z digest=sha256:401d44df7e0922f3895c139f056f631c235b4c6b5b2471eaded761fb38f1d4b3

Observation 41ccb67a-b407-4d0d-a330-a5ceba50c27a · outbound

This paper cites Unveiling A Core Linguistic Region in Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Unveiling A Core Linguistic Region in Large Language Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.154385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.154385Z digest=sha256:26615ba80ec8adc8494ebcde9f8a93f695b526d930a1c186f7e11ed2473d3d06

Observation b5a452b7-0514-4390-a217-1cc74004e77b · outbound

This paper cites Do large language models latently perform multi-hop reasoning?.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Do large language models latently perform multi-hop reasoning?

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.495179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.278719Z digest=sha256:7d1ff7c057a4c0bacca99041f6ab27aa75260dc452e34f5eae7385ffe5d3cab2

Observation 80808549-20ef-42be-93a5-7f56642fa035 · outbound

This paper cites Hopping too late: Exploring the limitations of large language models on multi-hop queries,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hopping too late: Exploring the limitations of large language models on multi-hop queries,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.328622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.344013Z digest=sha256:c250348b2b30b6824c793c4fc0b4f1208ee023e3878274019ac684fe5a9e921f

Observation 34373ead-3978-4a9a-a669-ff175d7c1a59 · outbound

This paper cites Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.444497Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.444497Z digest=sha256:9d1664ae944a6c60e00ca7c7dee335d815bd152605c3c0bf78c1a234f52dbb89

Observation e3ab0f48-158b-4f3a-89ba-1a5ca2385c40 · outbound

This paper cites Knowledge neurons in pretrained transformers,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Knowledge neurons in pretrained transformers,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.207526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.540789Z digest=sha256:98319c3bd83e0ff32b97c66b082cd13c52207bc575edc2fc46080da25ae90660

Observation 2d6b254a-74ab-48d4-b9b1-92c825e88c96 · outbound

This paper cites Neuron-level knowledge attribution in large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Neuron-level knowledge attribution in large language models,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.986466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.604588Z digest=sha256:ded6a87455cebdbe051bddb5a6e16da5ea132a530c9dd049820abfac022855d2

Observation 0cdcd27e-ab70-4947-b130-04fd06516c98 · outbound

This paper cites Listen and speak fairly: a study on semantic gender bias in speech integrated large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Listen and speak fairly: a study on semantic gender bias in speech integrated large language models,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.768197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.682261Z digest=sha256:d00f40ef37a2da4c0501e2cdce09d79a3a1dc3830adba293a9c45bf3f785d392

Observation 430d8b40-28c3-485f-a683-4845b1a48d5a · outbound

This paper cites The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.761053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.761053Z digest=sha256:0794061401df4fd52ad253a1d5940429d950b3774b98993761d11d322caf668c

Observation fdc3dfa9-8676-4cf3-8fd8-b0ea56244600 · outbound

This paper cites Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.597249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.850501Z digest=sha256:92d8845cf870f08f67e3e215a0b64616dc14c6905b0079d48eb2b6a93699f61e

Observation 71985eb9-f25d-4fb9-973d-c94817a254f4 · outbound

This paper cites Interpreting GPT: the logit lens,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Interpreting GPT: the logit lens,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.405947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:41.923742Z digest=sha256:e6310a6e32a61b1de8befd70685964500aebe18b8df56c974685900a201534b4

Observation 7faaee5b-4393-464f-bafe-97049a2d0928 · outbound

This paper cites Transformer feed- forward layers build predictions by promoting concepts in the vocabulary space,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Transformer feed- forward layers build predictions by promoting concepts in the vocabulary space,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.248234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.032988Z digest=sha256:324e7b5d4a93d303e12ea136379a4721ee835a1a516b81d69ebf30432b3f1c8e

Observation 5f52850f-a96f-4253-b79c-127c79882dc4 · outbound

This paper cites Jump to conclusions: Short-cutting transformers with linear transformations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Jump to conclusions: Short-cutting transformers with linear transformations,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.035359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.170174Z digest=sha256:80d5c9cf0bede5601e3214b07b16dd22d3228b14a72ce40aa1d399377f00228e

Observation 11a12ac2-19ca-4bd8-92a9-80ff236f836d · outbound

This paper cites Eliciting Latent Predictions from Transformers with the Tuned Lens.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Eliciting Latent Predictions from Transformers with the Tuned Lens

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:42.267367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:42.267367Z digest=sha256:249d5aa765463f1fc9f49c20696ad0cb5a01a005c4476644b41b8578c9cda31a

Observation a6d30e0a-e916-4e67-8afb-90d45e4d2926 · outbound

This paper cites Superb: Speech processing universal performance benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Superb: Speech processing universal performance benchmark,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.805057Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.341114Z digest=sha256:99946b75309688a4c2d32855821f4d38d9e4a92aafb66266e6ec86ab4c6e8c0d

Observation 87c54f9d-7cc2-45bc-9464-4467e2c43df8 · outbound

This paper cites Superb-sg: Enhanced speech processing universal performance benchmark for semantic and generative capabilities,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Superb-sg: Enhanced speech processing universal performance benchmark for semantic and generative capabilities,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.562454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.439650Z digest=sha256:0b65a884e536a48080d6a08774b7d42e7f0eaa8b7768de635ecb4af1bd17e033

Observation f9d3a312-8c5f-42a5-95bb-23778ae1dfe8 · outbound

This paper cites Hear: Holistic evaluation of audio representations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hear: Holistic evaluation of audio representations,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.327559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.535596Z digest=sha256:6b9586fb2fc2dceae366d3a7e05174b95a74962bcdbccbdea1b247a6048f1b29

Observation 533e4995-5bb6-4683-ae37-237e9e1525f2 · outbound

This paper cites Marble: Music audio representation benchmark for universal evaluation,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Marble: Music audio representation benchmark for universal evaluation,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.103447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.630486Z digest=sha256:3695770f6e15d70ccd54182151f1143d75fea71337a3456459ee52870f43caac

Observation 20771945-269a-49d7-b377-95965a6790f5 · outbound

This paper cites The zero resource speech benchmark 2021: Metrics and baselines for unsupervised spoken lan- guage modeling,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The zero resource speech benchmark 2021: Metrics and baselines for unsupervised spoken lan- guage modeling,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.920026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.742459Z digest=sha256:0961089c4781c0c71e48921ba651d4cedd14696d563e9dc4997f196efe32136c

Observation c17ec7f1-7408-4b10-a54a-17411905ff03 · outbound

This paper cites Zero re- source code-switched speech benchmark using speech utterance pairs for multiple spoken languages,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Zero re- source code-switched speech benchmark using speech utterance pairs for multiple spoken languages,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.713540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.847809Z digest=sha256:75208e680855bf7dd4baa0ce75368abbb61f7e5d1f639c6a9a4a1389c728494c

Observation 88ec8539-a0f7-4678-8022-20978f78219e · outbound

This paper cites Yang, K.-P.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Yang, K.-P

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.480191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:42.973675Z digest=sha256:f6bf4d8c09d3cce772b15ece2b6a1a35ad5d05fdb254697b3daa7339357a121d

Observation 999177de-285d-4738-92ef-8c66b8a859c5 · outbound

This paper cites Ml-superb: Multi- lingual speech universal performance benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Ml-superb: Multi- lingual speech universal performance benchmark,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.304813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:43.081636Z digest=sha256:ef5176b688117629c3ee79720eaafa4a2bd3df27077cac8a94fcba86309fa21c

Observation 7a5f1b1c-f4c1-4dce-900b-24c38ee814aa · outbound

This paper cites Hubert: Self-supervised speech representation learning by masked prediction of hidden units,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hubert: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.163518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.163518Z digest=sha256:98dabeaf131e813d0500c63adb77922d07ff6813e6fd7ea74cda79aaf32488b0

Observation d6b02991-a84d-41ba-ae29-a98470367764 · outbound

This paper cites Distilhubert: Speech represen- tation learning by layer-wise distillation of hidden-unit bert,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Distilhubert: Speech represen- tation learning by layer-wise distillation of hidden-unit bert,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.116539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:43.282638Z digest=sha256:0a8abbd8003d71502a8bec6d6dca1a98137ef48c0da6da4ea82bccfd742c5521

Observation d23963c7-5910-4dbc-a95b-18c54acff6b6 · outbound

This paper cites wav2vec: Unsu- pervised pre-training for speech recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models wav2vec: Unsu- pervised pre-training for speech recognition,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.884518Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:43.363926Z digest=sha256:1d9aa087fb7801aafe77d973631d0412d1c2d61f65ab54954f2d560e1725ccec

Observation 13472697-22eb-4688-ac30-eb7430aa469b · outbound

This paper cites wav2vec 2.0: A framework for self-supervised learning of speech representations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.464970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.464970Z digest=sha256:d28e619a7ce6b1c7d5513566ea9e6f9b29071227610556ddb3d1187fb2007f46

Observation 590f5ae6-61a5-47bc-8428-42360c4161cd · outbound

This paper cites Un- supervised cross-lingual representation learning for speech recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Un- supervised cross-lingual representation learning for speech recognition,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.629438Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:43.615965Z digest=sha256:7156e33ab324ad30abae09151cd7e83acca956879d253f2428744d902909cc13

Observation 2dc9822f-7971-4ae7-bf39-39f123942272 · outbound

This paper cites Layer-wise analysis of a self-supervised speech representation model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Layer-wise analysis of a self-supervised speech representation model,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.713167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.713167Z digest=sha256:607f4b3c29ec94ce1bf20c67b7889c3047333e20b3f36e53a0a152dbbcc4c6a5

Observation 358c2750-2aac-4303-a883-fe4b5d4e8a6d · outbound

This paper cites Comparative layer-wise analysis of self-supervised speech models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Comparative layer-wise analysis of self-supervised speech models,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.412394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:43.802905Z digest=sha256:acfa5d9fa5fde4a142d4fd868f4163d62b31863c5d5ac5237aa2be3d326ec56b

Observation fd57bbe1-a919-4430-8d50-c1ac6b5de80a · outbound

This paper cites What do self- supervised speech models know about words?.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models What do self- supervised speech models know about words?

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.922682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.922682Z digest=sha256:cf95d790619202933409f1f216c06446a6265d17f09997bf75117cf3c55d9652

Observation e4d48e92-c3e0-4404-81d0-f62e8e5d66d7 · outbound

This paper cites Self-supervised speech representations are more phonetic than semantic,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Self-supervised speech representations are more phonetic than semantic,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.151047Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.021653Z digest=sha256:5b48229a93f37596dc07fafd92f72ef29974edbde8ed1ca131485b17dfa18644

Observation 38d0acc9-7ce4-43ff-a5e1-66cd90910740 · outbound

This paper cites Property neurons in self-supervised speech transformers,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Property neurons in self-supervised speech transformers,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.904036Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.138736Z digest=sha256:0c0a5038ebfca9cf6313ac4bf4ea8ad902dc3893768701944105a3e3c213e337

Observation 2f9ac762-9a08-4a90-a56c-a7fa6e953d72 · outbound

This paper cites And: Audio network dissection for interpreting deep acoustic models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models And: Audio network dissection for interpreting deep acoustic models,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.686867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.271750Z digest=sha256:2b648f2a3da2bd99d916261ac471664f7d2b143940661a7cb53148cdc44f6858

Observation 11f6f6d0-df7a-49e2-92c0-68c998ce1662 · outbound

This paper cites Do prompts really prompt? exploring the prompt understanding capability of whisper,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Do prompts really prompt? exploring the prompt understanding capability of whisper,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.464754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.360094Z digest=sha256:343f6d6344e2ccac35defc2e3b15bd1fa570305a9b4fab0bf6f08f1089300d75

Observation 85a15553-dbcb-4263-be7f-fd6d326401ba · outbound

This paper cites Hey asr system! why aren’t you more inclusive? automatic speech recognition systems’ bias and proposed bias mitigation techniques. a literature review,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hey asr system! why aren’t you more inclusive? automatic speech recognition systems’ bias and proposed bias mitigation techniques. a literature review,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.211091Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.446769Z digest=sha256:872750d3c025e5931748bab81bd1c3982e19ce51e4339f83bfadaceca88ec85f

Observation 83b29e76-ecc0-4b82-8780-90d542a34aa2 · outbound

This paper cites Emo-bias: A large scale evaluation of social bias on speech emotion recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Emo-bias: A large scale evaluation of social bias on speech emotion recognition,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.035026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.544838Z digest=sha256:229f7fb000caca990ba8abfc81b4818cfc562a6fa231011365b50e58e51ec675

Observation bef6882b-a9e1-47a8-8fac-fa1f6f7d6a20 · outbound

This paper cites Attention is not only a weight: Analyzing transformers with vector norms,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Attention is not only a weight: Analyzing transformers with vector norms,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.828288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.632292Z digest=sha256:010e0473a051be81ca48b029f74a0699f1fb780ee541c671aad377a7028fd022

Observation 216ff809-949b-444b-9ec9-f362e8d5e61f · outbound

This paper cites An investigation of neuron activation as a unified lens to explain chain-of-thought eliciting arithmetic reasoning of llms,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models An investigation of neuron activation as a unified lens to explain chain-of-thought eliciting arithmetic reasoning of llms,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.602048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.708581Z digest=sha256:e6aeaa9f9464f46b28bfec7e41e70e3e7eeaf6c63965b4f87cc69e785c8844ec

Observation 60238b45-8fe9-4896-9f52-5a5bacfbaac4 · outbound

This paper cites Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.389645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.785659Z digest=sha256:2150254376bb24d0dc3c0b2d6233fce16c61b55acce6008b41cdd36f8e0964bd

Observation a2f09161-2083-467f-8363-d8b0d72f539c · outbound

This paper cites Patchscopes: a unifying framework for inspecting hidden representa- tions of language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Patchscopes: a unifying framework for inspecting hidden representa- tions of language models,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.186010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.872331Z digest=sha256:1ca9be69c7121a492f3e5b923093a2663a2d1f96140906124b0e15314da2e1e4

Observation 8cb66489-fe01-4ea8-bfdd-537e2eb355be · outbound

This paper cites Probing classifiers: Promises, shortcomings, and ad- vances,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Probing classifiers: Promises, shortcomings, and ad- vances,

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.054969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:44.980870Z digest=sha256:66d0f5c8fac2aef10770c925b6098da9f292e89c6bdbddfe848e652678fbcef7

Observation 9d3fb428-92da-47fb-8450-ab53a9eed2e2 · outbound

This paper cites Locating and editing factual associations in gpt,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Locating and editing factual associations in gpt,

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.070032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.070032Z digest=sha256:b2eac87096fa54c16242da5c448259980f6f2fed6dced3cd4c35f5e9c60e9daa

Observation efc027ab-9f73-4900-8149-fb0eda0c8a69 · outbound

This paper cites Language models implement simple word2vec-style vector arithmetic,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Language models implement simple word2vec-style vector arithmetic,

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.923791Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:45.155817Z digest=sha256:f28d88bd48e6f06ecd2855665e0b946c804846e5121b6035916d5bc14f7b4328

Observation 6b0bba89-a4fe-4ea7-92a7-2662a66a5fc1 · outbound

This paper cites Dissecting recall of factual associations in auto-regressive language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Dissecting recall of factual associations in auto-regressive language models,

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.707136Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:45.247861Z digest=sha256:f5552b6ffc873fec66b9e8434ff2ac8a510d7f01b8a2299abc9d8944aadf97a4

Observation dc29f272-fae9-4ad9-896c-ba6620f2bc85 · outbound

This paper cites LogitLens4LLMs: Extending Logit Lens Analysis to Modern Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models LogitLens4LLMs: Extending Logit Lens Analysis to Modern Large Language Models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.356667Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.356667Z digest=sha256:cdd669186afc6e32255c89fd705c657323a819dcc2024c297b027507b88d2979

Observation 3de112a3-c617-426c-9ba7-d876bd1c4740 · outbound

This paper cites Interpreting and editing vision-language representations to mitigate hallucinations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Interpreting and editing vision-language representations to mitigate hallucinations,

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.518839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:45.458884Z digest=sha256:59942139c7d757c552106a37318970ce7f7fc3260d7a85b3ae3689ce40eed11d

Observation 29447404-6719-40ec-9937-d267fb413939 · outbound

This paper cites Towards Interpreting Visual Information Processing in Vision-Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Towards Interpreting Visual Information Processing in Vision-Language Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.549978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.549978Z digest=sha256:16981d2175a63b4b0eed5bb9927d147f8a037ebc62bb62ff2e3228c314604505

Observation d82bdc62-f328-427b-984a-1ab6dc9fc555 · outbound

This paper cites Mmneuron: Discovering neuron-level domain-specific interpretation in multimodal large language model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Mmneuron: Discovering neuron-level domain-specific interpretation in multimodal large language model,

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.335269Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:45.660126Z digest=sha256:b71c33940c2f044f93bd7fea7219a703f200b4feea296432d87e941a095d8130

Observation 311eee3a-54e4-4a15-b4ca-19732ab683c8 · outbound

This paper cites Measuring massive multitask language understanding,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Measuring massive multitask language understanding,

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.132024Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T10:28:45.760195Z digest=sha256:695724e1dc14cbbc5f2add1b4178ccde80f3b813fcbbd9424299c1d2276a8d6d

Pith citing papers

Observation 4b4c16e3-ffa9-4279-b092-f29e7075d693 · inbound

Do Audio-Visual Large Language Models Really See and Hear? cites this paper.

Do Audio-Visual Large Language Models Really See and Hear? AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 59

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:58:15.807264Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-13T20:56:19.815569Z digest=sha256:bb961c1457d3f470ebc0dc45b464fe63bad5e40005b677763e83fedae671d332

Observation 8c896b53-acc0-4529-9cc0-d8c7d500e765 · inbound

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation cites this paper.

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-11T23:16:36.162279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-07T17:39:38.234052Z digest=sha256:8f4887ce49ea3bce4206017bb23d2a2a65845588dd50849f938fa0cb4f2db740

Observation 81c5aee3-dbe6-4897-8bb8-a06c1a164750 · inbound

Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings cites this paper.

Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-11T23:50:12.369547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T23:50:12.369547Z digest=sha256:bd059c58144644a4e7fa794e707f48182917584515979e4ee22e6495358a21fc