Pith. sign in

Paper Citation Record · LEDGER

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models

As of 18 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.12034.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.12034 v1

Coverage vector

measured 38 of 38 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T00:23:07.533974Z

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

38 of 38 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 60e70064-f763-4b1d-9434-3ac55c57aead · outbound

This paper cites GPT-4 Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.415367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.415367Z digest=sha256:f0ad0dc1cba9faa73b19bac2b9b960442359e5bed87cbb8c998715ebff5a0385

Observation 5dee3de8-eb87-46c6-a3a6-168af74bed14 · outbound

This paper cites The Llama 3 Herd of Models.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.419462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.419462Z digest=sha256:032c2c20e6925202ff49ae92cba0a9534e717e6b28b7d5275183f038e7351120

Observation 2a33887e-eba3-4e25-9f9e-a15d40c02726 · outbound

This paper cites Qwen3-Omni Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen3-Omni Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.422884Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.422884Z digest=sha256:7bbd59987cfd1923d2510b1ed1b50bcb3b429a8c5c100dddc848446d6cad445f

Observation 014f9437-5283-4b9f-9cf1-950c33ebc0a3 · outbound

This paper cites Gemini 3.1 Pro model card,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Gemini 3.1 Pro model card,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.989893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.426649Z digest=sha256:5912ecc5566313e585b04402fc58ba1632399b9e19f064f16083a554ff4b44de

Observation b856bf75-309d-48f7-b6da-cc5ec49c1ec1 · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SALMONN: Towards generic hearing abilities for large language models,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.978819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.430158Z digest=sha256:32677ce328adfebea2cd54a1b1ae3ce7c7bac5bb8fa8b04c056dadfc1937b9e5

Observation 8a1b1f80-79bf-4d3c-83d8-8cdc1dcc44cd · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.433724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.433724Z digest=sha256:a51322b763dc6b1026d738c9cf644f17c764194956478aa0f73ce5d9d70b2a68

Observation a44e4502-90ed-4aa8-9676-455e729cd3a7 · outbound

This paper cites Robust speech recognition via large-scale weak supervi- sion,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Robust speech recognition via large-scale weak supervi- sion,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.437548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.437548Z digest=sha256:4785f222aa8043b353947b7f2618d49a8c2dd6fabbd098a7b4ce26ccb4e271dc

Observation 2b260830-4bef-4c03-9031-e50c0a90c1eb · outbound

This paper cites Qwen2-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen2-Audio Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.440032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.440032Z digest=sha256:9badd1b51e69c420209a665eea34726f5b23ca45357683963f26378a6b84799d

Observation c7029b54-c214-4f18-8a9c-948cea2a5ed7 · outbound

This paper cites AudioPaLM: A Large Language Model That Can Speak and Listen.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models AudioPaLM: A Large Language Model That Can Speak and Listen

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.442776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.442776Z digest=sha256:cada3598df7435a90f35ac9ff23187c6a341a9d83c2d3b23e99c759cc1bc86bc

Observation be23c409-a793-4675-9e6c-a642d3a2c234 · outbound

This paper cites SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.445644Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.445644Z digest=sha256:4678568ddb329ed6c962aee57849cbb7093a1c0ff4ad833739362a841849748c

Observation d5befcf1-8e97-4322-8bb2-85b21ee9d748 · outbound

This paper cites Pengi: An audio language model for audio tasks,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Pengi: An audio language model for audio tasks,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.960878Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.448498Z digest=sha256:1e82a2fac273916ef0730c64a0a73814bf9433c93c42d1d3028faf7266a97b99

Observation bcf4e1c3-41fd-48c5-9031-f9e6068469b4 · outbound

This paper cites Listen, think, and understand,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Listen, think, and understand,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.949403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.451174Z digest=sha256:8b2277532989c067a136f7e474bf0f47af99f6d4a7fa45eb57e8d0683d0d81ba

Observation 436e92b9-7991-4f55-9f3e-9c3b11f90875 · outbound

This paper cites Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.453921Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.453921Z digest=sha256:95a0e9bad898049dec3bb81adb382c56b41556db069a1b841ee2ed17977ab8eb

Observation 1c649c4c-8438-43d7-a1ea-e3f888208f58 · outbound

This paper cites Kimi-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Kimi-Audio Technical Report

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.457110Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.457110Z digest=sha256:087220ea6e55c79e5c3486c223c704f09ee5775b60c69989de5ca7cce1e3136b

Observation b6cfd123-2aea-4ecf-b097-9c31e077f598 · outbound

This paper cites Aria Everyday Activities Dataset.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Aria Everyday Activities Dataset

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.460521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.460521Z digest=sha256:60e142540da7e4bf97bb7cd081d28b7167736ba4f2919bee324b99da81f0d0eb

Observation 061529ae-8eb2-41ef-95a4-ef57a1e42f44 · outbound

This paper cites Group conversations in noisy environments (GiN) – multimedia recordings for location-aware speech enhancement,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Group conversations in noisy environments (GiN) – multimedia recordings for location-aware speech enhancement,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.938183Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.464159Z digest=sha256:d9577a3192c29730814a3b24e8f654444f8326c3abf426adcb043094d28f08b8

Observation f2d41da8-e687-47c1-9386-eeaef19d19fd · outbound

This paper cites A survey on speech large language models for understanding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models A survey on speech large language models for understanding,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.926402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.467286Z digest=sha256:78cc26fd48afe3d2177b1454586e649a671cd9054d03ade297b5e29b340531f4

Observation 9485ef4c-b066-4279-856c-a3d7d3e69bc2 · outbound

This paper cites TagSpeech: End-to-end multi-speaker ASR and diarization with fine-grained temporal grounding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models TagSpeech: End-to-end multi-speaker ASR and diarization with fine-grained temporal grounding,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.914641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.471053Z digest=sha256:2d42f95147f9def9073a56078d5fe02ef2a0f3137ce761a20851673a27eefb0e

Observation d22f0655-98cf-49d7-9c6d-e78e969e082b · outbound

This paper cites The AMI meeting corpus: A pre-announcement,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The AMI meeting corpus: A pre-announcement,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.902778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.474587Z digest=sha256:11a950910d2dd4e1e53153c7b850a78f510ea60401b4e415fa677383ce53e01b

Observation 95d8291e-abac-4e04-9fd1-73f67945f4d0 · outbound

This paper cites The ICSI meeting corpus,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The ICSI meeting corpus,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.880559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.481729Z digest=sha256:b5a83f3e875dba9497c2ddb42e27c0d993a53742dce071b26658f9314b7cc0f8

Observation 0d6b4e68-45a4-4a90-b05a-6d0dc63a03a0 · outbound

This paper cites AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diarization in conference scenario,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diarization in conference scenario,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.869312Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.484871Z digest=sha256:c78990a0010fc277fc8ad756194cb8e82d4e919ff3082c81fdc77635487842b8

Observation ad19c90c-f343-4d45-8a11-29bb2dfac25d · outbound

This paper cites M2MeT: The ICASSP 2022 multi-channel multi-party meeting transcription challenge,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models M2MeT: The ICASSP 2022 multi-channel multi-party meeting transcription challenge,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.857394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.487905Z digest=sha256:16697106231c561fd0fe4a181fdefe9d5b2d9112dd7df7a7bc1148a726fb7724

Observation ec1af94d-8e78-494c-b671-3c272d73b89d · outbound

This paper cites NOTSOFAR-1 challenge: New datasets, baseline, and tasks for distant meeting transcription,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models NOTSOFAR-1 challenge: New datasets, baseline, and tasks for distant meeting transcription,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.845691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.491186Z digest=sha256:15dad4aac71445dbb282debe977b21148b702f16364270309fcf54654aebc50d

Observation 58dadf7d-539a-4ed9-b2d1-84ff239e7417 · outbound

This paper cites WearV ox: An egocentric multichannel voice assistant benchmark for wearables,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models WearV ox: An egocentric multichannel voice assistant benchmark for wearables,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.834338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.494345Z digest=sha256:a1ddcb4dfb06d65d997f93032404e1fbb19407c5cd06f5fc47803e4433616e31

Observation 743a6f61-a4b0-4c22-86f3-5a0be64e710e · outbound

This paper cites The CHiME-8 MMCSG challenge: Multi-modal conversations in smart glasses,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The CHiME-8 MMCSG challenge: Multi-modal conversations in smart glasses,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.823414Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.497398Z digest=sha256:0e31d1f5a6b8e368df40295069230c0906ba161ec9f46f01d0a47173b8d45342

Observation 5820bc6d-7b18-44fc-a417-e6ae5baddb8c · outbound

This paper cites On the evaluation of speech foundation models for spoken language understanding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models On the evaluation of speech foundation models for spoken language understanding,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.812409Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.500785Z digest=sha256:055e53afa1deb760f80505a303bea2aaab7f6b8930d7aa35a013047da7e27f12

Observation 283e0114-9c86-4942-a851-0016637dc9f6 · outbound

This paper cites MeetEval: A toolkit for computation of word error rates for meeting transcription systems,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MeetEval: A toolkit for computation of word error rates for meeting transcription systems,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.800572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.503872Z digest=sha256:70c25b42c902ca209244dec904c5d9ab9e261c633c842bb7d55845b9499e7af4

Observation fbee5349-d3e1-4161-b89d-3e31ae416d45 · outbound

This paper cites SoulX-Transcriber: A Robust End-to-End Framework for Multi-Speaker Speech Transcription.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SoulX-Transcriber: A Robust End-to-End Framework for Multi-Speaker Speech Transcription

Reference 28

Resolution
verified exact
local_arxiv, observed 2026-08-16T00:23:07.667222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.506953Z digest=sha256:9f47e34b44fcbd4fd872b426b945ec1d9bdf4693c8a7874359f60570baa3bc46

Observation 1b482ad0-3f66-406d-a53f-4a458aac120a · outbound

This paper cites VIBEVOICE-ASR technical report,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models VIBEVOICE-ASR technical report,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.510255Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.510255Z digest=sha256:4ca58e27cae75fd569c97f2a1bee280b9b9bacd69213ffcfc8e5aa7eca3178cc

Observation 52eea81b-4be9-4429-83bd-66235d3bc8b9 · outbound

This paper cites WavLM: Large-scale self-supervised pre- training for full stack speech processing,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models WavLM: Large-scale self-supervised pre- training for full stack speech processing,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.513237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.513237Z digest=sha256:93cedae4f4549af21650dbd38655dd82a965c7727a1c9618ce07e3e4d781f883

Observation 3a94ce0e-a34b-4f8c-bd7d-7706b9d80f26 · outbound

This paper cites MOSS Transcribe Diarize Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MOSS Transcribe Diarize Technical Report

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.516057Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.516057Z digest=sha256:00b4c779c90698af1e2b2c5ef7a5bef69b99f5560330dc6996bec2437fc9697a

Observation 51fb96f5-6a85-4f93-ad33-b34cf8061fbe · outbound

This paper cites Qwen3 Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen3 Technical Report

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.518938Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.518938Z digest=sha256:86b29c670a90bfea7c581182c4a6ebad47a8d5940c136cba2f746bb045525800

Observation 2809d181-e360-480e-83b2-1161658f149c · outbound

This paper cites GPU-accelerated guided source separation for meeting transcription,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models GPU-accelerated guided source separation for meeting transcription,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.782325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.522013Z digest=sha256:34f0c4fc53e94c3b7ef595c43e2e69023602c43f621667208642012698c34704

Observation c144e878-9957-4523-a2d4-469aef10f5f6 · outbound

This paper cites Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.770642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.524792Z digest=sha256:4e2fc40b746e4cbaa97a05eb9e9dd59216a42e89611c70952020884fd1133704

Observation 8f9747ac-539c-4b7b-960a-11b3d08b2176 · outbound

This paper cites Qwen2.5-Omni Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen2.5-Omni Technical Report

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.527433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.527433Z digest=sha256:65a7531a6df3734e389d8f8c9a909c8aad5ec67bb9cdb3eb77a306c163350c51

Observation 93f9dc6c-fe8c-46dd-95ef-832cc8cefd88 · outbound

This paper cites MOSS-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MOSS-Audio Technical Report

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.530792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.530792Z digest=sha256:9153d245206d95c04f797caf4774ba6828d83a8c6c539bee3d35db59a90e0be8

Observation a56544fc-2114-4101-a056-afd53c6469d4 · outbound

This paper cites QLoRA: Efficient finetuning of quantized LLMs,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models QLoRA: Efficient finetuning of quantized LLMs,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.759555Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.533974Z digest=sha256:2232a9d290d4a4a19a5134aa13b14ae99262eabeb9524a8c55f3d9cd46fc58ac

Observation 6baccc7b-3362-406b-9858-0416a474c502 · outbound

This paper cites an unresolved cited work.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Unresolved cited work

Reference 3869

Resolution
unresolved
raw_fallback, observed 2026-08-16T00:23:07.891006Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T00:23:07.478334Z digest=sha256:2dbe4bf3232659dedad21eb6bd93870dfaeae7cdae55721739b97fafbead4061

Pith citing papers

No inbound Pith citation observations are available.