Pith. sign in

Paper Citation Record · LEDGER

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models

As of 18 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.12034.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.12034 v1

Coverage vector

measured 38 of 38 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T00:23:07.533974Z

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

38 of 38 outbound references displayed

  • verified exact1
  • verified fuzzy19
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 60e70064-f763-4b1d-9434-3ac55c57aead · outbound

This paper cites GPT-4 Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.415367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.415367Z digest=sha256:596d9fe265a31fba34ac4f1dd8b10c726294ae7707cac368cb36d1e83b98dd3f

Observation 5dee3de8-eb87-46c6-a3a6-168af74bed14 · outbound

This paper cites The Llama 3 Herd of Models.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.419462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.419462Z digest=sha256:a9e7d40b1b13819fa80ebeb0833fffceb6f28d65e8731b7ae8640d76c2c46f34

Observation 2a33887e-eba3-4e25-9f9e-a15d40c02726 · outbound

This paper cites Qwen3-Omni Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen3-Omni Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.422884Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.422884Z digest=sha256:9d830c39e35c59c9f10ca098d44ac08327ed067056d48e8c9d692ed49077c4fb

Observation 014f9437-5283-4b9f-9cf1-950c33ebc0a3 · outbound

This paper cites Gemini 3.1 Pro model card,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Gemini 3.1 Pro model card,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.989893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.426649Z digest=sha256:249d42b23583004ae902c70ecc2dd5a7336aa135b44797435be7d50029c728bf

Observation b856bf75-309d-48f7-b6da-cc5ec49c1ec1 · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SALMONN: Towards generic hearing abilities for large language models,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.978819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.430158Z digest=sha256:719accea5756ec24ddef3f6f2a80ae49c5d7455995366c197ad2b953ae90edae

Observation 8a1b1f80-79bf-4d3c-83d8-8cdc1dcc44cd · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.433724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.433724Z digest=sha256:1127c9f738c61e3009e9cf887cb66ca57e12a9baedeb701f362bc4bfb74a4289

Observation a44e4502-90ed-4aa8-9676-455e729cd3a7 · outbound

This paper cites Robust speech recognition via large-scale weak supervi- sion,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Robust speech recognition via large-scale weak supervi- sion,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.437548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.437548Z digest=sha256:f749e94b7769c2d6833596cec16bcc6557aedddbcb35324d242266dc198f0b0b

Observation 2b260830-4bef-4c03-9031-e50c0a90c1eb · outbound

This paper cites Qwen2-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen2-Audio Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.440032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.440032Z digest=sha256:5ecd4fab37facc0a1b2f52ff3e1e1b5a4339de56cb7ffc600d74698ce01baa04

Observation c7029b54-c214-4f18-8a9c-948cea2a5ed7 · outbound

This paper cites AudioPaLM: A Large Language Model That Can Speak and Listen.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models AudioPaLM: A Large Language Model That Can Speak and Listen

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.442776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.442776Z digest=sha256:e8caad9f5f1956597fac492b4fd63de49bd173fba66e306e656254d5df9bfddf

Observation be23c409-a793-4675-9e6c-a642d3a2c234 · outbound

This paper cites SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.445644Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.445644Z digest=sha256:c58fa0649ab930730c76866c845069d7abe52c89e14b0560e6338bea22d9971c

Observation d5befcf1-8e97-4322-8bb2-85b21ee9d748 · outbound

This paper cites Pengi: An audio language model for audio tasks,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Pengi: An audio language model for audio tasks,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.960878Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.448498Z digest=sha256:4116351977bed5bbad628a7b6d29bbbf2cd877427df148f467774f564854127a

Observation bcf4e1c3-41fd-48c5-9031-f9e6068469b4 · outbound

This paper cites Listen, think, and understand,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Listen, think, and understand,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.949403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.451174Z digest=sha256:46ee1db48a379bd148086008fb187d2b6c043b6d63fa76ef2d3bcbec64f40d8b

Observation 436e92b9-7991-4f55-9f3e-9c3b11f90875 · outbound

This paper cites Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.453921Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.453921Z digest=sha256:1eec62d0090c432ad25a984cc94c381227bf8cb3fedb43aaabda9d49e6b16495

Observation 1c649c4c-8438-43d7-a1ea-e3f888208f58 · outbound

This paper cites Kimi-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Kimi-Audio Technical Report

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.457110Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.457110Z digest=sha256:3c43d363d44ae6823a4d2bc3f18f1b2b54a4eb68d5722f638291ad4aad95bdc1

Observation b6cfd123-2aea-4ecf-b097-9c31e077f598 · outbound

This paper cites Aria Everyday Activities Dataset.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Aria Everyday Activities Dataset

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.460521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.460521Z digest=sha256:479eb69abf02decac80692a6e4cb89ad3de3d7c39346da38c12b6e90785b4c9c

Observation 061529ae-8eb2-41ef-95a4-ef57a1e42f44 · outbound

This paper cites Group conversations in noisy environments (GiN) – multimedia recordings for location-aware speech enhancement,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Group conversations in noisy environments (GiN) – multimedia recordings for location-aware speech enhancement,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.938183Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.464159Z digest=sha256:3ea8f0fd49119f72ad6a8d23d54fe701edce061fc4a92fcb50fe2d5c095c12af

Observation f2d41da8-e687-47c1-9386-eeaef19d19fd · outbound

This paper cites A survey on speech large language models for understanding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models A survey on speech large language models for understanding,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.926402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.467286Z digest=sha256:922813370d1b9135577a4ebbce8b0a72ff319cc1b9c5d2c734aa35d4bcf25a86

Observation 9485ef4c-b066-4279-856c-a3d7d3e69bc2 · outbound

This paper cites TagSpeech: End-to-end multi-speaker ASR and diarization with fine-grained temporal grounding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models TagSpeech: End-to-end multi-speaker ASR and diarization with fine-grained temporal grounding,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.914641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.471053Z digest=sha256:462fdc9f6edef6482ea9516ccad252b81510a8dd81ddbc258c6a628461776498

Observation d22f0655-98cf-49d7-9c6d-e78e969e082b · outbound

This paper cites The AMI meeting corpus: A pre-announcement,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The AMI meeting corpus: A pre-announcement,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.902778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.474587Z digest=sha256:0f559608f2b6a2038bf7f9a0c3d4eb1fdfbccc57a3a6267142a70dcec5ab6738

Observation 95d8291e-abac-4e04-9fd1-73f67945f4d0 · outbound

This paper cites The ICSI meeting corpus,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The ICSI meeting corpus,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.880559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.481729Z digest=sha256:e5668138397b9a00eb935de1b3fb3b171d374786166e11605eaeb5e4053ed970

Observation 0d6b4e68-45a4-4a90-b05a-6d0dc63a03a0 · outbound

This paper cites AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diarization in conference scenario,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models AISHELL-4: An open source dataset for speech enhancement, separation, recognition and speaker diarization in conference scenario,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.869312Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.484871Z digest=sha256:951ec27061aa770f9ee3f042bc1440e22b08efe4bfec7371b06953b0e4f57b83

Observation ad19c90c-f343-4d45-8a11-29bb2dfac25d · outbound

This paper cites M2MeT: The ICASSP 2022 multi-channel multi-party meeting transcription challenge,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models M2MeT: The ICASSP 2022 multi-channel multi-party meeting transcription challenge,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.857394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.487905Z digest=sha256:8e5f863f29519b032796c348e18114f451bd5630279e0811c04c529cd067c0db

Observation ec1af94d-8e78-494c-b671-3c272d73b89d · outbound

This paper cites NOTSOFAR-1 challenge: New datasets, baseline, and tasks for distant meeting transcription,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models NOTSOFAR-1 challenge: New datasets, baseline, and tasks for distant meeting transcription,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.845691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.491186Z digest=sha256:36a11553144428ef10a353157c0e8de0e89e3dd2ad0d58b0a0cc9d62c0199573

Observation 58dadf7d-539a-4ed9-b2d1-84ff239e7417 · outbound

This paper cites WearV ox: An egocentric multichannel voice assistant benchmark for wearables,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models WearV ox: An egocentric multichannel voice assistant benchmark for wearables,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.834338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.494345Z digest=sha256:e1cb439eba48ad2896ff7abbc3604146385aa3c44e5a2672d4aa6e2d148f5e82

Observation 743a6f61-a4b0-4c22-86f3-5a0be64e710e · outbound

This paper cites The CHiME-8 MMCSG challenge: Multi-modal conversations in smart glasses,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models The CHiME-8 MMCSG challenge: Multi-modal conversations in smart glasses,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.823414Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.497398Z digest=sha256:c09f369a20bf49319d4f29ec5252b79c078346c8a7fde300f5b704607d2f9108

Observation 5820bc6d-7b18-44fc-a417-e6ae5baddb8c · outbound

This paper cites On the evaluation of speech foundation models for spoken language understanding,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models On the evaluation of speech foundation models for spoken language understanding,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.812409Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.500785Z digest=sha256:5b1fc4e471945fdbf91c7de2e70a4511d75b088aad666f634bf568e9df498e1a

Observation 283e0114-9c86-4942-a851-0016637dc9f6 · outbound

This paper cites MeetEval: A toolkit for computation of word error rates for meeting transcription systems,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MeetEval: A toolkit for computation of word error rates for meeting transcription systems,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.800572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.503872Z digest=sha256:ce5f2829f88f1cf4809c65efe013168782ef7a3c77da0249817794c0177824f5

Observation fbee5349-d3e1-4161-b89d-3e31ae416d45 · outbound

This paper cites SoulX-Transcriber: A Robust End-to-End Framework for Multi-Speaker Speech Transcription.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models SoulX-Transcriber: A Robust End-to-End Framework for Multi-Speaker Speech Transcription

Reference 28

Resolution
verified exact
local_arxiv, observed 2026-08-16T00:23:07.667222Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.506953Z digest=sha256:f98748e60e4129d8e3ccc53ca8317812692351b69a6a8fd00b5f0388cf2cdcb2

Observation 1b482ad0-3f66-406d-a53f-4a458aac120a · outbound

This paper cites VIBEVOICE-ASR technical report,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models VIBEVOICE-ASR technical report,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.510255Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.510255Z digest=sha256:888ca6c555a714c4e28519f70b52e60cd2ed42b333263708ebd5f05b4506b375

Observation 52eea81b-4be9-4429-83bd-66235d3bc8b9 · outbound

This paper cites WavLM: Large-scale self-supervised pre- training for full stack speech processing,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models WavLM: Large-scale self-supervised pre- training for full stack speech processing,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.513237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.513237Z digest=sha256:e9d6fb4d4871766f70233f1696e89f6257fe8f3d96daff69046e5cc20f216fdd

Observation 3a94ce0e-a34b-4f8c-bd7d-7706b9d80f26 · outbound

This paper cites MOSS Transcribe Diarize Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MOSS Transcribe Diarize Technical Report

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.516057Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.516057Z digest=sha256:13ada24d45194833ecdf0c588b9984e66c232be9cb72a29a40ed55913d7dd92d

Observation 51fb96f5-6a85-4f93-ad33-b34cf8061fbe · outbound

This paper cites Qwen3 Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen3 Technical Report

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.518938Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.518938Z digest=sha256:886113ef81a8cfc93696307afecf1778c6065ed58c742e45ae2c96e5ff0bb994

Observation 2809d181-e360-480e-83b2-1161658f149c · outbound

This paper cites GPU-accelerated guided source separation for meeting transcription,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models GPU-accelerated guided source separation for meeting transcription,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.782325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.522013Z digest=sha256:0e54bea0b45a24fadbbdb60cd54567335979df2e421c3328e0e2caed1e60f3fa

Observation c144e878-9957-4523-a2d4-469aef10f5f6 · outbound

This paper cites Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Dual-path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.770642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.524792Z digest=sha256:a9149d175fac4f6359d12a1989e40602b9d75e51d5daa5bde7bd6917d9c7b7d3

Observation 8f9747ac-539c-4b7b-960a-11b3d08b2176 · outbound

This paper cites Qwen2.5-Omni Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Qwen2.5-Omni Technical Report

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.527433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.527433Z digest=sha256:d48bf80150d4c4431ffd4136b9cee248de623bda91155ba7a49828c13dba8123

Observation 93f9dc6c-fe8c-46dd-95ef-832cc8cefd88 · outbound

This paper cites MOSS-Audio Technical Report.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models MOSS-Audio Technical Report

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-16T00:23:07.530792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T00:23:07.530792Z digest=sha256:ed446c5e6d736e166d61dc6aefb4d58c56e85656355a953cb687d7e412c807fa

Observation a56544fc-2114-4101-a056-afd53c6469d4 · outbound

This paper cites QLoRA: Efficient finetuning of quantized LLMs,.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models QLoRA: Efficient finetuning of quantized LLMs,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T00:23:07.759555Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.533974Z digest=sha256:3863e5b154f5c153ecf10a37ae6d205e5ffd3de1788e5db6e342cc548fee75a0

Observation 6baccc7b-3362-406b-9858-0416a474c502 · outbound

This paper cites an unresolved cited work.

The SLT 2026 SmartGlasses Challenge: Benchmarking Egocentric Multi-Talker Speech Recognition and Understanding with Audio-Language Models Unresolved cited work

Reference 3869

Resolution
unresolved
raw_fallback, observed 2026-08-16T00:23:07.891006Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T00:23:07.478334Z digest=sha256:892a8a6b5e4e804a895d61735f6892dbb11a0cb29d24970beae7b8b8c456d39e

Pith citing papers

No inbound Pith citation observations are available.