Pith. sign in

Paper Citation Record · LEDGER

CoLMbo: Speaker Language Model for Descriptive Profiling

As of 7 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2506.09375.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.09375 v2

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T04:54:16.523708Z

measured 31 of 31 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T01:12:30.704449Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T03:49:09.587857Z

Reference resolution

29 of 29 outbound references displayed

  • verified exact2
  • verified fuzzy19
  • unresolved8
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 1e55df75-f254-4d7d-b201-a4b37b63cfd7 · outbound

This paper cites Singh, Profiling humans from their voice.

CoLMbo: Speaker Language Model for Descriptive Profiling Singh, Profiling humans from their voice

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:22.083119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:12.573959Z digest=sha256:11ddb7eabc6984b38df51719e8111c4d938c9233a0c7e8d4a0f548809625842e

Observation 52e474f0-1649-4bfb-be8c-8b85b5173e33 · outbound

This paper cites SEGAA: A Unified Approach to Predicting Age, Gender, and Emotion in Speech.

CoLMbo: Speaker Language Model for Descriptive Profiling SEGAA: A Unified Approach to Predicting Age, Gender, and Emotion in Speech

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-07T04:54:17.065427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:12.714022Z digest=sha256:a34907a6439e6bf0f2cb4996d585408a8f31305903f7879ca0a7f1341cddba50

Observation 9a7357ea-5862-4f48-b372-b4e84c051c72 · outbound

This paper cites Prediction of age from speech features using a multi-layer perceptron model,.

CoLMbo: Speaker Language Model for Descriptive Profiling Prediction of age from speech features using a multi-layer perceptron model,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:21.806777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:12.829754Z digest=sha256:cd4dd005f4ec7a1a6cbbdbb87eb76428662e00af473a6325cbb8321d07b2e020

Observation af666c14-a783-4cc7-a266-e9f4a27f04ce · outbound

This paper cites Salmonn: Towards generic hearing abilities for large language models,.

CoLMbo: Speaker Language Model for Descriptive Profiling Salmonn: Towards generic hearing abilities for large language models,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:21.586191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:12.984271Z digest=sha256:c805f483cbc59623e41812bfff3546e25281a23625a480559cfd73d76ced59a6

Observation 622b8839-2497-4a35-b351-39a993fdd582 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

CoLMbo: Speaker Language Model for Descriptive Profiling Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:13.128574Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:13.128574Z digest=sha256:9de4097e36422cae60fdf77dc04172924e6468ed527a2c055c94b51b1eefca97

Observation a0b56506-e4b4-47cf-9bc8-9d7a2890f29a · outbound

This paper cites Pengi: An audio language model for audio tasks,.

CoLMbo: Speaker Language Model for Descriptive Profiling Pengi: An audio language model for audio tasks,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:13.257810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:13.257810Z digest=sha256:41e6579d85852a956dfcf9267e0ebf60c470ea6ba06bf1380f4e86a759c795e2

Observation ed050362-11eb-4766-9b85-376437709e6e · outbound

This paper cites Listen, Think, and Understand.

CoLMbo: Speaker Language Model for Descriptive Profiling Listen, Think, and Understand

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:13.382210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:13.382210Z digest=sha256:d306e879083db372f8ec6479144ccb57ca0b05e85462af051b572e38f538d776

Observation 9c967c50-3543-44f4-b64c-13e5197827fb · outbound

This paper cites GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities.

CoLMbo: Speaker Language Model for Descriptive Profiling GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:13.519625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:13.519625Z digest=sha256:3c3630bd2b5f93a1da9089baa13506928e3e7317bdcc0c7cef4be4d44706fe82

Observation 884ca67a-6d6c-43d9-9744-6ac44965e930 · outbound

This paper cites Speaker recognition for multi-speaker conversations using x-vectors,.

CoLMbo: Speaker Language Model for Descriptive Profiling Speaker recognition for multi-speaker conversations using x-vectors,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:21.412124Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:13.637259Z digest=sha256:26c703bbb169739f63d5a252a89249af77309c6ebb19b485ad53d95c0d7afca7

Observation 714c89ab-903b-47e1-b36d-78d40589ef49 · outbound

This paper cites Front-end factor analysis for speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Front-end factor analysis for speaker verification,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:21.171886Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:13.770908Z digest=sha256:7019a43e68aa9f39fde645f57beeea4c6e9aef0ea524d7afee7f3cb500d7bdb3

Observation dab474bf-85c3-4fa2-9b32-7ab971586295 · outbound

This paper cites Deep neural networks for small foot- print text-dependent speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Deep neural networks for small foot- print text-dependent speaker verification,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:20.906038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:13.944604Z digest=sha256:1609ff31a7ace67a4b90e8c31257773719fafffa9b1d7b0f7e89cdd96208a989

Observation aa719a45-2e84-40eb-aa1d-c24c9e641d01 · outbound

This paper cites Generalized end-to-end loss for speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Generalized end-to-end loss for speaker verification,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:20.679258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.063835Z digest=sha256:20994ece7ba03ab069b60f3228306e815d3e444fac040e2d9ed430ac29c9b5ce

Observation 5fe4dcfe-dcb8-4f34-a86c-d954bbd1ba6b · outbound

This paper cites Front-end factor analysis for speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Front-end factor analysis for speaker verification,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:20.438171Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.186302Z digest=sha256:d46bf68fb6e33f4d4357600179e1b0b7a3096b175dbd30b19d9f9b469f70973e

Observation e84767c0-373c-4828-8add-3905da63afec · outbound

This paper cites Conformer: Convolution-augmented transformer for speech recognition,.

CoLMbo: Speaker Language Model for Descriptive Profiling Conformer: Convolution-augmented transformer for speech recognition,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:20.219859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.348254Z digest=sha256:863b73334a942ddac28876a721837cfdfb83f161da126c15f4c2f1cd3c296e74

Observation ad2fb05a-1dbb-4e8c-85cb-d3e9d1612847 · outbound

This paper cites Mfa-conformer: Multi-scale feature aggregation conformer for automatic speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Mfa-conformer: Multi-scale feature aggregation conformer for automatic speaker verification,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:19.955951Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.495507Z digest=sha256:459e1f869ef2dc0629d1503a49bc3c96a747393e2317328423e7faeb6236ad70

Observation 48d2153f-20df-4719-96d5-5b086db3dc36 · outbound

This paper cites A novel scheme for speaker recognition using a phonetically-aware deep neural network,.

CoLMbo: Speaker Language Model for Descriptive Profiling A novel scheme for speaker recognition using a phonetically-aware deep neural network,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:19.718881Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.692566Z digest=sha256:caffcf3fcf0a5d334676518f42c37a65608b1e2674316206bf45d982a758a290

Observation 460728b4-b63d-4ecb-997a-3d05888fbab3 · outbound

This paper cites Employing phonetic information in dnn speaker embeddings to improve speaker recognition performance,.

CoLMbo: Speaker Language Model for Descriptive Profiling Employing phonetic information in dnn speaker embeddings to improve speaker recognition performance,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:19.409779Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:14.824249Z digest=sha256:1d6977265a48fb2a688ffba35a11f339d18b149264807d64f2a1bb547d3d711d

Observation b4f9717d-1e1f-4572-bde9-4f699a9d9dab · outbound

This paper cites Speaker Embedding Extraction with Phonetic Information.

CoLMbo: Speaker Language Model for Descriptive Profiling Speaker Embedding Extraction with Phonetic Information

Reference 18

Resolution
verified exact
local_arxiv, observed 2026-08-07T04:54:16.793671Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.003832Z digest=sha256:dd7b505619be6ae6b1feb47f28898e49c75c0f7fa01aa98e4a799ee8cc4280c7

Observation 2b5087c3-98b3-4329-bb21-02284159fb25 · outbound

This paper cites Gender and age estimation methods based on speech using deep neural networks,.

CoLMbo: Speaker Language Model for Descriptive Profiling Gender and age estimation methods based on speech using deep neural networks,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:19.123983Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.125576Z digest=sha256:70a2884a5695c671d608f1f4b6a71099a80ac59f36eb61783dc623a83c7e04c9

Observation ebce4b4a-d3d7-43bd-80a4-ba29b5b2052c · outbound

This paper cites Explainable Attribute-Based Speaker Verification.

CoLMbo: Speaker Language Model for Descriptive Profiling Explainable Attribute-Based Speaker Verification

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:15.253430Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:15.253430Z digest=sha256:309ecb10f69fdf6ea6f7d3cba4485e220903ec801ad25f6b211a40abac928172

Observation bce57a1b-a809-4bea-9796-5cb1d0de19fb · outbound

This paper cites Pdaf: A phonetic debiasing attention framework for speaker verification,.

CoLMbo: Speaker Language Model for Descriptive Profiling Pdaf: A phonetic debiasing attention framework for speaker verification,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:18.816521Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.419608Z digest=sha256:0c6efe1cc748333d4071fb03fdf6dd90e1b41b003819bd2e3b874f0fae969464

Observation f8c28283-b524-4c6a-bf1d-4adbcaf03595 · outbound

This paper cites ClipCap: CLIP Prefix for Image Captioning.

CoLMbo: Speaker Language Model for Descriptive Profiling ClipCap: CLIP Prefix for Image Captioning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:15.589604Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:15.589604Z digest=sha256:3d633b5aff1920b320d6bfb948d9c4143f1509f416483de45ec591dccef2302c

Observation b80c9514-0a64-4ffe-aec1-0c05fd711fa3 · outbound

This paper cites Multimodal few-shot learning with frozen lan- guage models,.

CoLMbo: Speaker Language Model for Descriptive Profiling Multimodal few-shot learning with frozen lan- guage models,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:18.489518Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.751445Z digest=sha256:a53b250f105bf8ce166680e81cadb204bcb7a0dfaaec6decda35cacc78febd47

Observation 5ea11c10-beb9-4c77-9595-8e602a406a51 · outbound

This paper cites EARS: An anechoic fullband speech dataset benchmarked for speech enhancement and dereverberation,.

CoLMbo: Speaker Language Model for Descriptive Profiling EARS: An anechoic fullband speech dataset benchmarked for speech enhancement and dereverberation,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:18.202577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.862316Z digest=sha256:dd55da7b825f2a1d58cf4883bffd2270bff5e89e47dddb399efb8eefd5825a4e

Observation 0ccf614f-994e-4089-8054-e69a8d5e55a5 · outbound

This paper cites Darpa timit acoustic-phonetic continuous speech corpus cd-rom. nist speech disc 1-1.1,.

CoLMbo: Speaker Language Model for Descriptive Profiling Darpa timit acoustic-phonetic continuous speech corpus cd-rom. nist speech disc 1-1.1,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:17.892657Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:15.969339Z digest=sha256:f614abd5d2c31dde029bf75d08cc25006acd74d1abe3bf298d7aa2cf504186f1

Observation 28bb011e-b81e-47b8-a31d-27847cbbbd50 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

CoLMbo: Speaker Language Model for Descriptive Profiling LLaMA: Open and Efficient Foundation Language Models

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:16.137326Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:16.137326Z digest=sha256:db5596f10705dbb9a4df5b278fc5e6a12b53b13a7d466e07001552745624ae20

Observation 8d60644f-f691-4de9-a987-93d0a1976863 · outbound

This paper cites Audio Entailment: Assessing Deductive Reasoning for Audio Understanding.

CoLMbo: Speaker Language Model for Descriptive Profiling Audio Entailment: Assessing Deductive Reasoning for Audio Understanding

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T04:54:16.288107Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:54:16.288107Z digest=sha256:0b0e25bb39e7e4cdd5cae2405c5e78782b115cba1d3da8aadffe284ad09a6b86

Observation b94ec1ce-8733-415f-a8b1-afbc1565e7b0 · outbound

This paper cites Adam: A method for stochastic optimization,.

CoLMbo: Speaker Language Model for Descriptive Profiling Adam: A method for stochastic optimization,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:17.641108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:16.429096Z digest=sha256:1c92e77d30cab6684fa6aeb81edf7c4ded10698d6a5eedf0423d4650ac3c4060

Observation 3ec8cfe9-c01c-41dd-84db-f67641700744 · outbound

This paper cites Pytorch: An imperative style, high-performance deep learning library,.

CoLMbo: Speaker Language Model for Descriptive Profiling Pytorch: An imperative style, high-performance deep learning library,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T04:54:17.336576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T04:54:16.523708Z digest=sha256:15a99bcf1691cf7569a2792c4297d922c7b7a17b9375fa6392ae9ae3a333e653

Pith citing papers

Observation d2701b38-547c-4780-ad59-9e18bda8fe7e · inbound

SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning cites this paper.

SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning CoLMbo: Speaker Language Model for Descriptive Profiling

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-15T03:24:55.781236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-15T03:20:37.488507Z digest=sha256:35735536abee3741f5b9227894df7c8586fa9cdf6dfac8f66d65b514a48229e4

Observation 00bc2fc1-edc9-4bd5-87d5-2f6625cd7dfb · inbound

Large Audio Language Models for Spoofing-Aware Speaker Verification cites this paper.

Large Audio Language Models for Spoofing-Aware Speaker Verification CoLMbo: Speaker Language Model for Descriptive Profiling

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T01:12:30.704449Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T01:12:30.704449Z digest=sha256:fd6644dd4d7621c0bf591ca3a9c823994e90e1f1f7f7f311ef283addb660a453