{"as_of":"2026-08-07T08:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2cf7afa43016df52c753614e3a25952c4bff939607f25aa73e2e75274c78a7d","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:45:24.518469Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08095/citation-record","integrity":"/paper/2508.08095/integrity","json":"/paper/2508.08095/citation-record.json","paper":"/paper/2508.08095"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.902837Z","title":"Towards emotional support dialog systems,","venue":null,"work_id":"1f617b6a-fa0e-4bef-9fea-8705362d88cb","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.710941Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ab2cc6dc31d8fede2172b0936bf7634efed159421e38a62aeb7af93faf22ddb7","observation_id":"023b16f8-f232-4b6d-ac52-531636f62c4d","resolution":{"observed_at":"2026-08-05T21:45:27.983267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.702845Z","title":"Advancing large language models to capture varied speaking styles and respond properly in spoken conversations,","venue":null,"work_id":"34a959e2-1f5c-4857-8d52-e522c8728a23","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.812884Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:efe83c5192d94ab1c8ba15d986c198f0763422a08eaf1b3ae1e9c783defd6029","observation_id":"2fd5faf8-77f0-42b6-8ed4-1c4347e2aeef","resolution":{"observed_at":"2026-08-05T21:45:27.811857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.553035Z","title":"Paralinguistics-enhanced large language modeling of spoken dialogue,","venue":null,"work_id":"ad72d7d2-a492-42b9-8814-94df13a11b2f","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.891427Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:c61beb4c16cb7decf81b62218db6bdedc66fc859de857da1c5e6ea9efe1cfa5a","observation_id":"29000374-5301-4476-85e3-3b00a296f15a","resolution":{"observed_at":"2026-08-05T21:45:27.610817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00475","last_updated":"2024-07-27T07:45:43Z","snapshot_observed_at":"2026-08-04T15:15:20.818594Z","submitted_at":"2023-12-31T12:29:12Z","title":"E-chat: Emotion-sensitive Spoken Dialogue System with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00475","snapshot_observed_at":"2026-08-05T21:45:21.987977Z","title":"E-chat: Emotion-sensitive spoken dialogue system with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.987977Z"},"links":{"cited_paper":"/paper/2401.00475","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:be67a8e59d8719ca59412cb675e3633d71a50987504e48314c7f4f465f96b242","observation_id":"f70ed20d-683a-4069-ad05-ac7c5be8df1e","resolution":{"observed_at":"2026-08-05T21:45:21.987977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03872","last_updated":"2024-06-06T09:02:31Z","snapshot_observed_at":"2026-08-04T22:33:15.502958Z","submitted_at":"2024-06-06T09:02:31Z","title":"BLSP-Emo: Towards Empathetic Large Speech-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03872","snapshot_observed_at":"2026-08-05T21:45:22.097811Z","title":"Blsp-emo: Towards empathetic large speech- language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.097811Z"},"links":{"cited_paper":"/paper/2406.03872","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:97a5fc691f9798d4a1435963efbc4f33db6994f9b89555a3f70f657fc589449a","observation_id":"badd5617-2e54-4ac5-8af2-03674bf846a1","resolution":{"observed_at":"2026-08-05T21:45:22.097811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-06T09:02:03.671500Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13577","snapshot_observed_at":"2026-08-05T21:45:22.176873Z","title":"Wavchat: A survey of spoken dialogue models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.176873Z"},"links":{"cited_paper":"/paper/2411.13577","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ca03107ed0e20ab58200f6c11004fc9c7b96f3296099738c3266b6a2219afd56","observation_id":"74403b0a-948f-405d-9850-ed7df164adbb","resolution":{"observed_at":"2026-08-05T21:45:22.176873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.340053Z","title":"Connecting speech encoder and large language model for asr,","venue":null,"work_id":"754270c8-7f88-4d32-8276-163eaa350de5","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.247832Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:2a6990751f5c8c4dca7f61d982d9ac9ec364e9e7d67cbb1119f8117c66305bf7","observation_id":"c9d2b378-e387-440f-bf8f-d280dfba3e0d","resolution":{"observed_at":"2026-08-05T21:45:27.433636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-05T21:45:22.388008Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.388008Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:7b77f36be97e312678c56f378e2526d44c66f21f91a327c830a45fe8ce36f831","observation_id":"d2ab4cb9-f143-45b2-9f74-ba441f2be27a","resolution":{"observed_at":"2026-08-05T21:45:22.388008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01162","last_updated":"2025-05-19T22:01:39Z","snapshot_observed_at":"2026-07-06T19:25:38.051475Z","submitted_at":"2024-10-02T01:32:47Z","title":"Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01162","snapshot_observed_at":"2026-08-05T21:45:22.464344Z","title":"Frozen large language models can perceive paralinguistic aspects of speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.464344Z"},"links":{"cited_paper":"/paper/2410.01162","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:4bc9df1afaf3a17a392202bf416a04ef783070921a8cbf2680cd730be4f4c9bd","observation_id":"9d916934-dc42-40b7-8b6b-61e984cb33b0","resolution":{"observed_at":"2026-08-05T21:45:22.464344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.164027Z","title":"Prefix-tuning: Optimizing continuous prompts for generation,","venue":null,"work_id":"178a4314-0d3c-40c6-83c6-8d36e760c978","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.613988Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:af8a8a433fa7f0dcaa0e315eaa28f7495bc70791b999d9f5c728c763e246ae9a","observation_id":"5d0c1c21-a44d-4cc3-a0a5-e04b35f2d39a","resolution":{"observed_at":"2026-08-05T21:45:27.247680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.978810Z","title":"AudioChatLlama: Towards general-purpose speech abilities for LLMs,","venue":null,"work_id":"6a487726-e4fb-4c67-b735-e4f41bb6987e","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.693144Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:c39d69a765df5fc0c5ce81413e788a8ced35591d04e61172db89fcb89360382f","observation_id":"39842294-ec26-4b48-8cdf-8fabd6c0fd86","resolution":{"observed_at":"2026-08-05T21:45:27.053593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-03T22:14:53.516423Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-05T21:45:22.786563Z","title":"P-tuning v2: Prompt tuning can be comparable to fine- tuning universally across scales and tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.786563Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:af2744165c3906f5830449dddb954758036ce643cb016c02b21f5481b715cbc1","observation_id":"246a53c1-09e4-4d34-81bb-321ee383cd53","resolution":{"observed_at":"2026-08-05T21:45:22.786563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.815488Z","title":"Secap: Speech emotion captioning with large language model,","venue":null,"work_id":"9443e22c-5d77-480d-a486-375ee37c8dcb","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.897147Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:3153660e5d99d4fc99ff080371f5bbc71edb59744da6218da152a592646ac1ba","observation_id":"306c0a74-e426-4272-bc5d-06735aedee23","resolution":{"observed_at":"2026-08-05T21:45:26.886740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.672160Z","title":"Stylecap: Automatic speaking-style captioning from speech based on speech and language self-supervised learning models,","venue":null,"work_id":"0fdb2bc6-399e-45a0-96f3-a5da42aa08d6","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.953545Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:30ec496b582fe0437de5436f041d6196faab693691c3fc01a92b88a2978660ed","observation_id":"568692f7-dfc3-4e27-bbe4-b75835cd4477","resolution":{"observed_at":"2026-08-05T21:45:26.754260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-05T21:45:23.049151Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.049151Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:7e3614a133acc91ea1840126bea7574203036a3eb20631f098b96c07f49b702d","observation_id":"793548fc-4a4c-4de7-adc4-683ce4ac6629","resolution":{"observed_at":"2026-08-05T21:45:23.049151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.519091Z","title":"The power of scale for parameter-efficient prompt tuning,","venue":null,"work_id":"a4c9ab94-faa1-4d8a-b6d2-aa56759c6da0","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.165427Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:d87a1e7356904b7b1316893a04ed74980bb69da20c4945934c06d4f2ee3e699f","observation_id":"4d2b4f50-cebe-4ba4-bbab-19f35d7cb3da","resolution":{"observed_at":"2026-08-05T21:45:26.587093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.411196Z","title":"Multitask prompt tuning enables parameter-efficient transfer learning,","venue":null,"work_id":"941de86b-0dbd-4c93-b240-d09b3efd28fe","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.275885Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ea93a5a10309f57395235cc3a3e1d2a8046645dd6ddee6561504c9798b08b852","observation_id":"24400545-1282-4060-8997-d2d214ffb384","resolution":{"observed_at":"2026-08-05T21:45:26.462844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.244418Z","title":"Factor-conditioned speaking-style captioning,","venue":null,"work_id":"0116eca4-a5db-4198-95ec-3597f3a761a4","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.410486Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:81588c47425404ac0433e4df5683bfbacbe5f528f0dfb37d9ffe4004606acd67","observation_id":"85ab5a0e-da1e-4863-ad51-c46e1ef307ec","resolution":{"observed_at":"2026-08-05T21:45:26.321953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.080474Z","title":"Developing instruction-following speech language model without speech instruction-tuning data,","venue":null,"work_id":"d2ec505d-d943-464f-aef6-b10cbf10e6d5","year":2025},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.503271Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:1b2d4747a4087d3787a9bf3cd3090edf1d9f3a2976a22f8765c9bde4dd2389c3","observation_id":"96c53e59-f4c2-476b-9bf5-9215af47b2d4","resolution":{"observed_at":"2026-08-05T21:45:26.159406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.918202Z","title":"Textrolspeech: A text style control speech corpus with codec language text-to-speech models,","venue":null,"work_id":"ce78c10b-41b4-4bb0-86af-a727a4fa20a4","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.581006Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:cff8f98659e2f7366276f85f6176b44a1fe9169c9a21cac5ff5300734581765e","observation_id":"792d39f8-481b-4be4-b504-921685e13154","resolution":{"observed_at":"2026-08-05T21:45:25.993215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.732529Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":"66c0a1a0-6779-4745-84ce-df8c5cbcae6e","year":2019},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.695583Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ee4669d65d44aba1a0405be2a0fc555f806365e2aea6fed3b6a4685c8b5134f1","observation_id":"b1b77b22-0a61-443a-86fe-d66d95a2aff7","resolution":{"observed_at":"2026-08-05T21:45:25.831124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.570498Z","title":"Dailytalk: Spoken dialogue dataset for conversational text-to-speech,","venue":null,"work_id":"039e7d0f-bdfb-4d44-8df6-a6fed2e6e125","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.771930Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:3e6fe5b8dc536665582f9fc69c90bffc8fb1e6b23cfeb10327152b3158b708fc","observation_id":"58755def-fe82-4cd1-8e3a-6cf3c55178e0","resolution":{"observed_at":"2026-08-05T21:45:25.642640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.375383Z","title":"DailyDialog: A manually labelled multi-turn dialogue dataset,","venue":null,"work_id":"4495f93c-9925-4c1e-b172-d6e3aa7e8701","year":2017},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.839897Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:71a90033738f4712d509ceef5f9a0584d4cf32ea07ec75aa25af2a35520b72ad","observation_id":"c7f7120f-e0e7-4d47-8b88-15967f768e76","resolution":{"observed_at":"2026-08-05T21:45:25.465767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-05T21:45:23.907075Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.907075Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:27e33227e329c26a0db609e279a28e0f5488f0e9ceb9834a116109080d968a39","observation_id":"60e45a49-bb4c-47c9-8812-24061e498963","resolution":{"observed_at":"2026-08-05T21:45:23.907075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06836","last_updated":"2024-08-07T08:09:53Z","snapshot_observed_at":"2026-08-05T03:31:28.874008Z","submitted_at":"2024-01-12T16:42:10Z","title":"Enhancing Emotional Generation Capability of Large Language Models via Emotional Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06836","snapshot_observed_at":"2026-08-05T21:45:23.985849Z","title":"Enhancing emotional generation capability of large language models via emotional chain-of-thought,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.985849Z"},"links":{"cited_paper":"/paper/2401.06836","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:639f034215e847f11b6c8f8718ae3c6916fb311402d5696d6f05ed3864a6eaaa","observation_id":"4a0e96f7-a40c-4f96-8799-3a84dff6ff16","resolution":{"observed_at":"2026-08-05T21:45:23.985849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.238475Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"4f118859-f334-4ecf-8a1e-a15b0061d7cd","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.080046Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:cb6d462f1ca45ce4ce23a5cf33adeddec9c144fd44c7c166a888548c1cff29f7","observation_id":"d5f62a89-62e8-4483-8378-ed1b28e34d37","resolution":{"observed_at":"2026-08-05T21:45:25.302036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.071190Z","title":"Qwen2.5: A party of foundation models,","venue":null,"work_id":"5a8e6224-707c-47c4-b9e5-240fe02d1fed","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.159674Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:3265f44113f833c2d0b67b9f1aaf12af2b8c3e49e4a6a969fb919a75d6b71137","observation_id":"00ad5a76-e8d1-46c8-be3b-6931aa7534a1","resolution":{"observed_at":"2026-08-05T21:45:25.140468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T21:45:24.267806Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.267806Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:b08b8588e637fcb9191c1b04119d8b973986bfd8366346f9c134593b5f4151d6","observation_id":"d8edb898-90d4-4542-a7b3-47ce4f314b6d","resolution":{"observed_at":"2026-08-05T21:45:24.267806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:24.886262Z","title":"emotion2vec: Self-supervised pre-training for speech emotion representation,","venue":null,"work_id":"2910d309-6e69-4b8c-8d72-b9cd9021eebb","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.367371Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:37dd51d189bf70f7a3a8be8891b9e734dc1f7ac51e801d619c86ee82396a0c97","observation_id":"2fa7f6e5-f4eb-4bef-a256-8e1a53b5d506","resolution":{"observed_at":"2026-08-05T21:45:24.959395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-07-06T16:47:12.709738Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T21:45:24.447487Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.447487Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:f765a98efceaaf61fd4b3ad4b47f9a77e4db6cf287b45a0917b32f1b497cc037","observation_id":"0fef669a-c530-4ed1-be1b-4252f2184801","resolution":{"observed_at":"2026-08-05T21:45:24.447487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:24.726742Z","title":"SALMONN: Towards generic hearing abilities for large language models,","venue":null,"work_id":"2bb72478-ac46-45b9-af90-9aecd5ffff23","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.518469Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:d64c0a0bee749255c7887b772bf7527aec21e745e55aa4f2590a0c98f000c42d","observation_id":"6fb68982-cf30-4234-a071-0e15d3246bf2","resolution":{"observed_at":"2026-08-05T21:45:24.772470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T22:52:52.249103Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2508.08095."}