{"as_of":"2026-08-06T19:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f94d339011aa03033af5de5f76b40d166838b7be02e6949adaf83104c065e974","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:41:57.488433Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:03:09.632009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:59:47.893961Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"cited_work":{"arxiv_id":"2507.18119","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18119","snapshot_observed_at":"2026-08-05T20:59:47.893961Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","venue":"cs.CL","work_id":"58f461a8-b385-42cc-b7cf-1294e2d805a0","year":2025},"citing_paper":{"arxiv_id":"2508.09599","last_updated":"2026-05-23T09:18:10Z","snapshot_observed_at":"2026-08-05T20:59:41.908406Z","submitted_at":"2025-08-13T08:28:21Z","title":"BridgeTA: Bridging the Representation Gap in Knowledge Distillation via Teacher Assistant for Bird's Eye View Map Segmentation","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-05T20:59:43.785209Z"},"links":{"cited_paper":"/paper/2507.18119","citing_paper":"/paper/2508.09599"},"observation_digest":"sha256:4a0e22795844a55c59bcfd333b85ee370e3b5c2ead563680a59406ac0ae82fec","observation_id":"114b1b5d-ca08-4e4f-99be-214cde165239","resolution":{"observed_at":"2026-08-05T20:59:47.953809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18119","snapshot_observed_at":"2026-08-05T21:03:09.632009Z","title":"Language Resources and Evaluation (LREC), 42: 335–359","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09600","last_updated":"2025-09-03T13:33:34Z","snapshot_observed_at":"2026-08-05T21:03:08.737740Z","submitted_at":"2025-08-13T08:30:14Z","title":"OSUM-EChat: Enhancing End-to-End Empathetic Spoken Chatbot via Understanding-Driven Spoken Dialogue","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:09.632009Z"},"links":{"cited_paper":"/paper/2507.18119","citing_paper":"/paper/2508.09600"},"observation_digest":"sha256:0d1430635c7e4f07ed7fec1a262afd3231986299fc36458cd0dd7ac675332d8d","observation_id":"5affa23d-c094-4c16-896c-d006ce8796cc","resolution":{"observed_at":"2026-08-05T21:03:09.632009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18119/citation-record","integrity":"/paper/2507.18119/integrity","json":"/paper/2507.18119/citation-record.json","paper":"/paper/2507.18119"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.910354Z","title":"On the landscape of spoken language models: A comprehensive survey,","venue":null,"work_id":"635298b0-0316-44c9-9d94-a07e0b3889b9","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.365862Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:6b9ae6752361ae3b579763e2a0566f072e17ef5e9fbd231f288aee0d980cdf24","observation_id":"eb64e32c-ff90-48d9-b9f2-575e4fb635e2","resolution":{"observed_at":"2026-08-06T14:41:57.914459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.897274Z","title":"Speechgpt: Empowering large language models with intrinsic cross-modal conversational abilities,","venue":null,"work_id":"7d9d1a5a-5e88-42cb-b308-792221fa23af","year":2023},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.371356Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:75805575e1031aacc088a2809a8bf0741948997a750bbe53a992112c523db51e","observation_id":"68bbeba8-9c7c-467d-b81d-bd99ce2c822f","resolution":{"observed_at":"2026-08-06T14:41:57.901450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.884315Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":"ad3aa688-3187-4ee2-bcae-9e1522ff1eb4","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.376159Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:cd75e67b4635810385ce9fe9ae476309a8b57dd958d304764695a98e05349bc6","observation_id":"24041366-a50b-40ad-a380-5a6e1234c62c","resolution":{"observed_at":"2026-08-06T14:41:57.888581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.871700Z","title":"Speechgpt 2.0-preview,","venue":null,"work_id":"5bd7e0ca-e9a0-47a3-8124-a77acc4dc533","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.381247Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:29f2c00bee77583edbcc54bfff8ba1c1b31a7e6f6a07b8089fe7fa68c4cfefc2","observation_id":"72c5bfa6-bcc3-430b-a2bc-3d0e4a717200","resolution":{"observed_at":"2026-08-06T14:41:57.875689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.858647Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":"02d4f530-a780-459b-9a2a-b56795b9014f","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.385844Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:0874abba1e49113a275a49612017d38080e07c01a6a77da62c27fb3092cd27a2","observation_id":"938b6b44-702d-478d-a7f9-d18e29f44c28","resolution":{"observed_at":"2026-08-06T14:41:57.862931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.845155Z","title":"Freeze-omni: A smart and low latency speech-to-speech dialogue model with frozen LLM,","venue":null,"work_id":"299d8cd3-a4f1-4562-869e-f4ecd8a5f4cc","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.390739Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:8997a5bb8b01276ff06d42d1c174f10f031b1842eaec1e52d4d8499b8827d265","observation_id":"e72106f9-554c-4ef0-8642-7a89c502a69f","resolution":{"observed_at":"2026-08-06T14:41:57.849408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.832172Z","title":"Slam-omni: Timbre-controllable voice interaction system with single-stage training,","venue":null,"work_id":"1ee058ad-4eea-4601-87d1-a39a142d5fc4","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.396459Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:47394a061f9f77b343208f2131fe6c70c8cb34b2b7d69f0c663ef6916c1a1cb0","observation_id":"36bed796-faa9-4a2e-96fc-0c967461f38a","resolution":{"observed_at":"2026-08-06T14:41:57.836513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.819391Z","title":"Glm-4-voice: Towards intelligent and human-like end-to-end spoken chatbot,","venue":null,"work_id":"5df6bd38-58e0-440b-b09f-0e4888520128","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.400457Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:87119239929bb90eff86985a770c1aa31eca899182a89c278e3e38ffaf3cf90a","observation_id":"02c73c13-ce25-43d2-8f96-5a2a7c3f9521","resolution":{"observed_at":"2026-08-06T14:41:57.823488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.806421Z","title":"Minicpm-o 2.6: A gpt-4o level mllm for vision, speech, and multimodal live streaming on your phone,","venue":null,"work_id":"8db67662-7f36-447c-b06c-f230762d8ffa","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.404284Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:15939020c4588d7a566cdcdb6042fef25d9a3f78333388c81c2cc6703c4a670f","observation_id":"cc859baf-0b64-426d-a228-f8fba81a3694","resolution":{"observed_at":"2026-08-06T14:41:57.810776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.791773Z","title":"Baichuan-omni-1.5 technical report,","venue":null,"work_id":"b1502eec-0b06-419b-aed1-26ddd1629604","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.408621Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:57399894a96b82678af91bb8fb2ea02bf25320d707f599ae50a5bc74bd286286","observation_id":"cdb7173f-a781-48aa-8211-75e898235a4a","resolution":{"observed_at":"2026-08-06T14:41:57.796923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.778216Z","title":"Salmonn-omni: A codec-free LLM for full-duplex speech understanding and generation,","venue":null,"work_id":"ebed501b-8658-4df7-bb73-e7cbf0a79fc8","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.412961Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:f29c7c337f48904dc52368a6012733ccf94d2b83dfcc594112193e99764ab4c6","observation_id":"000ff57d-2b87-4200-8928-eda716400dae","resolution":{"observed_at":"2026-08-06T14:41:57.782628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.764579Z","title":"Minmo: A multimodal large language model for seamless voice interaction,","venue":null,"work_id":"a63d0ec1-7a4f-42e7-84da-888b68d5feae","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.417459Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:c093267a4afab62ea3956771346b379aa920ad1c69d47195b990c4749a744b1f","observation_id":"d6181bd6-0b70-41ca-a7aa-c952f014718c","resolution":{"observed_at":"2026-08-06T14:41:57.768963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.751039Z","title":"Qwen2.5-omni technical report,","venue":null,"work_id":"0807b062-a066-4ece-8c03-e601ab1b660c","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.421720Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:48c49d70f8f481b8cbc3813aabf0f725d8fb20dcc5d5e9b82e9d486d07781e37","observation_id":"9e6aff3e-aff5-4316-b407-9cb0517125a5","resolution":{"observed_at":"2026-08-06T14:41:57.755597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.737541Z","title":"Step-audio: Unified understanding and generation in intelligent speech interaction,","venue":null,"work_id":"c92a6f68-d5fc-4106-b33e-320cfbf3c962","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.426101Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:6c7753c4c49873d2f3596e8820f2bd4649d19cc52ab3e36e095b168261a61ef9","observation_id":"b5cd58e1-1896-4480-91a6-0998d2991aa4","resolution":{"observed_at":"2026-08-06T14:41:57.742003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.722760Z","title":"Step-Audio-AQAA: a fully end-to-end expressive large audio language model,","venue":null,"work_id":"3b279e78-2bd3-4ea2-9f83-2170efc679ee","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.430435Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:7c26ea0e74a4312f3c67dad86e0ba65fc453657d8e385dc3e8879ea879396192","observation_id":"b5606be8-d984-47f7-be92-d774c481c6c4","resolution":{"observed_at":"2026-08-06T14:41:57.727510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.709213Z","title":"Llama-omni2: Llm-based real-time spoken chatbot with autoregressive streaming speech synthesis,","venue":null,"work_id":"55a938d2-9441-4cee-8fbb-1af9eed2a7fa","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.435030Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:cf2953e11e8653a664bbcb3ae1d5d9803ccb408414f0cbf034700f3857f1cdf3","observation_id":"7c8a943b-d78f-4531-92a9-a43779cb87a7","resolution":{"observed_at":"2026-08-06T14:41:57.713857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.694157Z","title":"Deeptalk: Towards seamless and smart speech interaction with adaptive modality-specific moe,","venue":null,"work_id":"46044d68-b64f-4788-81da-ea2e5ec30e67","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.439127Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:e45e19689441ebcf0075451c96bfff452ac94c99a5c6bf65ea00fcceff85843f","observation_id":"f7d4abe7-6ffa-4d74-8890-cef3efe68d10","resolution":{"observed_at":"2026-08-06T14:41:57.698773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.679792Z","title":"BoSS: Beyond-semantic speech,","venue":null,"work_id":"f44121cf-53e3-422a-9b35-3898521a3ed9","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.443222Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:5ce48ad28d01539e4ce406acea0a3d406f91e7087dd75e2155ec16e6218b6f92","observation_id":"16f671c4-e59e-470c-aac9-dc8dc68bbab7","resolution":{"observed_at":"2026-08-06T14:41:57.685148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.665885Z","title":"V oila: V oice-language foundation models for real-time autonomous interaction and voice roleplay,","venue":null,"work_id":"e8823eb4-93d5-498a-9c58-4d3725da9d7e","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.447315Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:3e7b74cd5be3339ea644efac878c35ca60b717d0276d2dc3180f5fa6905a36ce","observation_id":"29a2c081-b8f8-430c-a9cf-a6f7328a828f","resolution":{"observed_at":"2026-08-06T14:41:57.670291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.653213Z","title":"Kimi-audio technical report,","venue":null,"work_id":"e04c06f2-8035-42bd-880c-398f85334da1","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.451156Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:37a304a180486268d3dc025f78d0105101daa8b49aee567165a2538b68736535","observation_id":"9f8af00c-cc09-4c45-bfea-071d41d386b0","resolution":{"observed_at":"2026-08-06T14:41:57.657231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.639108Z","title":"GOAT- TTS: llm-based text-to-speech generation optimized via A dual-branch architecture,","venue":null,"work_id":"5f27eb86-c033-4858-a316-2aa243839879","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.455369Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:13dc7383c61c7913ff53df26be4d41dfda9be4018a60d1e17a82706f9c0c80d1","observation_id":"0243e4ed-6eda-4fc8-b4ab-4ada7e33f86d","resolution":{"observed_at":"2026-08-06T14:41:57.643553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.626186Z","title":"TELEV AL: A dynamic benchmark designed for spoken language models in chinese interactive scenarios,","venue":null,"work_id":"9213b859-d1f4-4bd7-9658-aa6409e1793e","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.459831Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:28b27bad75e88676403e9742a3459ba0f10ba448f9bd48725436f39dc9cec40a","observation_id":"1bb63ac0-1f4d-412c-a07b-5700418282e0","resolution":{"observed_at":"2026-08-06T14:41:57.630056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.612030Z","title":"Qwen2-audio technical report,","venue":null,"work_id":"d0ea4ade-98f3-4f94-b0bf-4a8572c39e32","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.464545Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:80c751dd3e03cb22776edf99603f5595219a089957e88208b9a0b2f6e1ef7695","observation_id":"4b62431f-b158-4d8f-b63a-611371451226","resolution":{"observed_at":"2026-08-06T14:41:57.616374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.596867Z","title":"Baichuan-Audio: A unified framework for end-to-end speech interaction,","venue":null,"work_id":"1b151a8b-fc82-4a8d-9f30-408d0f1323ca","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.468284Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:7b68added753c520b24d2e2a1ac4419369a98dd4a244436e6a47c2fa2a8cfd44","observation_id":"4385ee2b-2e76-42bf-8e1e-6c072eb367d2","resolution":{"observed_at":"2026-08-06T14:41:57.601830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.581770Z","title":"Telechat technical report,","venue":null,"work_id":"917c951c-095a-413d-a293-957dffd4f5aa","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.472468Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:30e169bd9ddd496a61f85544ae781c75a6e0c664947abcd113955c4fe3af8947","observation_id":"b846dc80-2c58-42c1-adda-536d03c04710","resolution":{"observed_at":"2026-08-06T14:41:57.586620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.567496Z","title":"Audiochatllama: Towards general-purpose speech abilities for llms,","venue":null,"work_id":"3f9bb336-1885-49e7-926e-f2104013c763","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.476480Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:306acc31a02d4de75d449bd2e5b7c7073fdc2377a09fed5d028dfd337959547f","observation_id":"a872b40c-1ecb-4efb-8603-fad8c29bbf85","resolution":{"observed_at":"2026-08-06T14:41:57.572007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.551879Z","title":"BLSP: bootstrapping language-speech pre-training via behavior alignment of continuation writing,","venue":null,"work_id":"911d3128-d649-4af7-9977-1f21fc273868","year":2023},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.480339Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:299bf9b52d365c1d9edb0890fe80fa0d359e115565391b81cc8075de977f5d10","observation_id":"f5806a61-abdf-41cb-b52c-e4bb51384651","resolution":{"observed_at":"2026-08-06T14:41:57.557553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.537592Z","title":"Wav2prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based llms,","venue":null,"work_id":"b8c5e5ce-b26e-44c0-89db-30e44b2ed72d","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.484253Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:7c303974c0dddfaada7ac5453beaf2959f03bbe140015506ce55d7557d6d5923","observation_id":"6db03b0e-9444-4583-a2ec-65646a9a624d","resolution":{"observed_at":"2026-08-06T14:41:57.542387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.519737Z","title":"DeSTA2: Developing instruction-following speech language model without speech instruction-tuning data,","venue":null,"work_id":"af657a3f-f27d-4b1a-a19b-3a1131f97a8a","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.488433Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:324ff64feedb3375021c71aaa30232338414c3da86cb2ea0e07e0073bead033e","observation_id":"3bac4abc-912c-46b0-87bb-31a4d20a8f0f","resolution":{"observed_at":"2026-08-06T14:41:57.527293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2507.18119."}