{"as_of":"2026-08-09T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5de2e9e05c9f1d180d84a48abc51623bb23be5832ab3eae0cae93f05145b78d","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T13:49:26.320341Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.10162/citation-record","integrity":"/paper/2607.10162/integrity","json":"/paper/2607.10162/citation-record.json","paper":"/paper/2607.10162"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Hinton, J","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:a9d7af799cc1c1654cc89f37be75c5e167df08e28756161f9ce3e92fd4fe074a","observation_id":"d4ad8f28-c095-4f04-b8f1-a87ebb8ee12d","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Arbitrariness, iconicity, and systematicity in language,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:8c52f5569b4ba536a11b6510271b122fc51187603bad0964a9f14a0dbbedf281","observation_id":"ea23ea1c-046d-4dc9-91ee-59ba075c0f78","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Gestalt psychology,","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:1de2dd9fdaf12f6094739d399b7283890d982e864fba733738af75c4af7a3246","observation_id":"24c4e5e6-701b-48dd-baf7-20da9a597fdf","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Synaesthesia — a window into perception, thought and language,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:30d3a54c61b7e2925458cc4fc3ea0b535c72c9852a5c2cf19f66b1f4ad022eb3","observation_id":"b05155bd-49b4-4da5-8b0d-42e9e70552f6","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"The bouba/kiki effect is robust across cultures and writing systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:b673fed75fa9f2b964b82e7b9b437af82ff9acf596ee84cfcb9e7dc3fac19fd7","observation_id":"49e7b6c4-3f89-4331-b149-472b9a43b8b6","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"An ethological perspective on common cross-language utilization of F0 of voice,","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:37261862b78a10062e3d0c35ad9a275ab1c5c673e77c2180dba4e6fa69cb9111","observation_id":"44b5fb0c-1998-4ad0-87f2-e312123893ef","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"A study in phonetic symbolism","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:5126caf0e800c6b777b7cf3850728ab6247932c627cae9fc637077ecbedd40ec","observation_id":"3a3c1305-f812-45aa-a39f-97bce61a0f67","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Stimulus parameters underlying sound-symbolic mapping of auditory pseudowords to visual shapes,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:ba50c812c4cfac8897d25b7c5fd559b845260892449bec7cc6cbc9e15b27ce94","observation_id":"53679f9b-0341-435c-9d85-5e10be69f937","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Generating images from spoken descriptions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:37d50323369d1c178c565f488223e96c66cd2a5a2bb73d6b77a2c755edb61bf3","observation_id":"9284b4ee-d9a5-435e-b483-75ab603e6bb2","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Audio flamingo 3: Advancing audio intelligence with fully open large audio language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:055aab6e0be8a294ba4aa01cb11eb11e6f355cca48f02e24bda2437c6860dcc5","observation_id":"330d06fb-8ad6-4a1c-9b31-dad7d230f68e","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16632","last_updated":"2025-08-27T16:42:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-22T14:23:55Z","title":"Step-Audio 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16632","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Step-audio 2 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2507.16632","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:5dd61b095aa2023349c5c7ef258928d305c32939bf0555f8335ebd3670e4dbaa","observation_id":"19e5b520-cfc5-473d-bdf0-357c93b9e3f8","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18425","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Kimi-audio technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2504.18425","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:8dbc3a191fb400b7cb53f1789d5fcb48fe2319307523cdbabfecd9e93dec691e","observation_id":"e78b3f3b-1417-4dab-b6db-28d183287566","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27393","last_updated":"2026-04-30T04:05:43Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T04:05:43Z","title":"MiniCPM-o 4.5: Towards Real-Time Full-Duplex Omni-Modal Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27393","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Minicpm-o 4.5: Towards real-time full-duplex omni-modal interaction,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2604.27393","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:3f2466728218725e264e1139541b2b49980802c4e72d217af1be921a5ae595b2","observation_id":"1c2b4b69-95d2-4228-9213-c97a562af010","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Towards holistic evaluation of large audio-language models: A comprehensive survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:8172f84d5abd795f206e1ea18480d5b0c2b1657c3d4976b7f5a70f95eca1789c","observation_id":"728b15a5-efd6-4df4-b3ee-4d487cb07398","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Qwen3-omni technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:b4c8b1db50db076c1bcf62d9a04d5240a3c8591f98a86d351986b85af0dfe822","observation_id":"cf35f339-f23b-4de2-8b54-72fd3e46168b","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Kiki or bouba? sound symbolism in vision-and-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:2fa4b4d58db2bfc4e4bfc0ccf3a98d89488282d85a3e8be20dcf4da1d1f7fda5","observation_id":"9d878fbd-860e-448d-b6f5-bdc8a6e9de33","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17306","last_updated":"2026-05-29T15:14:51Z","snapshot_observed_at":"2026-08-06T00:45:34.127653Z","submitted_at":"2026-03-18T03:02:10Z","title":"Evidence for systematic semantic structure in individual phonemes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.17306","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Evidence for systematic semantic structure in individual phonemes,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2603.17306","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:d9ae1a696480380137125083e931e8c4dcd9d199ec8e20db7d2eefbf2bf5c9a6","observation_id":"44c19af4-6d08-4129-b370-2cdc3f191dd1","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Do language models associate sound with meaning? a multimodal study of sound symbolism,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:09f9c3bd12095cf0c2a5ed0201c9022d4d2b1df08b960d5fd582e606c9588d8e","observation_id":"708952dd-ae48-403e-a3d7-80f38551d262","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Interpreting GPT: the logit lens,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:a54b3187a80457395462b2846dfb296ff9797fb0da4da2d5eea8f8ca727806cd","observation_id":"15bddca5-5765-424f-9ad5-5e806771010d","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Dynamic-SUPERB phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:8e6e0d6e9e330c75fe6f494634b144abfcccbb12df1a41221f12f4da41c25515","observation_id":"e615caba-0faf-47d2-9506-c7f234dcc240","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"V oicebench: Benchmarking llm-based voice assistants,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:93e0d4c6795d64dc769d1337a56168f72ab0576ffacd1ea7949e215cdd6342f6","observation_id":"188bfe4e-ce83-47bd-98e5-3fd22906c0d8","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Speech-IFEval: Evaluating Instruction-Following and Quantifying Catastrophic Forgetting in Speech-Aware Language Mod- els,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:a9f9e51bd57967d3d7ab9f2a787604b9d681e9444ccc5b0b1dab1717cf8ff761","observation_id":"1be920c8-af00-445d-8baf-940642f1f08b","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Listen, think, and understand,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:1a25bb9fb976a7a5f224808df28aa09f0534957f8afdb6762a6e2e63ed8bfaa6","observation_id":"97efa151-e622-4cdb-9e9a-cdf9a6bf7629","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"AudioBench: A universal benchmark for audio large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:bd00759b467e3bdadfa3f104a2172d584d5e71fcefd8d3a0e28217d7e33103c3","observation_id":"ebb7d896-2942-463e-8beb-a967fd89fa26","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19168","last_updated":"2024-10-24T21:20:10Z","snapshot_observed_at":"2026-07-06T19:39:23.839070Z","submitted_at":"2024-10-24T21:20:10Z","title":"MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19168","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Mmau: A massive multi-task audio understanding and reasoning benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2410.19168","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:d48a9d3ba5ca6994e4eaa41e680922efdd58ba0e51e1b7376e29482d58f4f426","observation_id":"fee9c806-61ab-45eb-a2e2-8efeb58c9462","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13992","last_updated":"2025-08-19T16:33:49Z","snapshot_observed_at":"2026-08-05T18:48:28.371759Z","submitted_at":"2025-08-19T16:33:49Z","title":"MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13992","snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Mmau-pro: A challenging and comprehensive benchmark for holistic evaluation of audio general intelligence,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"cited_paper":"/paper/2508.13992","citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:e69f4838e28bd44fa3a730d3a1182ae839905c7681a5009d29280db1ca7875ed","observation_id":"244e041f-d3f7-43e2-9324-10d11def72b9","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Dynamic-superb: To- wards a dynamic, collaborative, and comprehensive instruction-tuning benchmark for speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:b47537d01d53f8ce5158c318b8ce2e60a1b964748be8176d7a8dd390931660a2","observation_id":"4c445c30-67d4-413f-8b9e-540f0884a62c","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Echomind: An interrelated multi-level benchmark for evaluating empathetic speech language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:bb8af18a7307e7169bcfe5b3ddd355836434975e1cb896a6c78486d268448b1c","observation_id":"40f622aa-5701-481e-abc3-f91693bcdd75","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Investigating iconicity in vision-and-language models: A case study of the bouba/kiki effect in japanese models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:a3336ab9fb7771a677f6d1f78bb5171ef68be8834391a8ad75f85c0b79c20ac9","observation_id":"d28fd5df-73db-44e6-827d-83207e4a12c5","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Analyzing the sensibility of visual language models using an evolving image generation system: Focusing on color impressions and sound symbolism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:64a2574ce91c78d112e136d38f76da72fb6723c6727442a3da1c7e7d9da28402","observation_id":"e344a919-f7ea-47c3-83c2-64a33e49840b","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"With ears to see and eyes to hear: Sound symbolism experiments with multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:400a1ccde442b71c5cdf2fa3465885a0f24bad7fc432209b806c20991de2aa69","observation_id":"45103663-8ff8-4cf8-b548-6a7f9c3b6b9f","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Sound to meaning mappings in the bouba-kiki effect,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:6318e0e8070ecb5ccec061cd2cc0da297233d24bd3a7863b011b8e5b4adb9de2","observation_id":"0edc8f61-6baf-4806-9f56-8ee7d53ee07b","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Correlation calculated from faulty data,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:3812b40f31c80d6ae7f8595af1ae534a857bf759d44f4282d1561972896aaeed","observation_id":"badcd851-d7ed-4b55-a9ed-a8403263c138","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Some experimental results in the correlation of mental abilities 1,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:a7b5b13d89282f0800ed4f08c3a0dce12b3599a9f354f475a9c1fe5e4012d40a","observation_id":"648f8780-fa99-4b5c-95c8-5fb738574c4c","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"The detection of disease clustering and a generalized regression approach,","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:fca492d64d32d97be68bbbd05094e03cee003d5a2b77e254bdba3e4836ea9222","observation_id":"40bfaca6-87f8-4d06-97be-30f889627a65","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T13:49:26.320341Z","title":"Gemma 4 model card,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T13:49:26.320341Z"},"links":{"citing_paper":"/paper/2607.10162"},"observation_digest":"sha256:75fb91e06ccc4afd4352f1ece643e572156834c295aa661ed1b09d6f49036253","observation_id":"2cf2aadc-a2c3-434a-84eb-ecf5176d0b54","resolution":{"observed_at":"2026-07-14T13:49:26.320341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10162","last_updated":"2026-07-11T06:55:40Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T12:47:52.657535Z","submitted_at":"2026-07-11T06:55:40Z","title":"Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.10162."}