{"as_of":"2026-08-06T15:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53a019e84994076b73552dd0818aecfe98df00239b980c5746c562c84b5d6a10","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:20:18.125171Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19932/citation-record","integrity":"/paper/2607.19932/integrity","json":"/paper/2607.19932/citation-record.json","paper":"/paper/2607.19932"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.699721Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.699721Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:abfd734890031203bc4361eed4acfc512f20131af560bdf3964414451c17958b","observation_id":"f85d724e-d771-4885-a5d8-b75848b9aad9","resolution":{"observed_at":"2026-08-01T11:20:17.699721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.704724Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.704724Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:d835b12258db707e7462f1440bde4a7097a8bab4b95d86fab2fd07f75f556e1d","observation_id":"7b40e70e-9cc9-4ed9-acbe-52da9e0b4cdc","resolution":{"observed_at":"2026-08-01T11:20:17.704724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00722","last_updated":"2025-05-31T21:43:37Z","snapshot_observed_at":"2026-07-06T21:34:25.021259Z","submitted_at":"2025-05-31T21:43:37Z","title":"Chain-of-Thought Training for Open E2E Spoken Dialogue Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00722","snapshot_observed_at":"2026-08-01T11:20:17.708968Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.708968Z"},"links":{"cited_paper":"/paper/2506.00722","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:e169cbd267e6d1ba1e89f7329dc36295bfc6726af7db2790b8a12a2ad0df6126","observation_id":"73327330-5df7-4140-8d91-b147b4471cc2","resolution":{"observed_at":"2026-08-01T11:20:17.708968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.713632Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.713632Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:a0f31a7dc652067c39019b745161946f26b63cd9ec6be09bd617c67d5a0af9d0","observation_id":"609f5283-7135-45e4-95ad-7f88c05eb476","resolution":{"observed_at":"2026-08-01T11:20:17.713632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00294","last_updated":"2025-03-31T23:40:28Z","snapshot_observed_at":"2026-08-04T13:19:45.872454Z","submitted_at":"2025-03-31T23:40:28Z","title":"Inference-Time Scaling for Complex Tasks: Where We Stand and What Lies Ahead","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00294","snapshot_observed_at":"2026-08-01T11:20:17.717723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.717723Z"},"links":{"cited_paper":"/paper/2504.00294","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7567af417d7bceacb8f7492f5ef90c49be1ca01f53e0405f2aefc079d85a9183","observation_id":"5b23901b-0d37-4ce5-af49-14d651334862","resolution":{"observed_at":"2026-08-01T11:20:17.717723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.722174Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.722174Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:dec2329ab1f8fe36894e70c5947669bcbc29c2a57733defaad883ac90f0b8e24","observation_id":"337d8b71-c77d-4aa2-b1a0-a06466012e3d","resolution":{"observed_at":"2026-08-01T11:20:17.722174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11582","last_updated":"2025-08-15T16:40:29Z","snapshot_observed_at":"2026-08-05T19:50:27.648205Z","submitted_at":"2025-08-15T16:40:29Z","title":"Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Extreme Reasoning Efficiency in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11582","snapshot_observed_at":"2026-08-01T11:20:17.726641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.726641Z"},"links":{"cited_paper":"/paper/2508.11582","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:0a7f63977d8b19ee0518c61b9014bef2ee183a125fca60b8e15cedc514775ebb","observation_id":"b6612b61-9b7e-470d-8795-924ad5305684","resolution":{"observed_at":"2026-08-01T11:20:17.726641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.730649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.730649Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:8c0688c87062d9396fbdf3e267af6ecc1c247da6871ae32a5d5dcd4c6bcef8e1","observation_id":"e4c55fa7-7033-48ce-9884-d39fd3896ba5","resolution":{"observed_at":"2026-08-01T11:20:17.730649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.734424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.734424Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:8d8ba254a2ae3b338feb1cdc6e042a78d198e10eac0489d884a2b38e1ff2800f","observation_id":"c8bad0e2-3d31-4971-bf46-a3bf4da2102f","resolution":{"observed_at":"2026-08-01T11:20:17.734424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.738152Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.738152Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:5ac819b08f40fde6011da1226a6d5473f8aab10b98d5f691a34d3cb92c92c921","observation_id":"062e5fd6-ff9a-42ce-bec3-51629b1b8693","resolution":{"observed_at":"2026-08-01T11:20:17.738152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.741844Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.741844Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:647210efac90a94474053511773eac4d707a5c9318460ebe4b9a97237a8e61df","observation_id":"d79e6bfe-823c-4068-9df4-f3db79378b14","resolution":{"observed_at":"2026-08-01T11:20:17.741844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-01T11:20:17.745465Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.745465Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:dc53b4d0777cd8a327147c295defc8f66449ec2e5af2fd30e1b4254f999c053a","observation_id":"aef75a80-9bb7-4e41-9da9-517588c5b860","resolution":{"observed_at":"2026-08-01T11:20:17.745465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-01T11:20:17.749282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.749282Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:024185dc36b121f681ebba7c9558a04d44b900cfa03f8db8c040339b6c257223","observation_id":"8355c74e-ba57-4fbc-a877-c44e5d9667dd","resolution":{"observed_at":"2026-08-01T11:20:17.749282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14838","last_updated":"2024-05-23T17:54:14Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:54:14Z","title":"From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14838","snapshot_observed_at":"2026-08-01T11:20:17.753453Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.753453Z"},"links":{"cited_paper":"/paper/2405.14838","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:80ae06a5fe879fac5238ecd15521e0e1214a62fef8ca36136e897d7d8b2ef6a7","observation_id":"c3e4eceb-35d6-4ea0-a106-a17d758cb997","resolution":{"observed_at":"2026-08-01T11:20:17.753453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01460","last_updated":"2023-11-02T17:59:49Z","snapshot_observed_at":"2026-08-05T13:45:13.159592Z","submitted_at":"2023-11-02T17:59:49Z","title":"Implicit Chain of Thought Reasoning via Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01460","snapshot_observed_at":"2026-08-01T11:20:17.757395Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.757395Z"},"links":{"cited_paper":"/paper/2311.01460","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:b918b10520a169d35a2653d7ac37580229ac651b9f18ef754857c3266924f14e","observation_id":"40da951e-5382-4b7c-b1c5-8050455c6abe","resolution":{"observed_at":"2026-08-01T11:20:17.757395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18425","snapshot_observed_at":"2026-08-01T11:20:17.761339Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.761339Z"},"links":{"cited_paper":"/paper/2504.18425","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:dbf778d3763fea158ebdca8178e844bb50b9aade0ddca058f09ec14ea8f68da3","observation_id":"dee3f02f-2b39-4bb3-b38b-331a91c7629f","resolution":{"observed_at":"2026-08-01T11:20:17.761339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19510","last_updated":"2025-06-16T09:05:04Z","snapshot_observed_at":"2026-08-04T12:52:02.920184Z","submitted_at":"2024-09-29T01:48:09Z","title":"Making LLMs Better Many-to-Many Speech-to-Text Translators with Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19510","snapshot_observed_at":"2026-08-01T11:20:17.765161Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.765161Z"},"links":{"cited_paper":"/paper/2409.19510","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:bed2a11bbda4fa07bff0d132f5d84fc5dbcd642f7165419207b59eba1d6df80e","observation_id":"44d27210-c6fb-40d2-94ef-e1bca2f9806b","resolution":{"observed_at":"2026-08-01T11:20:17.765161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-07-06T21:29:06.781083Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-08-01T11:20:17.769566Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.769566Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7def931966b8581cc7dc4a644eda303c314ea2ae7eb35725159931ca6f9868a7","observation_id":"be66fa53-10cf-4a96-a479-0ac9e1e22c1f","resolution":{"observed_at":"2026-08-01T11:20:17.769566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.773376Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.773376Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:c2716ee385999f70025fa5e6e2775214835e6f86c4f1fe530d060cc5005e00f5","observation_id":"69329906-d41f-4a5f-b7f8-d0f23140e329","resolution":{"observed_at":"2026-08-01T11:20:17.773376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08940","last_updated":"2025-08-12T13:48:03Z","snapshot_observed_at":"2026-08-05T21:17:08.639030Z","submitted_at":"2025-08-12T13:48:03Z","title":"Train Long, Think Short: Curriculum Learning for Efficient Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.08940","snapshot_observed_at":"2026-08-01T11:20:17.777028Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.777028Z"},"links":{"cited_paper":"/paper/2508.08940","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:c99360bf88e9d72e8d1413f6e200abd715d075da301583b6b62a3230da4432e4","observation_id":"9d1cc011-f5b9-4d79-bdb5-6178ba39f90e","resolution":{"observed_at":"2026-08-01T11:20:17.777028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.780879Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.780879Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:45f4b2e210741bf8a42483df7d7a4e5da1ee2fde2c2761bdd092dcc75d1ccc51","observation_id":"ad03b6c2-bed2-4f48-a1e7-dbc1195708f7","resolution":{"observed_at":"2026-08-01T11:20:17.780879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-01T11:20:17.784433Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.784433Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:87c809410b78cf425fe68b39924369311ef5cc93e9323bc8a71b7dbfbcd072e2","observation_id":"247123b2-f55f-477d-a4bd-62e2be38371e","resolution":{"observed_at":"2026-08-01T11:20:17.784433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.788209Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.788209Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:fa8355902798b6ef72493c65cbd03d52faae40fa07549104e593ca5b794c3547","observation_id":"d8799a3e-05f0-4b0f-88be-671d87a9b78a","resolution":{"observed_at":"2026-08-01T11:20:17.788209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.791736Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.791736Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:1af909ef2730c9f3a87462e95691fcd4253f8eee36e0bb2f724bff6e0c8ce0c1","observation_id":"7b43a3ed-b311-48f1-b2f9-f8e0fb12c97a","resolution":{"observed_at":"2026-08-01T11:20:17.791736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.795442Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.795442Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:12ef9c8511fb54615ff0bb16ca3269c6ea3b119bd2eabca5bb4ce9070e61b164","observation_id":"67894774-56f3-412e-824c-af36bb5e08c6","resolution":{"observed_at":"2026-08-01T11:20:17.795442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.799734Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.799734Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:95257513c46490e05380fedc32528f7d77512897aecaf28d5128f1faec1686aa","observation_id":"95ee0718-0507-4dd7-8f70-8624ff686d4a","resolution":{"observed_at":"2026-08-01T11:20:17.799734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.803330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.803330Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:5939ce3d3447896ec6da41bc1647d79f192237de254b4725855292299b14181f","observation_id":"a31a5dda-33d0-4eb1-85eb-4b22d64e66cf","resolution":{"observed_at":"2026-08-01T11:20:17.803330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11116","last_updated":"2025-06-09T06:37:15Z","snapshot_observed_at":"2026-07-06T21:41:19.199391Z","submitted_at":"2025-06-09T06:37:15Z","title":"Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11116","snapshot_observed_at":"2026-08-01T11:20:17.807063Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.807063Z"},"links":{"cited_paper":"/paper/2506.11116","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:1257fc6530c10efb81c122c15be2cff78d34922087c88c7ce8b7405a2aef050a","observation_id":"63061890-88cd-4a2b-8c23-44ea5a9c7964","resolution":{"observed_at":"2026-08-01T11:20:17.807063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02350","last_updated":"2025-09-02T14:16:02Z","snapshot_observed_at":"2026-08-05T11:39:34.180867Z","submitted_at":"2025-09-02T14:16:02Z","title":"Implicit Reasoning in Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02350","snapshot_observed_at":"2026-08-01T11:20:17.811223Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.811223Z"},"links":{"cited_paper":"/paper/2509.02350","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:cf8a8a3614d71e3960fd82fa7ed365808645b430eefe07106c03bbd1d076712b","observation_id":"f4a04d3f-1bdd-42a6-bfbc-68b7393264cc","resolution":{"observed_at":"2026-08-01T11:20:17.811223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.814767Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.814767Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:a543384b6f44235bcccdca4006b372be9ce07302544b92ee9bb9e5ab0e227c21","observation_id":"205fc0e3-b4b6-4898-bd70-908485b8d5a2","resolution":{"observed_at":"2026-08-01T11:20:17.814767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17239","last_updated":"2025-02-24T15:16:34Z","snapshot_observed_at":"2026-07-06T20:41:42.199592Z","submitted_at":"2025-02-24T15:16:34Z","title":"Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17239","snapshot_observed_at":"2026-08-01T11:20:17.818345Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.818345Z"},"links":{"cited_paper":"/paper/2502.17239","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:53f6e3c81cd59bc6afd7a10623dc7148e222016f006a14e1182a2f0f177231b1","observation_id":"f7baa26c-ec12-481b-9480-c87ea1f3954c","resolution":{"observed_at":"2026-08-01T11:20:17.818345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.822556Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.822556Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f66671479f329890eb84813395963f38845e8d07f7b7ad2d737beeb3ad9e9763","observation_id":"672a90a5-6d7f-4304-8632-16db2ab01390","resolution":{"observed_at":"2026-08-01T11:20:17.822556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.826351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.826351Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:919da4e62d7be0dff79e4a82d4e060c6bb9d99db660c739d9fa7c3a89cf59203","observation_id":"71a77e20-ce96-4989-85ae-466fcd0bdc1c","resolution":{"observed_at":"2026-08-01T11:20:17.826351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.830758Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.830758Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:88e08bde9cd4983c88c92c2113002af3884bbd1a5ff215adce4f705f9616ae55","observation_id":"a7a862d1-a895-4974-ad56-dc85b21a831e","resolution":{"observed_at":"2026-08-01T11:20:17.830758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.834654Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.834654Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:44cfd4344377de9cd2b81dfd25515f5e33421cfa70cf53543270d9446ac49ddf","observation_id":"a0dcf448-7020-46f9-9b29-5194ee5404a6","resolution":{"observed_at":"2026-08-01T11:20:17.834654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07246","last_updated":"2025-01-13T11:54:40Z","snapshot_observed_at":"2026-08-01T10:25:58.860404Z","submitted_at":"2025-01-13T11:54:40Z","title":"Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07246","snapshot_observed_at":"2026-08-01T11:20:17.838169Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.838169Z"},"links":{"cited_paper":"/paper/2501.07246","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:97e0c4895c1812849b6d407f4a2a4e5596ff9c91aa902a30946de429c9eee4af","observation_id":"f3641d3d-397c-4875-ac20-768f76134745","resolution":{"observed_at":"2026-08-01T11:20:17.838169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.842069Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.842069Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:4960e2b071e64bec425a6f37b70f2195e45c1419179726ee303c59cf4ec4e26d","observation_id":"8f53efd3-fe12-47e0-b91b-3d363cb28299","resolution":{"observed_at":"2026-08-01T11:20:17.842069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-01T11:20:17.845680Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.845680Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7b6ba4dc53182e4f7228151ba4f7e1cab741519d9da326db9df701d02deee04f","observation_id":"bee2084b-cdfb-4f8b-9679-bb172797f891","resolution":{"observed_at":"2026-08-01T11:20:17.845680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.849479Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.849479Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:e8789ff2d2d1b4eadcc5543a91483eaf46a3d4c43b4c73fc2902f537b03b67c7","observation_id":"fad52c77-7a03-4094-b085-36d5eb9853ff","resolution":{"observed_at":"2026-08-01T11:20:17.849479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.853551Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.853551Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:1624375dbbe7ec20ce9fb07b1ce11c6fae761bc43082d608ff756257ee06db09","observation_id":"c3f9e283-0afc-4de2-8c20-763afd04685f","resolution":{"observed_at":"2026-08-01T11:20:17.853551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.857291Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.857291Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:0a89699ef3d5749c3d862bfe3622cab455eb9ac316ac13acd1a2a494ce4160ff","observation_id":"d29b3810-4d54-4eb4-883b-79db6ad56fd8","resolution":{"observed_at":"2026-08-01T11:20:17.857291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.973241Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.973241Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:78b0673dfe0a41bb05f1359f17a08295af4bca8ef64a38f04b56349e35d188a1","observation_id":"e37d8263-fe02-46f0-9be0-d7cfa2806eed","resolution":{"observed_at":"2026-08-01T11:20:17.973241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05433","last_updated":"2026-07-03T04:38:21Z","snapshot_observed_at":"2026-07-15T14:32:24.776402Z","submitted_at":"2026-03-05T17:54:40Z","title":"CRISP: Compressed Reasoning via Iterative Self-Policy Distillation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05433","snapshot_observed_at":"2026-08-01T11:20:17.977479Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.977479Z"},"links":{"cited_paper":"/paper/2603.05433","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7adace57474c1419b28e811dc384f04836045604877dc69a4a22b9652cf1e52a","observation_id":"b7186b00-590a-4149-960e-ee926d82dba0","resolution":{"observed_at":"2026-08-01T11:20:17.977479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19201","last_updated":"2026-05-04T05:23:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-31T15:10:29Z","title":"Efficient Reasoning with Hidden Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19201","snapshot_observed_at":"2026-08-01T11:20:17.981573Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.981573Z"},"links":{"cited_paper":"/paper/2501.19201","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:552efda7375294551a1a10029c6a0cac335b2ad697912838794c37abbcd2909c","observation_id":"f0eb650f-c81e-4d22-bc47-f0ee4d48356b","resolution":{"observed_at":"2026-08-01T11:20:17.981573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.986072Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.986072Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:671e032351413d6d913bebdd6de3354650b59fa725d52567e7a3079534bf059b","observation_id":"3381d84a-b8db-4fe4-ab0a-dafc3ea498be","resolution":{"observed_at":"2026-08-01T11:20:17.986072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:17.989726Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.989726Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:be84be447eda104a93ca1e324f5593e6fd6c7ddfaee27a4221dc52fba6bd7fb2","observation_id":"d17cc328-3dc5-448a-a230-e0f1745649f5","resolution":{"observed_at":"2026-08-01T11:20:17.989726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-03T03:23:56.857266Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-01T11:20:17.993227Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.993227Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:71c7552d5ace7e3f63a008d19cf42f31b7f7abc5500ac8a2c2fa4e8edea4015b","observation_id":"b8777640-2dd7-40fa-9bc3-73c8604ca149","resolution":{"observed_at":"2026-08-01T11:20:17.993227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10676","last_updated":"2025-02-25T15:42:31Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T16:18:29Z","title":"Both Ears Wide Open: Towards Language-Driven Spatial Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10676","snapshot_observed_at":"2026-08-01T11:20:17.997004Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.997004Z"},"links":{"cited_paper":"/paper/2410.10676","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:2aabb8beb470d02dcd2e23b670890b8b704dc62cd758c3a636b78394b845beba","observation_id":"aa741522-7280-4e57-a108-c61ee2375d0e","resolution":{"observed_at":"2026-08-01T11:20:17.997004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.000958Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.000958Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f1046038aa4dc1b8981bd4879251f7bd55d0b34092e11a3f1f6b494252bbfe03","observation_id":"02a024f7-b995-4524-adfb-c351d3c81458","resolution":{"observed_at":"2026-08-01T11:20:18.000958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.004932Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.004932Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:c0501015016670ba14c281c9973b3311c06dba270161f5aa5e52a5397f17e582","observation_id":"955ae5d3-a9c4-4027-a488-a3a08637fa64","resolution":{"observed_at":"2026-08-01T11:20:18.004932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.012657Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.012657Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:0c69b6e379e126e6ccad8b3ceafe77100f4afa4fccb46642aae932f19ee2055d","observation_id":"012a7b1d-6269-46f5-bdf5-4565d7a1dceb","resolution":{"observed_at":"2026-08-01T11:20:18.012657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.016660Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.016660Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:1966bc0ae9102da6eb8c245be4926ba8f3ac31db3d6c3f8621ac2188390880fe","observation_id":"61bdfd83-98fb-470a-aa06-09e0732eaac2","resolution":{"observed_at":"2026-08-01T11:20:18.016660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.020363Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.020363Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f6ab36cc0f704ef97986f2b1cb252ca10ae1053474be444c73e3e0d5538f9b46","observation_id":"01c2d3f7-71f8-4133-8e03-20ff8c384270","resolution":{"observed_at":"2026-08-01T11:20:18.020363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05543","last_updated":"2026-04-20T10:33:45Z","snapshot_observed_at":"2026-07-31T08:03:40.121303Z","submitted_at":"2026-01-09T05:51:56Z","title":"Closing the Modality Reasoning Gap for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05543","snapshot_observed_at":"2026-08-01T11:20:18.024195Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.024195Z"},"links":{"cited_paper":"/paper/2601.05543","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:143d1da00494ad10db95f2aaacab0f5156281ff51da90432d8c1fbb84d55af6c","observation_id":"dc81d3ee-9b01-4182-ab49-a142b535d4b7","resolution":{"observed_at":"2026-08-01T11:20:18.024195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-01T11:20:18.028160Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.028160Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:075cb3703da752c23193887a913e1b18c0d21f0a4b5470ad22dbe61b81ecd077","observation_id":"0923a3cc-e114-4438-a7fa-dd0c54d76178","resolution":{"observed_at":"2026-08-01T11:20:18.028160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-07-06T21:27:27.363146Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-08-01T11:20:18.032456Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.032456Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:9aa2d2636378045057e2704db25a6671c536ec7bb901608239a298169be4c75b","observation_id":"57d2b1d6-7214-482b-80b6-266c8d138531","resolution":{"observed_at":"2026-08-01T11:20:18.032456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09592","last_updated":"2026-05-10T15:21:35Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-10T17:50:59Z","title":"Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.09592","snapshot_observed_at":"2026-08-01T11:20:18.036424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.036424Z"},"links":{"cited_paper":"/paper/2510.09592","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:a2e70436636490064ec43716a7b3a774ec637004b30c2f096062429edd0dd54f","observation_id":"cc6f4436-37dc-40da-9d11-197d99f3670e","resolution":{"observed_at":"2026-08-01T11:20:18.036424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.040243Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.040243Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:9e22aef74a86387c42a508be191cd5f721a37ef877e6095572b78d4f9505b32e","observation_id":"1f4bf8bb-276b-4103-b7ea-c32fef3aa11c","resolution":{"observed_at":"2026-08-01T11:20:18.040243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.043837Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.043837Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:ccdc1d6b5056c7691fd8e229b22c62662e2623f1ccd0f42e03569229dbea12de","observation_id":"a954e56f-8aff-4616-8bbb-f5938216d717","resolution":{"observed_at":"2026-08-01T11:20:18.043837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.051483Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.051483Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:2356f264011455a67acb793eff183a0841885f52dd2dd74938d5b8845eafbe5b","observation_id":"51b091f1-5f69-4e50-8a87-2d04b7aa750a","resolution":{"observed_at":"2026-08-01T11:20:18.051483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.047674Z","title":"InICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.047674Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:1026c39583962f276194a790c618cc8620f43fc5f63de12afb495eb891b37c9c","observation_id":"32290aa9-df9e-492a-99f9-80879431e98e","resolution":{"observed_at":"2026-08-01T11:20:18.047674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16725","last_updated":"2024-11-05T02:24:18Z","snapshot_observed_at":"2026-07-06T19:07:46.545514Z","submitted_at":"2024-08-29T17:18:53Z","title":"Mini-Omni: Language Models Can Hear, Talk While Thinking in Streaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16725","snapshot_observed_at":"2026-08-01T11:20:18.059150Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.059150Z"},"links":{"cited_paper":"/paper/2408.16725","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:82404083c03307415f44807f0010750708a40d05968e727ebe09b9434b8501c1","observation_id":"1dec2098-bac7-4438-8214-ed401eb814c8","resolution":{"observed_at":"2026-08-01T11:20:18.059150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.055208Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.055208Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:217de04cfd03aa9827a00e07c729be3f42f531f10435fb3a1afaa98b46ddb00b","observation_id":"1a0b6d92-29cb-4c50-96b4-87ad5aebe299","resolution":{"observed_at":"2026-08-01T11:20:18.055208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-06T08:00:07.411397Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-01T11:20:18.067569Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.067569Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:91516ccaa8585b03f1f0641c65c8938d553a0ef34f61e5dada4e26b9d4b9e06c","observation_id":"299de0ed-5e7f-47d9-b0fb-cafde6b6ac16","resolution":{"observed_at":"2026-08-01T11:20:18.067569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-01T11:20:18.063509Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.063509Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:b82505bcb7b0695c5bdad4e149ea3a77ddb90428dcedcd7ac4e666700b00fa4b","observation_id":"d0fc4782-2cdf-4a4b-83b6-db7326a94694","resolution":{"observed_at":"2026-08-01T11:20:18.063509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.075204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.075204Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:913dc776f0eb5c458f7461b1ca71ec66f1381e9003b2ae7d8c0f29e5d670d5a1","observation_id":"67d25d54-81ba-4467-b7fe-70d1ef895d45","resolution":{"observed_at":"2026-08-01T11:20:18.075204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-01T11:20:18.071332Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.071332Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:73f911792384653bd48bb474e1d579b2749d6decc3e11b6c8db719838cdf5dfa","observation_id":"85ac43bd-870e-4116-8a31-42a56e77b373","resolution":{"observed_at":"2026-08-01T11:20:18.071332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-01T11:20:18.083441Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.083441Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:653a1535de4366966d2909905bc322f7057f49577e31c91a6a169b27724917e1","observation_id":"a3cc2f2a-5b7d-4485-af04-926caffb1af6","resolution":{"observed_at":"2026-08-01T11:20:18.083441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17810","last_updated":"2025-08-10T12:34:42Z","snapshot_observed_at":"2026-07-06T20:42:05.476907Z","submitted_at":"2025-02-25T03:31:48Z","title":"URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17810","snapshot_observed_at":"2026-08-01T11:20:18.079021Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.079021Z"},"links":{"cited_paper":"/paper/2502.17810","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f6e49b9a9ec039085e72c5dfcf7b58931ebc5712180eac6f45617b5565c4272c","observation_id":"533cc13a-9506-4390-bb4e-c9a1d0468fef","resolution":{"observed_at":"2026-08-01T11:20:18.079021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02612","last_updated":"2024-12-03T17:41:24Z","snapshot_observed_at":"2026-08-02T21:27:26.884251Z","submitted_at":"2024-12-03T17:41:24Z","title":"GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02612","snapshot_observed_at":"2026-08-01T11:20:18.091728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.091728Z"},"links":{"cited_paper":"/paper/2412.02612","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:0c7b19874afab091435ee26ccc7904ebb662f1676c336a206aad4b16d7f8cc75","observation_id":"99fb2f1a-4f93-43a9-8bd2-85cdf477a05a","resolution":{"observed_at":"2026-08-01T11:20:18.091728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18138","last_updated":"2024-11-27T08:38:57Z","snapshot_observed_at":"2026-07-06T19:57:51.125083Z","submitted_at":"2024-11-27T08:38:57Z","title":"SALMONN-omni: A Codec-free LLM for Full-duplex Speech Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18138","snapshot_observed_at":"2026-08-01T11:20:18.087637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.087637Z"},"links":{"cited_paper":"/paper/2411.18138","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:c927694c2ba78739e97c71ce98a9a437522cdaf737b2c237cdcccdf0b28dde97","observation_id":"a1755e35-933f-4f40-8696-357759bbadf0","resolution":{"observed_at":"2026-08-01T11:20:18.087637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.100000Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.100000Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f580fa415e45ebd6b554293f4beccf08ce4e432e8599d3ec7c8e29af92055cd2","observation_id":"830fc9fa-4f46-4c81-8418-60639b053042","resolution":{"observed_at":"2026-08-01T11:20:18.100000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.095897Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.095897Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:e15ad552fd9886b138b8f5797a7868c734b1c110fb921027196b4d47a783cfed","observation_id":"b45f3cb6-689c-4426-b177-ad3685f05a4b","resolution":{"observed_at":"2026-08-01T11:20:18.095897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15778","last_updated":"2025-05-21T17:29:15Z","snapshot_observed_at":"2026-07-06T21:27:56.777489Z","submitted_at":"2025-05-21T17:29:15Z","title":"Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15778","snapshot_observed_at":"2026-08-01T11:20:18.112161Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.112161Z"},"links":{"cited_paper":"/paper/2505.15778","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:3b78f0e0523a9c6cc0033a5f2876f79524ee75cc88ce1632dfe845fe87170088","observation_id":"b71fc428-2d33-4df4-9e5e-96ab8974a900","resolution":{"observed_at":"2026-08-01T11:20:18.112161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.104064Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.104064Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:f826984121483b3ea962dec5654703e7af83174b936ec819a8fa80f04dc2ecfd","observation_id":"2954ebdf-800f-47e6-a586-0a65bc75f451","resolution":{"observed_at":"2026-08-01T11:20:18.104064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.121002Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.121002Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:acd1a5bdcbd8a6b7f8a78ed1e46fded105effc9f6deb9bbe6cec9edcf6bd8b1f","observation_id":"a6bdca76-a6db-4923-835f-64fd9e40a161","resolution":{"observed_at":"2026-08-01T11:20:18.121002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.125171Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.125171Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:4d02383db32e912b111ee67a07e0748a59fb823e511c8329928b806336119d53","observation_id":"ecdc9cec-40a3-4794-9a67-fa91debfbe34","resolution":{"observed_at":"2026-08-01T11:20:18.125171Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.116172Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.116172Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:cba10107fd95df019815f0fba55f2c07362fa69f30601d5bb7deb0b2d5d8d2a9","observation_id":"e27bf06a-99b6-48e5-88c5-e770807904ca","resolution":{"observed_at":"2026-08-01T11:20:18.116172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13527","last_updated":"2024-01-25T17:24:52Z","snapshot_observed_at":"2026-07-06T17:19:56.099931Z","submitted_at":"2024-01-24T15:25:01Z","title":"SpeechGPT-Gen: Scaling Chain-of-Information Speech Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13527","snapshot_observed_at":"2026-08-01T11:20:18.108095Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.108095Z"},"links":{"cited_paper":"/paper/2401.13527","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:7c8903cd1c59a3215a27363de4b65f3b29822cfb87e02c6419e140fe6d0c9bf9","observation_id":"e300a67e-7734-45ff-9d10-621397311743","resolution":{"observed_at":"2026-08-01T11:20:18.108095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:20:18.008855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.008855Z"},"links":{"citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:3c90fe19ae68e5279f8b27d665e1c4f4f4d56464cdf062b9fe5a120a7d887bf7","observation_id":"3e533973-a397-41e9-96c5-f085657e6045","resolution":{"observed_at":"2026-08-01T11:20:18.008855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T16:45:17.309419Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2607.19932."}