{"as_of":"2026-08-08T20:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f180cd833d06efa70a35d13486193aaab123fe5162015d4aa267701e4580dfd4","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:11.225870Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:20:18.032456Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T02:09:24.101764Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2510.09592","last_updated":"2026-05-10T15:21:35Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-10T17:50:59Z","title":"Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T07:43:23.913399Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2510.09592"},"observation_digest":"sha256:b7bd979eff8aed989eabc564af9b56d63da500f82ad2a982647c3a0fbe12f076","observation_id":"5a02317f-104d-4e39-a2a5-766b072b0843","resolution":{"observed_at":"2026-05-18T07:46:03.523212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2604.25719","last_updated":"2026-05-31T23:35:54Z","snapshot_observed_at":"2026-08-03T00:45:36.849248Z","submitted_at":"2026-04-28T14:44:30Z","title":"Step-Audio-R1.5 Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T14:12:56.278256Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2604.25719"},"observation_digest":"sha256:422b437c0122f0ec541a231fba4adf9b8682d5dea2b79f40c8c7f4473c00cf75","observation_id":"1597cf4d-188a-4f55-802e-283e695a2adc","resolution":{"observed_at":"2026-05-12T00:46:13.579952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2605.21008","last_updated":"2026-05-20T10:44:56Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T10:44:56Z","title":"A Survey of Audio Reasoning in Multimodal Foundation Models","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-21T02:08:06.976461Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2605.21008"},"observation_digest":"sha256:801e03f3636ce89337fe471d97022a5fd1716bf62e3ae1a8144401ce47c1ba38","observation_id":"e831c21e-5c89-43e9-a2b8-e51abbb0ae8b","resolution":{"observed_at":"2026-05-21T02:09:24.104663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-08-01T11:20:18.032456Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-07T17:53:01.414682Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.032456Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:3295710a62ff655c6385b14056cc6d36cb32aaae6959613bfbd1ac0e0e788094","observation_id":"57d2b1d6-7214-482b-80b6-266c8d138531","resolution":{"observed_at":"2026-08-01T11:20:18.032456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15000/citation-record","integrity":"/paper/2505.15000/integrity","json":"/paper/2505.15000/citation-record.json","paper":"/paper/2505.15000"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.383707Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.383707Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:1aac7857eba487be71391e7715f1f18819ddb91387da6a9320835fe76c607157","observation_id":"85c6914a-5e75-49ce-8570-921a040a7767","resolution":{"observed_at":"2026-08-07T15:29:05.383707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.492840Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.492840Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:5fe4c93f8393ac1f9c05c64793b1a440fc82dcee10549919933be897d9daf97f","observation_id":"75dc0901-1399-48a2-81e0-7de589607136","resolution":{"observed_at":"2026-08-07T15:29:05.492840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-07T15:29:05.603798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.603798Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:ffb8fa711942fa9c0598ee1e9d31079ede45aaa85e3fa2dde593e8b59ba13190","observation_id":"266e389a-678d-4477-8ce9-a6f32b368a9a","resolution":{"observed_at":"2026-08-07T15:29:05.603798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-06T00:42:36.144034Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-07T15:29:05.746864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.746864Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:7e84f8619f326ba536ea6ebcc1c94f8f1a79af45a4925b14641044f0cef5e722","observation_id":"a291c044-2852-4cb3-b259-d15d1708d90b","resolution":{"observed_at":"2026-08-07T15:29:05.746864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T15:29:05.891772Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.891772Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:e2dc7305a0db62aad0095f73f4192362ae51c640f6655ae56ca7611e767f7185","observation_id":"e6c5dcdc-367a-46f6-a876-48e8e644b503","resolution":{"observed_at":"2026-08-07T15:29:05.891772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T15:29:05.982526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.982526Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:a8e8111c2a0fa99fbe820293982958f336cf301e14e5f9fe0e5218bba72c06aa","observation_id":"c528cbb1-192e-42ed-9ea7-6f26663486f2","resolution":{"observed_at":"2026-08-07T15:29:05.982526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:29:06.046164Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.046164Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6964120bdb4457b49b5f9583cc229321694aacc27617cf623bef48c9982c2f86","observation_id":"c9620cbb-0b11-4707-b5cd-91bcd36fbc23","resolution":{"observed_at":"2026-08-07T15:29:06.046164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04962","last_updated":"2025-05-27T16:14:30Z","snapshot_observed_at":"2026-08-04T13:52:59.504745Z","submitted_at":"2025-01-09T04:30:12Z","title":"VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04962","snapshot_observed_at":"2026-08-07T15:29:06.156425Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.156425Z"},"links":{"cited_paper":"/paper/2501.04962","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:166fce852fed3d9c2566ccb4e5a96746162dab6023d46654beb41bf6225a15c1","observation_id":"3664a2fe-b193-4ef5-afd8-b995ec8f5b92","resolution":{"observed_at":"2026-08-07T15:29:06.156425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03751","last_updated":"2025-08-07T13:29:43Z","snapshot_observed_at":"2026-08-08T14:59:40.686276Z","submitted_at":"2024-10-01T21:48:12Z","title":"Recent Advances in Speech Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03751","snapshot_observed_at":"2026-08-07T15:29:06.241559Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.241559Z"},"links":{"cited_paper":"/paper/2410.03751","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:54676cf755973cf537f31c96b90ab9caf7f57ca63ab7ac1c178073d0ca6485e5","observation_id":"776258d4-e59f-4fe8-a55e-cb813b7dfa3a","resolution":{"observed_at":"2026-08-07T15:29:06.241559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11768","last_updated":"2024-06-17T17:31:01Z","snapshot_observed_at":"2026-08-01T20:00:05.737836Z","submitted_at":"2024-06-17T17:31:01Z","title":"GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11768","snapshot_observed_at":"2026-08-07T15:29:06.347770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.347770Z"},"links":{"cited_paper":"/paper/2406.11768","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:bdf3466874fac048050b654818960c8ec0a537437d234c72f1831568e9494e47","observation_id":"be7bd3bd-d8fd-4713-8ca7-15a84fd921ec","resolution":{"observed_at":"2026-08-07T15:29:06.347770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.511131Z","title":null,"venue":null,"work_id":"a2341e73-3e94-47e0-8c11-c8569998d61a","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.447238Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:e73e5e7bb034a9287053cd070460ba53e11829ac0cd83aed34f9a443a628777c","observation_id":"b6743a7c-d15e-47ab-850a-7e2686a526c5","resolution":{"observed_at":"2026-08-07T15:29:14.642682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:29:06.506922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.506922Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:3890db3bd9eaaf6db591f39709adba36072b650d0ad3dec2956f5bbb0602ea27","observation_id":"410a78f5-e00f-4e21-aee0-e7cd25e3da7c","resolution":{"observed_at":"2026-08-07T15:29:06.506922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.661963Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.661963Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d6277e682d0dfd3ba592a23c00eb624c075240035d43686da5ec6d348c69fa43","observation_id":"042367db-bc70-4ca2-9105-b29867ac3b75","resolution":{"observed_at":"2026-08-07T15:29:06.661963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11567","last_updated":"2023-12-04T20:55:53Z","snapshot_observed_at":"2026-08-08T09:19:39.749246Z","submitted_at":"2023-11-20T07:06:31Z","title":"InfiMM-Eval: Complex Open-Ended Reasoning Evaluation For Multi-Modal Large Language Models","version":3},"cited_work":{"arxiv_id":"2311.11567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.11567","snapshot_observed_at":"2026-08-07T15:29:12.054919Z","title":"InfiMM-Eval: Complex Open-Ended Reasoning Evaluation For Multi-Modal Large Language Models","venue":"cs.CV","work_id":"90939588-554c-48b5-b83c-ec54dc370de2","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.752573Z"},"links":{"cited_paper":"/paper/2311.11567","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:b4515dae61d56bd24a3bccd7d853c6b03b353f3691a08cd64982b6b54a2f1ae3","observation_id":"e211f9c4-279c-4b75-8982-982754be555f","resolution":{"observed_at":"2026-08-07T15:29:12.179165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05444","last_updated":"2025-01-09T18:55:52Z","snapshot_observed_at":"2026-08-07T17:40:59.052312Z","submitted_at":"2025-01-09T18:55:52Z","title":"Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05444","snapshot_observed_at":"2026-08-07T15:29:06.836442Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.836442Z"},"links":{"cited_paper":"/paper/2501.05444","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:1e626f02991102728ce2c884870fcc77bc5157bb4bb3719df6956157c9e09f94","observation_id":"ca4d68d7-8604-484e-b562-19be0e03b0cf","resolution":{"observed_at":"2026-08-07T15:29:06.836442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-07-06T20:06:17.706151Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-07T15:29:06.918057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.918057Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:79e961995e26a674bece3a3e2ffba3bcc085e33640c3915591ac37dd431794ff","observation_id":"0aa76744-67c5-4a22-ae0c-6d7edda09bd1","resolution":{"observed_at":"2026-08-07T15:29:06.918057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.990799Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.990799Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:a6f45029016a52ac8db0c883ad7d7dc6827ef44335496915f7d9a0fd931edf42","observation_id":"afbdd6d7-55f5-4469-a78a-8f7fd1c431aa","resolution":{"observed_at":"2026-08-07T15:29:06.990799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.261576Z","title":null,"venue":null,"work_id":"5b25dc9f-5937-4b9f-8bb9-4d82c3bbcc29","year":2014},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.060061Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d23acfd83bf7386f9ec4bb82ffef5a913e7924b53249b3ccfcaa88e50a104077","observation_id":"e6641d6b-4106-4342-8a7a-3cfd18529825","resolution":{"observed_at":"2026-08-07T15:29:14.372863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11946","last_updated":"2025-02-18T07:29:10Z","snapshot_observed_at":"2026-08-01T18:52:39.594289Z","submitted_at":"2025-02-17T15:58:56Z","title":"Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11946","snapshot_observed_at":"2026-08-07T15:29:07.130989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.130989Z"},"links":{"cited_paper":"/paper/2502.11946","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d1128e8aa82d8ebd2a67462d0474058fe587999f6d28907fa501e721ffefc076","observation_id":"c7bc4686-5ada-4b63-9ff4-27152db6d3f0","resolution":{"observed_at":"2026-08-07T15:29:07.130989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:29:07.276254Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.276254Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d0477d968918fb29cea8344b2796dab6191d3c74c3be8b6a2d19b9a9bab682ca","observation_id":"9cf64359-b0d1-4418-8645-ae6f4fb80d1d","resolution":{"observed_at":"2026-08-07T15:29:07.276254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.992602Z","title":"Identifying and mitigating vulnerabilities in llm-integrated applications","venue":null,"work_id":"cbc94f94-7d87-4b21-a565-461138dcc628","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.386967Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:aa03ac3d696ef9694b54a3196f0f64e9e9152ef781b795cf899749ffa1222826","observation_id":"9e65ca95-cf97-4614-a103-166d69d5f444","resolution":{"observed_at":"2026-08-07T15:29:14.146759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.575107Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.575107Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:47b5b2d2374087e530be88fec2b5281b55ecd9d4bf4c2b1abde81390cfad57a4","observation_id":"c86d34b2-23f7-473a-b8d1-bc4262b5ef0d","resolution":{"observed_at":"2026-08-07T15:29:07.575107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.705019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.705019Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:b174af09cfb2c6aa3c0581cad5cd5e33b3126393ebb7f8dcc1760ca6965a6b34","observation_id":"f5fd6abf-ca37-4e7b-a9ef-1b505acd5909","resolution":{"observed_at":"2026-08-07T15:29:07.705019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T15:29:07.815220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.815220Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:970ae736b19bfba96d2ab3840187fc8c95ee1ea88d4766778b7f3f0f0179510e","observation_id":"8a518f1d-38d9-4f42-a14c-d4df6cadc9e7","resolution":{"observed_at":"2026-08-07T15:29:07.815220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.777081Z","title":null,"venue":null,"work_id":"710b2324-dfeb-4023-a0b7-6ddde3e38939","year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.970827Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d4f84d7143521b3c62b74994fef5af113520e5cfb57b769b44bcab6c37bc248a","observation_id":"45ab8b93-6c95-4f35-900e-c6b760657cf9","resolution":{"observed_at":"2026-08-07T15:29:13.850609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.458996Z","title":null,"venue":null,"work_id":"40698d22-c73d-4823-a098-cdb738c606fe","year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.140174Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:57038749abe1b9a8f71f090ea5868348803d65dff27d25d9ec90d7fea295ba88","observation_id":"f57a2608-05d9-447f-a12f-d5f2eae2d3d4","resolution":{"observed_at":"2026-08-07T15:29:13.607467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.168506Z","title":null,"venue":null,"work_id":"82f37147-4f6b-4b4d-870b-b6372051313e","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.269687Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:93f4642d12add7530cdb0ecedcc214d8001b976ed4eab04b0765bb1457aaf4de","observation_id":"5b4d033c-4740-4584-9ebc-6f69d021e827","resolution":{"observed_at":"2026-08-07T15:29:13.299629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.439478Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.439478Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6246888f006486699c13b7c313009a59d1568f49078867ae0bd8168aabf526e4","observation_id":"edf34150-7c3f-4609-aa30-344adb293b33","resolution":{"observed_at":"2026-08-07T15:29:08.439478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.670367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.670367Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:c6492ef64cdb598c132e828d64cae771ff4233d1bad30d180cf05e5e881d3797","observation_id":"7b93e13b-f795-48cc-87b6-d2ceb4957420","resolution":{"observed_at":"2026-08-07T15:29:08.670367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-07T15:29:08.761996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.761996Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6d15648f6768c3b0b41d2f08058d00b726da1f7d89e535ada23eb92ce33d7039","observation_id":"3eff4b52-9fde-4a5d-8613-7e369c6fd26b","resolution":{"observed_at":"2026-08-07T15:29:08.761996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.811385Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.811385Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:a25bb72f5b9e26f16fb346dc7c47adcc40e84124d6fae952cf98e0fbe0943663","observation_id":"7096508b-4efd-4f84-924d-279cddb03ad3","resolution":{"observed_at":"2026-08-07T15:29:08.811385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.911321Z","title":null,"venue":null,"work_id":"dfe95d15-b795-4f19-97d0-d1bb6f365681","year":2015},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.866273Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:1f173ed7e5ded5304ab3477ae3980a43331ea6effe7f3eaddcfc0b90b105bd7e","observation_id":"e4fc5f9c-95cc-4e26-884d-586c8bd12475","resolution":{"observed_at":"2026-08-07T15:29:13.025456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19168","last_updated":"2024-10-24T21:20:10Z","snapshot_observed_at":"2026-07-06T19:39:23.839070Z","submitted_at":"2024-10-24T21:20:10Z","title":"MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19168","snapshot_observed_at":"2026-08-07T15:29:08.907699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.907699Z"},"links":{"cited_paper":"/paper/2410.19168","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:bc3c809bf0196f10dbd4c2b0aea3c7421c343d08c727607e39ac291d97de5cbe","observation_id":"11b05881-b78f-4b2b-9a64-cbcade8cdf47","resolution":{"observed_at":"2026-08-07T15:29:08.907699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13692","last_updated":"2023-07-28T03:31:08Z","snapshot_observed_at":"2026-07-06T15:58:27.523039Z","submitted_at":"2023-07-25T17:55:19Z","title":"ARB: Advanced Reasoning Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13692","snapshot_observed_at":"2026-08-07T15:29:08.957582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.957582Z"},"links":{"cited_paper":"/paper/2307.13692","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:281fad1d2abe66e097c91cfcebc693a23df7d1eb2d604ad852f0a5b07e3e73ed","observation_id":"d217b324-4312-4423-b330-978c7bc4eca3","resolution":{"observed_at":"2026-08-07T15:29:08.957582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T15:29:09.009917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.009917Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:93c14964d0a33c17ed26b27d5270e7e8cb0d8b177ba1faa7520b04745b1ecaa4","observation_id":"e4b22b5a-e1c1-4fbd-823c-6265b5be0127","resolution":{"observed_at":"2026-08-07T15:29:09.009917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T15:29:09.060214Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.060214Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:838d2a8ae4a587d22623acec28345d71339febf79df780452bca7821fb135301","observation_id":"62377a18-2e9d-4fc0-9855-1509e8db42d4","resolution":{"observed_at":"2026-08-07T15:29:09.060214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-07T15:29:09.112978Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.112978Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:b4cd8097d42757bbf9446ba15533346b22843f87753197eda0378767465e0fae","observation_id":"ae38544a-e1a5-4962-a735-e79322499815","resolution":{"observed_at":"2026-08-07T15:29:09.112978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.165431Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.165431Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:df6595c136fb086859e3944a2fafe3fa41ff9cf25b7657795970fe729a570eeb","observation_id":"334d6059-03cd-458a-8931-d1168dcc0057","resolution":{"observed_at":"2026-08-07T15:29:09.165431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T15:29:09.231365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.231365Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:abfbf0b886aba01d475051eecb8b1d7870588d267ca97d5febb9a485420875aa","observation_id":"bf90be1b-a9c8-48d5-ba24-832a9fcdf08e","resolution":{"observed_at":"2026-08-07T15:29:09.231365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06186","last_updated":"2025-01-10T18:59:51Z","snapshot_observed_at":"2026-07-06T20:19:26.003822Z","submitted_at":"2025-01-10T18:59:51Z","title":"LlamaV-o1: Rethinking Step-by-step Visual Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06186","snapshot_observed_at":"2026-08-07T15:29:09.303581Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.303581Z"},"links":{"cited_paper":"/paper/2501.06186","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:9fe71fdec16166266370bae4fd0d9b89aae756cb552ae8eb4e4dfb7a683cce3f","observation_id":"957facb3-f800-4cfd-a49b-e014d32d746e","resolution":{"observed_at":"2026-08-07T15:29:09.303581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10176","last_updated":"2024-11-03T03:48:02Z","snapshot_observed_at":"2026-08-06T07:29:34.258050Z","submitted_at":"2024-02-15T18:26:11Z","title":"OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10176","snapshot_observed_at":"2026-08-07T15:29:09.451527Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.451527Z"},"links":{"cited_paper":"/paper/2402.10176","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:7a1928ba632a1274839cf8f49f7f7c0d1144a01e290a071f772b625375007844","observation_id":"1dfd7160-01e1-4910-accc-69f467d5916d","resolution":{"observed_at":"2026-08-07T15:29:09.451527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.630568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.630568Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:eb68f4d3711d658cf8c9fb96a2bf9e60c984e5be72eb5a6898cc2086741e5974","observation_id":"6cb4693f-c41a-4568-9d0d-7b5c6e890d98","resolution":{"observed_at":"2026-08-07T15:29:09.630568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11699","last_updated":"2024-12-16T12:21:11Z","snapshot_observed_at":"2026-07-06T20:07:41.462631Z","submitted_at":"2024-12-16T12:21:11Z","title":"CoinMath: Harnessing the Power of Coding Instruction for Math LLMs","version":1},"cited_work":{"arxiv_id":"2412.11699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11699","snapshot_observed_at":"2026-08-07T15:29:11.534622Z","title":"CoinMath: Harnessing the Power of Coding Instruction for Math LLMs","venue":"cs.CL","work_id":"69b30415-8118-46d2-be3d-1bc5c5f5aea1","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.802739Z"},"links":{"cited_paper":"/paper/2412.11699","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:68a684f9840dbfc35ae550df4046912541bc3ae0290746181f64ffb7558bf0d0","observation_id":"033c6da8-70f6-4ba8-87ce-e643a5b99b3a","resolution":{"observed_at":"2026-08-07T15:29:11.653822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.918646Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.918646Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:c4f98466a74c894f6cb6fd84fb4542d8ce4a59c0cd79db19a12ea44002ec43e9","observation_id":"bf8e362f-a722-42c1-b9f2-df5b4b3d1c19","resolution":{"observed_at":"2026-08-07T15:29:09.918646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T15:29:10.069369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.069369Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:a1c0597fb3b2960cbe4d49f6c0ff0c8ddb42cc237461bd7704ddf28229e5084f","observation_id":"9f7fcb83-621b-48f1-8aa4-ea55d87c5f76","resolution":{"observed_at":"2026-08-07T15:29:10.069369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15279","last_updated":"2025-04-21T17:59:53Z","snapshot_observed_at":"2026-08-07T16:00:29.784743Z","submitted_at":"2025-04-21T17:59:53Z","title":"VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15279","snapshot_observed_at":"2026-08-07T15:29:10.165713Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.165713Z"},"links":{"cited_paper":"/paper/2504.15279","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:73e3b8b99d6f6470619ae29fa3e3a40e49966388b358112be95374b80b3e3574","observation_id":"2b724981-3f44-4de4-b84d-c906395ff3f3","resolution":{"observed_at":"2026-08-07T15:29:10.165713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T15:29:10.500394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.500394Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:94d179dab3a5237819b618445d9eef6a340535f753e29d25b1e56c745b1cedeb","observation_id":"05a65c43-edc5-4eb8-9042-f3dfef4010e6","resolution":{"observed_at":"2026-08-07T15:29:10.500394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-08-06T03:59:19.956442Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-07T15:29:10.617952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.617952Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:69cee8c6b3c14b18a0d0a89abb26cf9ad137279f04f1b07b3c22e545b145403f","observation_id":"2455d858-69a6-4ed7-b71c-3f6252576548","resolution":{"observed_at":"2026-08-07T15:29:10.617952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:10.696136Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.696136Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:107df4f466044d6d6274b207a29f1ceb9a8bc31b3f634141ee564d749ef7042a","observation_id":"3484289d-0fc8-4e26-9ec8-b14aca858f4e","resolution":{"observed_at":"2026-08-07T15:29:10.696136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13975","last_updated":"2024-12-20T12:52:00Z","snapshot_observed_at":"2026-08-08T12:50:10.492040Z","submitted_at":"2024-06-20T03:50:23Z","title":"MR-Ben: A Meta-Reasoning Benchmark for Evaluating System-2 Thinking in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13975","snapshot_observed_at":"2026-08-07T15:29:10.816937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.816937Z"},"links":{"cited_paper":"/paper/2406.13975","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:1a29871efdd908c7d79f3a60a95c2152ee8ab348600d2c52211dc75547af8f30","observation_id":"98cbffa3-3cc2-4f6b-8840-fc938a69a4b5","resolution":{"observed_at":"2026-08-07T15:29:10.816937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.643088Z","title":null,"venue":null,"work_id":"43400091-44ba-492d-8e63-cb5b5069c327","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.988219Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:90696001a8f60db8e7060fea164af9abd0fe26621b41e531f0e33fb2b8228478","observation_id":"cca22b89-d645-42ee-b32b-5a6c2779d378","resolution":{"observed_at":"2026-08-07T15:29:12.749419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.402749Z","title":null,"venue":null,"work_id":"ad38232b-32ee-4214-940f-d9dd190ca201","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:11.108727Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:143114f0728a1fb87c33566fd56326d5ee09a812089825bb5856d77639ddc7a2","observation_id":"ba3d7663-9a9a-4344-af18-9833fe446361","resolution":{"observed_at":"2026-08-07T15:29:12.493642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08105","last_updated":"2025-04-07T21:05:50Z","snapshot_observed_at":"2026-07-06T19:31:18.802964Z","submitted_at":"2024-10-10T16:53:10Z","title":"What Makes Large Language Models Reason in (Multi-Turn) Code Generation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08105","snapshot_observed_at":"2026-08-07T15:29:11.225870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:11.225870Z"},"links":{"cited_paper":"/paper/2410.08105","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:ed9e19ab32dcc4307bfd285e2c695fdbac0efebdd7b520efe402a851ebe164f1","observation_id":"ea63c9ff-5161-465b-841f-43870f4dff29","resolution":{"observed_at":"2026-08-07T15:29:11.225870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:23:25.479987Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 4 inbound Pith citation observations for arXiv:2505.15000."}