{"as_of":"2026-08-08T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d82ba04cc6add8c96b8b9c3b33e6c60adbfd61cab1211b1df3384a14be96f37f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:13.461419Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:07:21.344787Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"reference_index":292,"source":"pdf_text","source_observed_at":"2026-05-13T01:36:23.845366Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2502.17419"},"observation_digest":"sha256:f22ce8dd24c569e79c16c56ccb261dbe2f2845fdbbd4280a8766c0029bf5bed5","observation_id":"9f43c0ce-d66c-4ef9-a17f-0fc807f4c018","resolution":{"observed_at":"2026-05-13T01:36:24.508679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-07T14:31:13.461419Z","title":"Reinforce- ment learning outperforms supervised fine-tuning: A case study on audio question answering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-07T22:01:21.366221Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:13.461419Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:90b826ae242e2fd7239b8256f335f83580a16456cd42aaa0fe3b13debdcefa03","observation_id":"7b9ad463-7fbf-40ee-8a5f-8390c59237f0","resolution":{"observed_at":"2026-08-07T14:31:13.461419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2507.08128","last_updated":"2025-07-28T22:53:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-10T19:40:21Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-15T03:42:44.523919Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2507.08128"},"observation_digest":"sha256:67489fb92f9e6944d744ca62b362ae4a07b3f63a5cd3d3858829440430dddce9","observation_id":"02f72257-f736-4ef4-9ac9-4788cfbaf892","resolution":{"observed_at":"2026-05-15T03:42:45.293345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-05T20:28:59.977640Z","title":"Li et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-07T18:23:08.889281Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:59.977640Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:8e9d60b9d196c2de1702e5ae0bfacb3b358c0f4c6e2b09408f08107f50a134ab","observation_id":"08b7bb0e-fa30-455a-9a89-729280f973ba","resolution":{"observed_at":"2026-08-05T20:28:59.977640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-05T12:07:21.394981Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question answering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01939","last_updated":"2025-09-02T04:20:12Z","snapshot_observed_at":"2026-08-07T18:39:10.295579Z","submitted_at":"2025-09-02T04:20:12Z","title":"Group Relative Policy Optimization for Speech Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T12:07:21.394981Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2509.01939"},"observation_digest":"sha256:b7536633107a2791c5f4bd25943fc019833fb295a28585467785766e50043bfc","observation_id":"6a3b6bae-50c7-4904-b015-a960435a0c0e","resolution":{"observed_at":"2026-08-05T12:07:21.394981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":262,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:87407a92b48d955b88170f5cf1a124aab1f33747eaa0ee1fff019e17a78d2047","observation_id":"9b56048b-e90a-4405-b888-06f9d163bd80","resolution":{"observed_at":"2026-05-18T19:21:48.171376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-04T11:23:18.440292Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question answer- ing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.05478","last_updated":"2026-06-08T05:16:04Z","snapshot_observed_at":"2026-08-04T21:47:56.469923Z","submitted_at":"2025-10-07T00:39:14Z","title":"AQA-TTRL: Self-Adaptation in Audio Question Answering with Test-Time Reinforcement Learning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T11:23:18.440292Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2510.05478"},"observation_digest":"sha256:f1ab4c8aedd1e3ea721ddc22bc9fe6a1f5fadaf36074fffea7be917c7f7ad326","observation_id":"513d9acc-d37d-431a-9187-d31604016403","resolution":{"observed_at":"2026-08-04T11:23:18.440292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2510.09592","last_updated":"2026-05-10T15:21:35Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-10T17:50:59Z","title":"Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T07:43:23.913399Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2510.09592"},"observation_digest":"sha256:ea04ca7f40c2763b5a2cbb7aa6a3b20be7c66540641028793cfed4ee46a8f4f1","observation_id":"1e30c90c-79f5-444e-a87c-a4d8b13e6018","resolution":{"observed_at":"2026-05-18T07:46:03.575240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2511.20785","last_updated":"2026-05-21T10:39:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T19:22:48Z","title":"LongVT: Incentivizing \"Thinking with Long Videos\" via Native Tool Calling","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T12:26:35.347190Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2511.20785"},"observation_digest":"sha256:5aa15baaebe38887f254dd67d0f555e5a3dffe6a78593d16ca577daee414c6ab","observation_id":"8f292c1d-1083-4035-b4a8-109329d1dec2","resolution":{"observed_at":"2026-05-22T12:31:32.069649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-12T21:34:30.078813Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question answering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.12144","last_updated":"2026-07-01T22:34:57Z","snapshot_observed_at":"2026-08-02T05:18:11.450897Z","submitted_at":"2026-04-13T23:48:35Z","title":"VERITAS: A Multi-Agent Co-Scientist for Verifiable Image-Derived Hypothesis Testing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T21:34:30.078813Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2604.12144"},"observation_digest":"sha256:a41967bd9c88f2b81eb648902f6fb252a7ce0d7b572069ae36068869f248c7d8","observation_id":"946b3ddd-5e8a-452d-8d87-9c6b7ded12a0","resolution":{"observed_at":"2026-07-12T21:34:30.078813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2604.12145","last_updated":"2026-04-13T23:49:27Z","snapshot_observed_at":"2026-07-30T03:55:58.250974Z","submitted_at":"2026-04-13T23:49:27Z","title":"Why Your Tokenizer Fails in Information Fusion: A Timing-Aware Pre-Quantization Fusion for Video-Enhanced Audio Tokenization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T14:49:51.481873Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2604.12145"},"observation_digest":"sha256:a00bc48f524d27fc095a5d5fba44259b3e1220ffa65fddbaaac882c8c05cdea7","observation_id":"8293b213-4cda-4579-b637-2a6d80e6fd61","resolution":{"observed_at":"2026-05-11T11:31:01.814073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2604.15849","last_updated":"2026-04-17T08:57:44Z","snapshot_observed_at":"2026-07-06T23:03:16.345488Z","submitted_at":"2026-04-17T08:57:44Z","title":"TinyMU: A Compact Audio-Language Model for Music Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T08:17:23.740979Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2604.15849"},"observation_digest":"sha256:5aa7e74e2926169dbdadca9acc4b4d6c43eb31436a818e749357061e2ebb0dd5","observation_id":"aceb0ce8-818d-4344-8794-de122493689c","resolution":{"observed_at":"2026-05-10T08:17:36.954358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2604.18187","last_updated":"2026-04-20T12:43:00Z","snapshot_observed_at":"2026-08-03T22:48:32.005633Z","submitted_at":"2026-04-20T12:43:00Z","title":"Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T03:41:27.425176Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2604.18187"},"observation_digest":"sha256:7badbcb02393285b76e37afdcbf20d3c93405496ce545d5e09919e620005386f","observation_id":"e4d01878-c041-45ed-a53e-f627b8b95a83","resolution":{"observed_at":"2026-05-11T12:26:04.051187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2605.09996","last_updated":"2026-05-11T05:11:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T05:11:22Z","title":"Omni-Persona: Systematic Benchmarking and Improving Omnimodal Personalization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T04:01:23.060562Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2605.09996"},"observation_digest":"sha256:e8dd91f0a5914b53e6fe315802c3b87b701bd9e6ecadd24f88e1f6befa277caa","observation_id":"044e02f1-1000-4e55-9cbb-922572d725cf","resolution":{"observed_at":"2026-05-12T06:46:25.869198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2605.15984","last_updated":"2026-05-15T14:17:19Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T14:17:19Z","title":"Beyond Content: A Comprehensive Speech Toxicity Dataset and Detection Framework Incorporating Paralinguistic Cues","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-19T18:36:34.351533Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2605.15984"},"observation_digest":"sha256:8f04fe13d18003c65869a20f1bba193f48c5665b624c0d44fea95057cc30eda8","observation_id":"cf1683a5-dbf9-4766-9b64-1d903fbb5bdf","resolution":{"observed_at":"2026-05-19T18:37:42.814418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2605.21008","last_updated":"2026-05-20T10:44:56Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T10:44:56Z","title":"A Survey of Audio Reasoning in Multimodal Foundation Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-21T02:08:06.976461Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2605.21008"},"observation_digest":"sha256:b7f9e545848027eb83289546c93b2fb50a9bfd9f9f65add42d98579372897afd","observation_id":"7e39656b-afa1-4cab-afec-3ed85f069a99","resolution":{"observed_at":"2026-05-21T02:09:24.292449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2605.27190","last_updated":"2026-05-26T15:43:11Z","snapshot_observed_at":"2026-08-06T18:21:13.610239Z","submitted_at":"2026-05-26T15:43:11Z","title":"Learning When to Think While Listening in Large Audio-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T18:37:34.409802Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2605.27190"},"observation_digest":"sha256:4a81c90081366ec156b9c533a7b05fe55ebda4aa731bd1da08dfe516bb7845b3","observation_id":"ff16a0b4-21dd-4882-99d2-2b437f8372ca","resolution":{"observed_at":"2026-06-29T18:43:50.737960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2606.00507","last_updated":"2026-05-30T03:44:12Z","snapshot_observed_at":"2026-08-02T14:23:14.310102Z","submitted_at":"2026-05-30T03:44:12Z","title":"LaSR: Context-Aware Speech Recognition via Latent Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T19:12:59.843096Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2606.00507"},"observation_digest":"sha256:0d29f70300c029934d06ec819d937ae9c4ba2f06c43212ed7da474214f6e23ab","observation_id":"4399527a-8e7c-4c25-82d8-6525afc60902","resolution":{"observed_at":"2026-06-28T19:22:34.992549Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2606.02615","last_updated":"2026-05-26T15:36:07Z","snapshot_observed_at":"2026-08-08T16:26:36.305631Z","submitted_at":"2026-05-26T15:36:07Z","title":"FSA-GRPO: Teaching Auditory LLMs to Use Few-shot Demonstrations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-01T16:02:03.730543Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2606.02615"},"observation_digest":"sha256:417c8d06eccaccdebd6c833d34dc1db38700fc8f5d3b0f821f8547f8835f94ae","observation_id":"908f10dc-06eb-4515-9197-97752fbe235a","resolution":{"observed_at":"2026-07-01T16:05:49.453256Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":"2503.11197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-07-02T20:07:21.344787Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question an- swering","venue":null,"work_id":"124c7cde-3047-4ea3-b487-b56039243100","year":2025},"citing_paper":{"arxiv_id":"2606.07264","last_updated":"2026-06-05T13:39:39Z","snapshot_observed_at":"2026-07-06T23:46:55.970997Z","submitted_at":"2026-06-05T13:39:39Z","title":"VISA: A Visual Information Strengthened Audio-Reasoning System for the Interspeech 2026 ARC Agent Track","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T21:02:19.300441Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2606.07264"},"observation_digest":"sha256:f1dfb7bcfa6dc3541cdeb998c8dcedf464fff9125f28eb5741cbe1717ab18464","observation_id":"7cfff068-1d25-4f50-8ef7-0f8da95b5d03","resolution":{"observed_at":"2026-07-02T20:07:21.346714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-01T21:22:42.917716Z","title":"arXiv preprint arXiv:2503.11197 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16107","last_updated":"2026-07-17T16:41:15Z","snapshot_observed_at":"2026-08-06T12:38:24.456240Z","submitted_at":"2026-07-17T16:41:15Z","title":"Audio-Visual Flamingo: Open Audio-Visual Intelligence for Long and Complex Videos","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T21:22:42.917716Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2607.16107"},"observation_digest":"sha256:e6adfec79b92427372800223b260a55f23dd448c4fa4d4d9539139e7320722ef","observation_id":"1b580945-e9cd-485e-94c7-0b3bb827eaf8","resolution":{"observed_at":"2026-08-01T21:22:42.917716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-01T10:40:25.897788Z","title":"Reinforcement learning outperforms supervised fine-tuning: A case study on audio question answering.arXiv preprint arXiv:2503.11197,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20166","last_updated":"2026-07-22T14:03:25Z","snapshot_observed_at":"2026-08-06T05:11:13.812820Z","submitted_at":"2026-07-22T14:03:25Z","title":"Audio-Zero: Label-Free Self-Evolution for Fine-Grained Audio Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:40:25.897788Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2607.20166"},"observation_digest":"sha256:f44bef2f7f03b3fc8d82a7f3de2c96fe5b346df0ae4a59c88a1ca92545784cff","observation_id":"5924d362-6311-4e55-906c-f7e5c3a8e008","resolution":{"observed_at":"2026-08-01T10:40:25.897788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-01T07:12:16.661745Z","title":"arXiv preprint arXiv:2503.11197 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21550","last_updated":"2026-07-23T17:35:20Z","snapshot_observed_at":"2026-08-08T08:48:36.880078Z","submitted_at":"2026-07-23T17:35:20Z","title":"X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-01T07:12:16.661745Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2607.21550"},"observation_digest":"sha256:f5f7405cdfd8ed32a01295183c3884dc5940a62a370282a8c800ca208ca03773","observation_id":"18352f4d-a462-4945-a5a9-133ff75fc6eb","resolution":{"observed_at":"2026-08-01T07:12:16.661745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11197","snapshot_observed_at":"2026-08-01T00:26:30.612742Z","title":"arXiv preprint arXiv:2503.11197 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26246","last_updated":"2026-07-28T20:31:48Z","snapshot_observed_at":"2026-08-03T10:50:56.850549Z","submitted_at":"2026-07-28T20:31:48Z","title":"Weak-to-Strong On-Policy Distillation","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-08-01T00:26:30.612742Z"},"links":{"cited_paper":"/paper/2503.11197","citing_paper":"/paper/2607.26246"},"observation_digest":"sha256:38780fb2c450ce9322073d90a373d4cb419f8c3480e9756c10e912af3f12ebba","observation_id":"6f8e5bc0-3f3e-42a5-aa65-05b8214630aa","resolution":{"observed_at":"2026-08-01T00:26:30.612742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.11197/citation-record","integrity":"/paper/2503.11197/integrity","json":"/paper/2503.11197/citation-record.json","paper":"/paper/2503.11197"},"outbound":[],"paper":{"arxiv_id":"2503.11197","last_updated":"2025-05-14T02:12:43Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T17:04:37.656728Z","submitted_at":"2025-03-14T08:43:53Z","title":"Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2503.11197."}