{"as_of":"2026-08-04T13:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75d0a5b02eabe0d4bb61f37b7469b19500c907ee21f337c1c87a0fc97785a066","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T11:56:29.743281Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.14184/citation-record","integrity":"/paper/2603.14184/integrity","json":"/paper/2603.14184/citation-record.json","paper":"/paper/2603.14184"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-07-10T11:37:03.214945Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:2240c80cfed30989450e73484a2051789b9a3837a09bce05dc7be5db852d9328","observation_id":"c8ceeb52-d5a6-4cfe-b961-c23dec8313cb","resolution":{"observed_at":"2026-05-21T12:00:04.307365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-11T01:17:45.013705Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:f57e4b44d7ce1e37957c9f5e223f146876130c19f97278aee145a4d31b1add3b","observation_id":"25e5159c-2406-4143-a096-dc8bf4e2d87e","resolution":{"observed_at":"2026-05-21T12:00:04.283277Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ddot: A derivative-directed dual-decoder ordinary differential equation transformer for dynamic system modeling","venue":null,"work_id":"7fc2e15b-8f11-40b3-9821-0ee3b7a5bd74","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:848217214cf4a9ad17f13f7568bf3e46ac229633e64336640913bb3f785cba37","observation_id":"a88192c8-3607-41f2-b797-1527c5301047","resolution":{"observed_at":"2026-05-21T12:00:04.901809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are we on the right way for evaluating large vision-language models?Advances in Neural Informa- tion Processing Systems, 37:27056–27087","venue":null,"work_id":"ded11222-0ca9-4c9e-b0b0-92b661b854b7","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:c530700a5bc40920fcf06acff91a0694ddf452359774f1fd1156e13c6c435c54","observation_id":"0b2daca1-8bb6-4bf6-9794-10325ce6e90e","resolution":{"observed_at":"2026-05-21T12:00:04.926683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interleaved-modal chain-of-thought","venue":null,"work_id":"e6c968a0-b436-4378-9da7-aa4ded71d640","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:69c4f35b8dcac671dce0ee1b4ed56a04c6a0a3549e300809b01807f24b8f5d28","observation_id":"5f949651-fe6d-40d7-877a-78a09810b314","resolution":{"observed_at":"2026-05-21T12:00:04.899743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini: Our most capable multi- modal ai model yet.https://deepmind.google/ technologies/gemini/","venue":null,"work_id":"959ad23c-ce20-44ef-a46d-87a94c8cce93","year":2023},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:1dec98ced98ebdae449ccfce8f65d43477a36e706eb57445310f68479bd2eeb2","observation_id":"d2ee727d-9616-4a24-a027-7d2d37b25fe7","resolution":{"observed_at":"2026-05-21T12:00:04.890661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hallusionbench: an advanced diagnos- tic suite for entangled language hallucination and visual il- lusion in large vision-language models","venue":null,"work_id":"a33aa07d-7550-4041-839b-dab44dcdcf8b","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:85c80828dd053663c32e46bbb217c8845a8212f67cf5afa8fc2b1821eaeaec96","observation_id":"ea006f23-8a73-4f8c-9c7e-4a473ee9ae13","resolution":{"observed_at":"2026-05-21T12:00:04.895058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03321","last_updated":"2025-03-05T09:55:07Z","snapshot_observed_at":"2026-07-06T20:47:04.984599Z","submitted_at":"2025-03-05T09:55:07Z","title":"See What You Are Told: Visual Attention Sink in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2503.03321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.03321","snapshot_observed_at":"2026-07-04T03:19:31.045973Z","title":"See what you are told: Visual attention sink in large multimodal models","venue":null,"work_id":"e2353a49-e7c6-4ef7-9033-fbaaa4fc0e08","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2503.03321","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:bdf31a1fb5166a4830e72356ef5387a4f9c772dfdbff8842430692cfbd5fb7b1","observation_id":"019e877f-d788-46fd-a323-8e61986d8f3c","resolution":{"observed_at":"2026-05-21T12:00:04.294537Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"64e54d92-50d2-424f-91ff-9130d0428cf0","year":2022},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:01a7042e2f950839ef815d2cfd66233c8ff52adf1208108680457f15b85bffc2","observation_id":"1ecc98c0-b5b0-4f55-9e15-3c83e705dec0","resolution":{"observed_at":"2026-05-21T12:00:04.897202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:03922fcf0fb483919212a151589a5a199c12f0088d2fcac8f1930d9eeb83f88a","observation_id":"873458e3-a56d-4bd4-a4d4-ed0ab4552919","resolution":{"observed_at":"2026-05-21T12:00:04.278492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"75da829d-a6c1-4732-ab15-14c9aaac7bc8","year":2023},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:7bac50ba44269f3851388d57135aaf6e499a3a103c0c22b9f0ea207ee7918dfc","observation_id":"d60cb9bd-3110-4c39-a443-a367a20b05ae","resolution":{"observed_at":"2026-05-21T12:00:04.904787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":"1705.04146","doi":"10.48550/arxiv.1705.04146","metadata_source":"pith","pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","venue":"cs.AI","work_id":"719ded21-2bd8-46b6-8270-4cfca53de17f","year":2017},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:8e5eddc64f077b083f29da67aa7f29bbe2501c948b9ddf8df92fbe27f4f02914","observation_id":"38f12b71-985f-4a35-82ab-9fae04cde827","resolution":{"observed_at":"2026-05-21T12:00:04.303572Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21523","last_updated":"2025-06-20T08:41:41Z","snapshot_observed_at":"2026-08-03T19:13:55.105957Z","submitted_at":"2025-05-23T05:08:40Z","title":"More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models","version":3},"cited_work":{"arxiv_id":"2505.21523","doi":"10.48550/arxiv.2505.21523","metadata_source":"pith","pith_arxiv_id":"2505.21523","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Advances in Neural Information Processing Systems , year =","venue":"cs.CL","work_id":"bb9acd95-b27a-4709-9dfa-75f62a65c716","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2505.21523","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:6c5ccfa96b865ba137c2e42221d14db1d8c37e6c0c0f63a7bd3c6fcd78c30ff7","observation_id":"b4ae380b-8e2d-4288-a5e7-958be10e4c51","resolution":{"observed_at":"2026-05-21T12:00:04.289571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916","venue":null,"work_id":"b34ac6c1-7820-4e96-a2de-5ca62e2f1cc7","year":2023},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:94ce03dc21bedad3ffc210af4e4190c23dea85dd98374d2d6cd9122f7ec1a0ab","observation_id":"53512ddb-d9ff-4a21-b7c9-634a86f55c66","resolution":{"observed_at":"2026-05-21T12:00:04.892804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15587","last_updated":"2025-08-24T14:19:05Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T16:26:38Z","title":"SCP-116K: A High-Quality Problem-Solution Dataset and a Generalized Pipeline for Automated Extraction in the Higher Education Science Domain","version":2},"cited_work":{"arxiv_id":"2501.15587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15587","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"78969e26-2bab-42e1-9c80-79f260218059","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2501.15587","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:efb2a619b87d3631bcb3094e6c50ccb0542b2ca80fdaf1251f274efad556c780","observation_id":"5e6842ff-7553-47ff-a60f-94d630df5961","resolution":{"observed_at":"2026-05-21T12:00:04.299034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering.Advances in Neural Information Processing Systems, 35:2507–2521","venue":null,"work_id":"192b1435-d9c0-46b1-86ad-5435ea099fb7","year":null},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:e184e43e45b54e4d488084c00307c1cfdbc04112b3c232464a8476670ef73295","observation_id":"5b3334e5-1a7f-4ebc-9ef3-b8be329e7342","resolution":{"observed_at":"2026-05-21T12:00:04.886741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.07365","doi":"10.48550/arxiv.2503.07365","metadata_source":"pith","pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","venue":"cs.CV","work_id":"eda3a54e-ebd6-40bd-af17-b567ea4c5d62","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:7d03784671e3e2521aa49f8ccb34e5865e6bcbd416d0afe0f1229cabb240af2d","observation_id":"4338ff4a-26a0-4ecd-871b-088210bc443c","resolution":{"observed_at":"2026-05-21T12:00:04.245706Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ocean-r1: An open and generaliz- able large vision-language model enhanced by reinforcement learning","venue":null,"work_id":"5c9a9d9d-273a-4286-b772-9698b914ba0b","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:a6c77cb5d01943b599ab184b27b9dc653e5dec118ad51d12a46091c8216cceb1","observation_id":"517b1b64-d8cb-443b-891b-bc9a2966cc34","resolution":{"observed_at":"2026-05-21T12:00:04.882099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional chain-of-thought prompting for large multimodal models","venue":null,"work_id":"d617edd2-f90c-4957-9f39-eebbe8a4602d","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:a6f2d6b12f748e5669232bf1e569789fd36f388170418979a7d2b137c4e46c84","observation_id":"1ead2075-e5c3-4043-b642-c902b3f78553","resolution":{"observed_at":"2026-05-21T12:00:04.877763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards vqa models that can read","venue":null,"work_id":"2fd0bb9e-2459-40b9-a710-c921c4b1e56c","year":2019},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:b749aceb8dd77b50244dc56730590413d794f27ac3aceb519355f9df23eb4ee8","observation_id":"9c7e8226-6581-465e-ad1e-01ee43312b87","resolution":{"observed_at":"2026-05-21T12:00:04.888729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":"2309.14525","doi":"10.48550/arxiv.2309.14525","metadata_source":"pith","pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-07-10T08:06:57.517625Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","venue":"cs.CV","work_id":"85bf563b-4790-4f8d-92e3-0ed210813c10","year":2023},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:1e2596fbc1274b6c711d86e8745a2c33ce4185c39a093927cace40a7a4815f11","observation_id":"1cf2d3f2-db35-4d2b-abf2-004867d2b9c4","resolution":{"observed_at":"2026-05-21T12:00:04.255052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:08.282214+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:08.282214+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3 technical report","venue":null,"work_id":"fc78de4c-0bba-4de9-b1f7-6d21583f38c9","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:f83ae3c0d41af826384438fc39983be631e0566a5bb43b91016b3a0ec8410629","observation_id":"2e9dbaba-656e-401c-89f5-05acc341f068","resolution":{"observed_at":"2026-05-21T12:00:04.875868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T03:24:29.435936Z","title":"Mea- suring multimodal mathematical reasoning with math-vision dataset.Advances in Neural Information Processing Sys- tems, 37:95095–95169","venue":null,"work_id":"d7b10f8f-29b4-4453-a107-3edf0352a196","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:d361cef148adb216ccdbcdd2adaf6288ec5d84b76bb480b92e271ce233bba3d4","observation_id":"700af3fe-858e-4958-acda-e4c4b7113f97","resolution":{"observed_at":"2026-05-21T12:00:04.880086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-07-11T01:17:42.597062Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:b3f3d61b5d651857d991ffaac6230b69e5a14034663840768d717334559eec53","observation_id":"c784c8ef-ae77-401b-bc6e-512f950c0994","resolution":{"observed_at":"2026-05-21T12:00:04.268445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07934","last_updated":"2025-05-30T15:53:16Z","snapshot_observed_at":"2026-07-06T21:07:29.062389Z","submitted_at":"2025-04-10T17:49:05Z","title":"SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement","version":3},"cited_work":{"arxiv_id":"2504.07934","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07934","snapshot_observed_at":"2026-07-04T16:29:57.248099Z","title":"Sota with less: Mcts-guided sample selection for data-efficient visual reasoning self-improvement","venue":null,"work_id":"3af2dc47-c7ba-4654-9a4e-89fdcbfa9bc0","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2504.07934","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:6dceda2aceb33b7ebecf3e6abdec3e2bde5686b4d222e1e727d6198d71ad9a7e","observation_id":"c71b368f-6819-4534-9280-31d87dd2d01d","resolution":{"observed_at":"2026-05-21T12:00:04.251113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Haloquest: A visual hallucination dataset for advancing multimodal reasoning","venue":null,"work_id":"f2765d3a-ff82-4ae9-aeab-fc62ae6b0d94","year":2024},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:3d4550d50b7a6acfdabfff11bf5640b4a6655f4b5d84c5f25019ccd69646ea22","observation_id":"681abfc9-ffaf-4b59-83bd-fc09f848cde4","resolution":{"observed_at":"2026-05-21T12:00:04.874020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thinking in space: How mul- timodal large language models see, remember, and recall spaces","venue":null,"work_id":"276ce603-f3c0-424f-a23a-7bb7a168ddd9","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:5d6a9c22aee96e96b6be2ccae676c964727ba8bbcc338b3f76c687ff66f00ea3","observation_id":"1e13eb74-28a8-4020-a17c-808c9eb0b88d","resolution":{"observed_at":"2026-05-21T12:00:04.884370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:49:18.136752Z","title":"Gsm8k-v: Can vision language models solve grade school math word problems in visual contexts","venue":null,"work_id":"4e523856-467f-4f6a-9f93-f35d35da71fb","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:261eaee3eaa8f35f9daaad86e4b5615d6ae09a55882e78817e547f58519400e2","observation_id":"022b4dd0-4592-4df5-b411-62449c6d8592","resolution":{"observed_at":"2026-05-21T12:00:04.263872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17422","last_updated":"2025-02-24T18:54:40Z","snapshot_observed_at":"2026-07-06T20:41:51.646955Z","submitted_at":"2025-02-24T18:54:40Z","title":"MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs","version":1},"cited_work":{"arxiv_id":"2502.17422","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.17422","snapshot_observed_at":"2026-07-11T03:17:51.651790Z","title":"Mllms know where to look: Training-free perception of small visual details with multimodal llms.arXiv preprint arXiv:2502.17422, 2025a","venue":"cs.CV","work_id":"60c37b5e-bbe5-4027-874f-8868378999bc","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2502.17422","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:7dcc2c93debdd45817710b5427a25f3ef89b07e78fd42e8c74568840092426a4","observation_id":"78da70f9-51ff-4322-b493-1722d99f08da","resolution":{"observed_at":"2026-05-21T12:00:04.273457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2505.14362","doi":"10.48550/arxiv.2505.14362","metadata_source":"pith","pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","venue":"cs.CV","work_id":"5f6cf57b-2407-4127-b39c-d8a61494e474","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:52617b67012c9150e23b3f50372a78d39739aea0361e8e223e4b0e49e8da4afe","observation_id":"35150de5-752a-4584-9fb9-26114febec26","resolution":{"observed_at":"2026-05-21T12:00:04.259058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":13,"verified_fuzzy":16},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2603.14184."}