{"as_of":"2026-08-07T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41c519b83a232638854b6cfe528b0b2144f4d63fe99ec97189dc1e4666d0127f","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T14:27:02.063345Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.01520/citation-record","integrity":"/paper/2605.01520/integrity","json":"/paper/2605.01520/citation-record.json","paper":"/paper/2605.01520"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b7dcb583-c0dd-4650-b8ae-fc977e4ebd8f","year":2023},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:d054592aa41a6267cd9668ea01d80dec9d02979e06ac3b9d8cb42788c48d586d","observation_id":"eb8a5b03-ae02-43d7-a97e-3449c8a5dd25","resolution":{"observed_at":"2026-05-26T02:06:30.497074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual Instruction Tuning , booktitle =","venue":null,"work_id":"46254718-182b-4973-a5ed-8db8b69dbb3a","year":2023},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:b5216509d1edefa5ecf4bb984f7aad86c524fb36179db22998ed4184ff44e7be","observation_id":"67b2cdf2-ea65-4707-912f-f575d5526d5d","resolution":{"observed_at":"2026-05-26T02:06:30.518439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"5bb3af73-a69e-4a97-ba2e-dd16e74d188b","year":2023},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:d5b402b1bb5beeb6eb193a08bbe11a6084b9bbe1b5367df80758a93cc32dcc80","observation_id":"5efe5387-42aa-4d5f-aece-378403b0c974","resolution":{"observed_at":"2026-05-26T02:06:30.476225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"d997d2b0-3416-4e37-b97a-f7a245d90898","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:4f68949e1df1a43eb90e617a0c1df042c8747d4bf2282d3dc0252c516fe80cd7","observation_id":"3b06d1f0-81d9-4224-839c-c6095e560369","resolution":{"observed_at":"2026-05-26T02:06:30.503011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:d489ef2779e93f4d5bfaa91ed85bd0701a8b4002e748102edb238ee2acb60641","observation_id":"96a39fed-9025-4aed-9021-d57697742d9d","resolution":{"observed_at":"2026-05-09T22:24:01.636793Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:2bc2cb4848d562b431f651754a6056ca91e9fb564a033310ddd231a4417711f9","observation_id":"900e9ebb-6329-453d-9251-e4b99b231e1a","resolution":{"observed_at":"2026-05-09T22:24:01.644916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-07-06T20:49:27.466064Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:50d154e73e065aef34265ae7f3300e8b9a633a1e153d8dd1452a839082c8d4c8","observation_id":"40481495-2338-4c30-9bfc-56259fd731a4","resolution":{"observed_at":"2026-05-11T08:59:21.515346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:11:42.092743Z","title":"The Twelfth International Conference on Learning Representations","venue":null,"work_id":"0971bb9b-52fd-4ee7-9bd9-38110d7f09c8","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:a6b7d4b1781980934249ad9bf11a4bd3e19244b5abe2fe32d7c2ea5927584ba2","observation_id":"8877dbe5-1def-4ee3-ae24-1c0a0288f251","resolution":{"observed_at":"2026-05-26T02:06:30.491402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.510","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:36:58.254898Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","venue":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"85cb163c-682e-453b-a6a0-83882efc0942","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:5ada758eb0887ee185700182d4f98c67ded0479c0b3bca959e99a1376facb6d7","observation_id":"4f6c61a9-1040-4342-86a0-f4eb9643cc0c","resolution":{"observed_at":"2026-05-09T22:24:01.697464Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:52:29.842744+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:52:29.842744+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:9d91b65fba4999bb190f17356bc6c8da5940946cf87f665b7e335cc6a45082b8","observation_id":"6b5f9f35-b243-4268-b128-31c288da67b2","resolution":{"observed_at":"2026-05-09T22:24:01.683811Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19678","doi":"10.48550/arxiv.2505.19678","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.19678 (2025)","venue":"ArXiv.org","work_id":"c9a8d97f-f1af-4a27-a29f-8c8615e4a64b","year":2025},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:62a126cf3603616e741ee785696acf29b5f68ef40b93af229ce716a87fb388f4","observation_id":"687bc591-e1be-4ebc-856e-39586694dd5a","resolution":{"observed_at":"2026-05-09T22:24:01.693283Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:48fee00f658107c36098afb20efb00b434148ac8b9b7e785a12f9b99080e251e","observation_id":"caffb111-a642-4890-8c03-bf35a5281e53","resolution":{"observed_at":"2026-05-09T22:24:01.675606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts , booktitle =","venue":null,"work_id":"e0bbeb11-e37a-4f6d-98a3-c4294a6c8d56","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:11f18689d160e6c4f67dcf388d19c6df80f1e01eb95d825674ddb47f62b60ba7","observation_id":"aff6787d-e22b-4fdf-9830-3e7a10104a91","resolution":{"observed_at":"2026-05-26T02:06:30.527330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73242-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps://doi.org/10.1007/978-3-031-73242-3 10","venue":"Lecture notes in computer science","work_id":"05c42c21-3af1-4a16-aa23-2791f1f3b254","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:f3234177e0832f7b7aeaabb8e8784defded83663f834b246a5423812a34987a7","observation_id":"34d3a071-77c0-42ea-886b-4572803fd541","resolution":{"observed_at":"2026-05-09T22:24:01.640195Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models? , booktitle =","venue":null,"work_id":"6046f287-742b-45f1-ab0c-724539e4bb6f","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:497c067a0ba9371e7102384adacc419b5974b7ff1e5a49ff941f1c20cc482e04","observation_id":"d62e4f69-9bc0-43d5-bbbb-f67f666604e5","resolution":{"observed_at":"2026-05-26T02:06:30.506054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:269de6eed40cfe5c52c5e9870d6354cc8b06c2eeddf980eda9df85dfdb3c1d1f","observation_id":"21c3b8db-876d-445f-b3ca-f597247ecd2e","resolution":{"observed_at":"2026-05-09T22:24:01.650139Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.960754Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning? , booktitle =","venue":null,"work_id":"7fa95e84-0414-40a6-956c-88e0a5bac807","year":2025},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:638c24bc4b1246cc1dc248abb2844f355cc03429e32324a7b0d97a4a9985d1e5","observation_id":"b4748b50-c53c-415a-83b5-1cdf32086b15","resolution":{"observed_at":"2026-05-26T02:06:30.473217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.446","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M 3CoT: A novel benchmark for multi-domain multi-step multi-modal chain-of-thought","venue":null,"work_id":"7fe0fd76-8fb5-467d-9671-0820c04c5bd5","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:4371a3593576aba937460dea5312face39f72dbba6151d2ac5291633389718ef","observation_id":"450a34f7-47da-40ff-9c2f-526fb9fded50","resolution":{"observed_at":"2026-05-09T22:24:01.666940Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , howpublished =","venue":null,"work_id":"903c0e85-4fbb-4e39-9d17-e831e8397041","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:d9d11ec46dd69ad61b260a27a15911ef3026f12dd2da043fc1faf4a262a22184","observation_id":"3d5acccf-e59d-446e-8e74-571bd9ae3bd4","resolution":{"observed_at":"2026-05-26T02:06:30.515519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-46493-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Weinberger , editor =","venue":"Lecture notes in computer science","work_id":"09aa03fa-69c2-4b29-a286-c96e6895e095","year":2016},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:9200845569c9396305a372aa74cae1cd85ee23b4506e9d169a457761c4de2fe4","observation_id":"1282ce89-670b-4328-9856-302263c6f34f","resolution":{"observed_at":"2026-05-09T22:24:01.670726Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-15T19:20:20.487599+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T19:20:20.487599+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-acl.177","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:14:17.822252Z","title":"doi: 10.18653/v1/2022.findings-acl.177","venue":"Findings of the Association for Computational Linguistics: ACL 2022","work_id":"db438984-c1ed-42ec-b36e-e121a4b9cf1b","year":2022},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:ead4166f738372c9d46ee88156fa967f7272723080cfb31677cc16e3fe1a6a7d","observation_id":"205f9469-b9cd-4178-ab62-735f43ec8c37","resolution":{"observed_at":"2026-05-09T22:24:01.658041Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.20","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Bouamor, H., Pino, J., Bali, K","venue":null,"work_id":"666b2cad-d7b8-46ce-b87a-5bfc5c974bda","year":2023},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:54bbe58b6cdebfe262b5507573e385338b3865fc336f1086f731121d8a9229fe","observation_id":"f2718aeb-e3d2-4a37-b12c-a0b22dcae56d","resolution":{"observed_at":"2026-05-09T22:24:01.679101Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:10.783551+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:10.783551+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:ab33dfef8614c18d09131e435de177c3963d03551a010ef8b46a90ad2032dcc5","observation_id":"466861b1-def5-4b6c-af66-138f94014691","resolution":{"observed_at":"2026-05-09T22:24:01.688773Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:a6840b9a3cc61c21e106a0d1845c67bdc3c73c70f3086f725423a23bc7046e2a","observation_id":"d89f4725-c088-4497-8eb7-850a95bc11b6","resolution":{"observed_at":"2026-05-11T16:56:07.528251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.930426Z","title":null,"venue":null,"work_id":"2af38f92-e456-44c4-a31b-7d5da7f5b0af","year":2022},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:564eefcc9e2a4550b10fadb1787bd06a833b0ecca3aa020e4890817043a83d16","observation_id":"210daae9-352a-4e12-a778-fa5b3bc8a3e1","resolution":{"observed_at":"2026-05-26T02:06:30.479765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.959134Z","title":"Manning and Stefano Ermon and Chelsea Finn , editor =","venue":null,"work_id":"6db17358-23f5-4dfe-a28b-fe864c0cf8e9","year":2023},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:8034b2d0f1e3e6bac5ddff454f124bbcdd0285f989bf2c3d14d8eae06d7c5230","observation_id":"f81eb4c0-f2df-4130-8ee7-07c247b25ba5","resolution":{"observed_at":"2026-05-26T02:06:30.512330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":"1807.03748","doi":"10.1609/aaai.v36i10.21390","metadata_source":"pith","pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Learning with Contrastive Predictive Coding","venue":"cs.LG","work_id":"7b08a1d4-d565-424e-9c86-6ef244b7b90a","year":2018},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:aec91eaa317d54672fe160b5c38b276050d28368c5ff192d6c63a09ac4c39bba","observation_id":"0498bf5b-943c-45f8-8d44-d8c7f77e59e8","resolution":{"observed_at":"2026-05-11T16:56:07.532925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning Transferable Visual Models From Natural Language Supervision , booktitle =","venue":null,"work_id":"cd2a7495-6513-4131-9e34-108b1d621839","year":2021},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:9329d80f8efcb3f9f0285071b9591fb31b691536bc41c4c1f58e20fa1ea2bb6f","observation_id":"f0663295-dc05-41ea-a137-ab6047866cf1","resolution":{"observed_at":"2026-05-26T02:06:30.521562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"276bf8fd-163e-40e4-8c25-9335e79406fb","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:407d0ee049ce638a6fe8ab1e08ef65709f8e9092a3f7a75f07d0c85cc69bfa65","observation_id":"1cf32a4f-ab14-4031-94f8-e2f97ad5d593","resolution":{"observed_at":"2026-05-26T02:06:30.524390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Courville and Alessandro Sordoni and Rishabh Agarwal , title =","venue":null,"work_id":"8777153c-538d-488d-a189-11687c1569f6","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:8566f2f97197c00fb31f608cf09fe1e0a9b711d739fbdb3626cef7f0ea8261cf","observation_id":"66949f46-d71f-4bef-aff8-a1cc7c0fb9bd","resolution":{"observed_at":"2026-05-26T02:06:30.509386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"48c5e5d5-a772-4509-901d-ec0a609912ed","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:3d25959244f60e2b2687453c40f8de785079ded489a6aa8eeccf886c4025738c","observation_id":"245ea09a-27f5-4add-bb49-b1dd4cdd2752","resolution":{"observed_at":"2026-05-26T02:06:30.485104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hinton , title =","venue":null,"work_id":"9e97cc36-f508-4dca-b7f5-346a43408de9","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:97009f2e5be6a72d0c7833e4abb369c5913ec5537103c23ffa713d8d543c0548","observation_id":"99d9a650-e9db-4882-9fe9-f9f79ed3f544","resolution":{"observed_at":"2026-05-26T02:06:30.482571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Girshick , title =","venue":null,"work_id":"dcf33073-f9bb-4f28-b3b4-c89cb94f11dd","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:c93d656621814c3e252737a7cf1f5123edda25e9c066a2029118f1ed65e6e7d6","observation_id":"ff1d19fd-96da-4408-92a0-0cf271bd2346","resolution":{"observed_at":"2026-05-26T02:06:30.494126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"47ed342e-6564-4212-b6b9-a8151f749f5b","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:ea30acf8ed6e2ed9a0586e0d5463e55d200b021faf167ee54f7278dcc8fdb8fc","observation_id":"c65b093a-a737-4d98-ba6b-fcf771035c2f","resolution":{"observed_at":"2026-05-26T02:06:30.499933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T04:43:23.211760Z","title":"CoRR , volume =","venue":null,"work_id":"e10a1974-f6df-4ba2-ab9a-03c8e5f6e6f9","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:e19602c435a8f72eb2f4bd0daeac1a277ab1fe7e701224e0c7b74e4795278942","observation_id":"000932f7-ab17-4d9b-8dfe-af2a41e78fa6","resolution":{"observed_at":"2026-05-26T02:06:30.487957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T04:43:23.306953Z","title":"Le and Ed H","venue":null,"work_id":"7cfedc49-9ea5-4804-8e6f-11ad6abbf8d1","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:41a623da1cbe176abecf4e0519910e8ce6bb6f43516aafd3c6e6ecc33c5983bb","observation_id":"cd8d38e0-5b84-425f-a0ea-e4a3fd4ef0f9","resolution":{"observed_at":"2026-05-26T02:06:30.544354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Goodman , title =","venue":null,"work_id":"e4d125c9-a892-44b4-83ff-1d2fe114937b","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:7eb4c151e39a07d139d669ee534b1bf2f73a61a361d7030d764a50bd2f89a762","observation_id":"cb9f9f91-d5be-4947-b9ca-c04e49070799","resolution":{"observed_at":"2026-05-26T02:06:30.530045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fa481604-4f3d-4966-a5c6-cfac2b34441a","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:ef56720eb5509ce6a58bcafba0dbab6347b5aec97e449963fbc3be25d8923a51","observation_id":"f79f4c06-a35d-4fab-a70b-615623c65cdc","resolution":{"observed_at":"2026-05-26T02:06:30.547008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2933346a-c22f-43db-bad1-bc7d5e24aee5","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:0da3d8d3fc4a8577b8c65cb5c8e9fa7f83af374b053b25a4d804d0caad212f06","observation_id":"f1863afb-1511-4eb8-964a-93dd3edaa207","resolution":{"observed_at":"2026-05-26T02:06:30.552449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Curriculum learning , booktitle =","venue":null,"work_id":"d112790a-e052-4f4d-95a1-278106bff9e6","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:9da9b8076e2a24f4b9707a46c53c122b8f0cedfc5d9d2a1ba969882a7095e18a","observation_id":"e9ece5a9-02ca-44e6-adcf-96ce2088b615","resolution":{"observed_at":"2026-05-26T02:06:30.536211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"1ec171c0-e7af-4a2d-99dd-042e4889ee81","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:dba6b5da8637e700ffd2d7a1db7a14d0855e4436c52c47863fc841710fe4f7c2","observation_id":"089e59a4-6e51-4003-a57e-c2fc73e3bad3","resolution":{"observed_at":"2026-05-26T02:06:30.541632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"776585bc-a647-4698-9c37-d54eef15a110","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:94e5138447e5c5b1b619df0548facbdef3767075a4574b52f10f664a6786f76c","observation_id":"2a05db19-21c2-4d78-9cdf-5401856dffdf","resolution":{"observed_at":"2026-05-26T02:06:30.539065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"7ca7b2de-6064-42d8-8e94-b5a7bcfe992e","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:c3c386b1e0b7a86c0cab4c6d2c7e81628b08ec091fdebb0445a472b3ae32d372","observation_id":"5718749e-9eb9-42a9-b032-100340324490","resolution":{"observed_at":"2026-05-26T02:06:30.549928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9031.369607","doi":"10.1145/3689031.3696072","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"4909736c-3fe1-4820-b489-cca51669c6d2","year":2025},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:948a6b1a1fad7e23891e1d4886c54270d4f1d74dd0792485c0fcf755ffa5ed2a","observation_id":"c7fa927d-c4fb-4485-96b0-8d410d0d7854","resolution":{"observed_at":"2026-05-09T22:24:01.663017Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR , volume =","venue":null,"work_id":"f275337d-c12a-4ded-9429-5150b41942ec","year":null},"citing_paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-09T14:27:02.063345Z"},"links":{"citing_paper":"/paper/2605.01520"},"observation_digest":"sha256:65f149692675cab00df387c72faf0e7ce24a62620175218082fbe73fa11a639d","observation_id":"5134ed97-8d98-4042-bb64-2889f08ca845","resolution":{"observed_at":"2026-05-26T02:06:30.533258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.01520","last_updated":"2026-05-02T16:21:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T16:21:31Z","title":"MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":10,"parse_uncertain":0,"unresolved":6,"verified_exact":7,"verified_fuzzy":22},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2605.01520."}