{"as_of":"2026-08-08T06:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e677abe80cc3c8bc9cca3aeaad43516a9c573b223a9669617bd67a0ebce0a92f","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:59:23.141014Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T16:53:43.427625Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:46.064161Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"cited_work":{"arxiv_id":"2505.23091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23091","snapshot_observed_at":"2026-07-04T10:39:46.064161Z","title":"arXiv preprint arXiv:2505.23091 , year=","venue":null,"work_id":"9101ce9a-5e5c-4cfb-a22a-658e7067fcc4","year":2025},"citing_paper":{"arxiv_id":"2509.24251","last_updated":"2025-10-05T04:01:18Z","snapshot_observed_at":"2026-07-06T22:31:00.843452Z","submitted_at":"2025-09-29T03:52:01Z","title":"Latent Visual Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T18:41:30.307521Z"},"links":{"cited_paper":"/paper/2505.23091","citing_paper":"/paper/2509.24251"},"observation_digest":"sha256:0413a3c9a20be98035fd02bdfcc8dc1dd48bd1881e67aa9bbf58a8d3606d633c","observation_id":"12bd2d1f-7a14-4920-a638-28601499118e","resolution":{"observed_at":"2026-05-15T18:41:30.420970Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"cited_work":{"arxiv_id":"2505.23091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23091","snapshot_observed_at":"2026-07-04T10:39:46.064161Z","title":"arXiv preprint arXiv:2505.23091 , year=","venue":null,"work_id":"9101ce9a-5e5c-4cfb-a22a-658e7067fcc4","year":2025},"citing_paper":{"arxiv_id":"2605.17037","last_updated":"2026-05-16T15:16:00Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T15:16:00Z","title":"D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-19T20:21:48.657926Z"},"links":{"cited_paper":"/paper/2505.23091","citing_paper":"/paper/2605.17037"},"observation_digest":"sha256:a7e19e862aca682bc95296a5c03954a7ddad66d2c1208368207dbcb3cbd0bc99","observation_id":"600bdcfc-05fa-415f-b1e7-da58c3897ad4","resolution":{"observed_at":"2026-05-19T20:22:45.278394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"cited_work":{"arxiv_id":"2505.23091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23091","snapshot_observed_at":"2026-07-04T10:39:46.064161Z","title":"arXiv preprint arXiv:2505.23091 , year=","venue":null,"work_id":"9101ce9a-5e5c-4cfb-a22a-658e7067fcc4","year":2025},"citing_paper":{"arxiv_id":"2606.23543","last_updated":"2026-06-22T16:17:30Z","snapshot_observed_at":"2026-07-06T23:58:16.163783Z","submitted_at":"2026-06-22T16:17:30Z","title":"VeriEvol: Scaling Multimodal Mathematical Reasoning via Verifiable Evol-Instruct","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T08:34:27.719022Z"},"links":{"cited_paper":"/paper/2505.23091","citing_paper":"/paper/2606.23543"},"observation_digest":"sha256:54ede33ffd66553bb09f3758de7d76057e5b8d2cff2f1f6188747de22c5621ea","observation_id":"3bfa07d7-4e8b-4106-8fa1-53a296c7ad16","resolution":{"observed_at":"2026-07-04T10:39:46.065840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"cited_work":{"arxiv_id":"2505.23091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23091","snapshot_observed_at":"2026-07-04T10:39:46.064161Z","title":"arXiv preprint arXiv:2505.23091 , year=","venue":null,"work_id":"9101ce9a-5e5c-4cfb-a22a-658e7067fcc4","year":2025},"citing_paper":{"arxiv_id":"2607.01707","last_updated":"2026-07-02T04:59:56Z","snapshot_observed_at":"2026-08-02T06:22:23.690891Z","submitted_at":"2026-07-02T04:59:56Z","title":"LASER: A Corrective Lens for LVLMs via Visual Attention Preservation and Sink Suppression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-03T16:53:43.427625Z"},"links":{"cited_paper":"/paper/2505.23091","citing_paper":"/paper/2607.01707"},"observation_digest":"sha256:cdb3f31e847b6a58a50ca100a660c80c162fe8ccd198ddceb1ab8ed4bcc22375","observation_id":"8c55e748-8cfe-4f10-84db-cdea0c04c937","resolution":{"observed_at":"2026-07-03T16:58:42.492709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23091/citation-record","integrity":"/paper/2505.23091/integrity","json":"/paper/2505.23091/citation-record.json","paper":"/paper/2505.23091"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:59:19.315667Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.315667Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:159768e97035f93af8948d2b39c8644fac636799f46c34d4241aa0f57fd94b30","observation_id":"44d759aa-6212-40d0-bb87-aa29433b17ce","resolution":{"observed_at":"2026-08-07T12:59:19.315667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:59:19.431681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.431681Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:29eb4b3c897f54314e26a470cd33410fae3753afb4c34439e64b291377a32568","observation_id":"65a29c40-e7d4-4c9a-b8de-0221cfd36bf8","resolution":{"observed_at":"2026-08-07T12:59:19.431681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T12:59:19.523089Z","title":"Kalai, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.523089Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:01e89e79c1e6f2f70a62ddfba84a864bcd379334d4cfbbb8693ce735c4378d72","observation_id":"9cb0006b-35d7-4660-ba07-8f10ad333518","resolution":{"observed_at":"2026-08-07T12:59:19.523089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-07T12:59:19.624700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.624700Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:7a45a36df2c8c85fb7cc545f412a512e9a8ebd4314f6cffddd1c2b968b6f8d36","observation_id":"c01072d5-3cee-4766-bfb9-26bbf4b826a7","resolution":{"observed_at":"2026-08-07T12:59:19.624700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:25.627114Z","title":"Kosaraju, Y","venue":null,"work_id":"0993f877-cafa-4bab-a573-24bbb7562e09","year":2023},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.764183Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:03d77d86c13c65db27e16a33a64233bb750631bb35c991efa9d302e041846e58","observation_id":"0c95002a-6c4f-4b32-9bdb-c7906314ef78","resolution":{"observed_at":"2026-08-07T12:59:25.681023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:25.468500Z","title":null,"venue":null,"work_id":"bea559b1-a9f0-4bf6-bc45-c4eb11f73275","year":2023},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:19.906443Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:db2c5abe09cc1d93def247e17e6221dc35db28e74ca1b1056e55672a81a3db39","observation_id":"19d83683-c19d-4022-ad09-68fcb74e33fb","resolution":{"observed_at":"2026-08-07T12:59:25.531225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:25.345515Z","title":null,"venue":null,"work_id":"1b93af55-b9cb-4c4c-817f-a70275d581fe","year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.054294Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:3ffac4a2987d2cbda6aaa34d3032ada16933e4c35a12800504ff859d0d6f254a","observation_id":"7711fb21-8c83-49c6-8593-de6873b052a7","resolution":{"observed_at":"2026-08-07T12:59:25.393970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:20.185816Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.185816Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:382a635faf4b5a55587fbc067c64202f4c35a9e5999f9f481680eb86c6a8e99b","observation_id":"042b01ec-2aec-4b7e-b9d0-fc7cabbb8249","resolution":{"observed_at":"2026-08-07T12:59:20.185816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T12:59:20.280238Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.280238Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:1ab0b822c8a7c6539312b3da5da8d841a793a0922cc79ff90d42debee191a641","observation_id":"39c6486a-1a54-499d-a35c-aff0c2dd67a6","resolution":{"observed_at":"2026-08-07T12:59:20.280238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:25.236982Z","title":"Donahue, P","venue":null,"work_id":"2e5097c5-b6e4-4fa3-894f-f00f155e3d0d","year":2022},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.410033Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:07c7adfa206fdb91e4c0569cea960f694f011a9b696b9b5d167161fc34bb9309","observation_id":"dc87b2d7-493c-4505-8140-ad931d9fce0b","resolution":{"observed_at":"2026-08-07T12:59:25.277908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:25.120881Z","title":null,"venue":null,"work_id":"ce979969-6694-4597-b48f-48ad6ed39009","year":2023},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.492336Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:77a735540013d4572d730f4ee2d3ab3542dce647b1b48f51e3514ba5f5518c0a","observation_id":"654ae170-2358-4d99-874b-ea1b6f4f9f42","resolution":{"observed_at":"2026-08-07T12:59:25.183689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16198","last_updated":"2024-10-21T17:00:06Z","snapshot_observed_at":"2026-08-08T03:30:51.616377Z","submitted_at":"2024-10-21T17:00:06Z","title":"Improve Vision Language Model Chain-of-thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16198","snapshot_observed_at":"2026-08-07T12:59:20.586668Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.586668Z"},"links":{"cited_paper":"/paper/2410.16198","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:9e65834c5617149ba8dd837e613fa08f6d18085ae1d4028b1e3829764964540d","observation_id":"bbc362b5-e8fe-4c70-8155-8d80da3ff91d","resolution":{"observed_at":"2026-08-07T12:59:20.586668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:24.983137Z","title":null,"venue":null,"work_id":"b118308e-4c4f-41ee-bc23-65de94c20ee9","year":2022},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.666995Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:ddbe4d72a0f8dbb0adedb897104be21c80c581a0468524c2471e3b8c757a4997","observation_id":"55887e46-2bf9-4415-9ab0-450044554533","resolution":{"observed_at":"2026-08-07T12:59:25.067268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T12:59:20.808202Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.808202Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:fc2a10898ccc879bd2f5f605f229035adf4498988f34412726c9b6e5e4e260d4","observation_id":"31096d2e-7c27-41ac-a0ea-5011229d128f","resolution":{"observed_at":"2026-08-07T12:59:20.808202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03981","last_updated":"2025-05-06T21:08:27Z","snapshot_observed_at":"2026-08-07T15:49:23.234741Z","submitted_at":"2025-05-06T21:08:27Z","title":"X-Reasoner: Towards Generalizable Reasoning Across Modalities and Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03981","snapshot_observed_at":"2026-08-07T12:59:20.896118Z","title":"Zhang, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.896118Z"},"links":{"cited_paper":"/paper/2505.03981","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:8d1b8a6a019a710a2c88af5c2269134856dde36235ced8bdab24d181302783f6","observation_id":"1f49ad59-bbbc-40c1-8dd9-2b7c2e7e9b40","resolution":{"observed_at":"2026-08-07T12:59:20.896118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T12:59:20.994541Z","title":"Zhang, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:20.994541Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:f67b7e70f33742b8d529930e1146bed31895d8e8369ba09bd0ce3a1e1a629be7","observation_id":"e4014433-8b02-47a4-84e6-9bccf0045322","resolution":{"observed_at":"2026-08-07T12:59:20.994541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:24.784499Z","title":null,"venue":null,"work_id":"c733bb82-4473-4936-a9bd-12d788dac68a","year":2021},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.107805Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:74991a2ceea3d704ef8b93fa4548867ba50f531afad1e19a071000a8a08a2959","observation_id":"5415c9ba-dfb6-4ca7-98f3-f57147b36ef6","resolution":{"observed_at":"2026-08-07T12:59:24.879439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.09848","last_updated":"2019-03-26T12:39:04Z","snapshot_observed_at":"2026-08-06T17:53:06.711251Z","submitted_at":"2019-03-23T17:33:38Z","title":"Competence-based Curriculum Learning for Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.09848","snapshot_observed_at":"2026-08-07T12:59:21.225659Z","title":null,"venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.225659Z"},"links":{"cited_paper":"/paper/1903.09848","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:cf8e54066eb8ce54ca64540ab8a1e28f3444f08688e6b7560cb590a8c27f7c1f","observation_id":"be86a894-3054-417b-b73c-fc6fb900a8d4","resolution":{"observed_at":"2026-08-07T12:59:21.225659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:59:21.343445Z","title":"Wolski, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.343445Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:0f0f548c0f124b86e4aa1ae3a7cb7a661bf06241771f7e3064d80afb3821de23","observation_id":"975416c1-4126-4765-a05e-f68e8aa722fc","resolution":{"observed_at":"2026-08-07T12:59:21.343445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07089","last_updated":"2025-06-02T09:38:26Z","snapshot_observed_at":"2026-08-07T21:01:40.617151Z","submitted_at":"2025-04-09T17:58:58Z","title":"OmniCaptioner: One Captioner to Rule Them All","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07089","snapshot_observed_at":"2026-08-07T12:59:21.482694Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.482694Z"},"links":{"cited_paper":"/paper/2504.07089","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:7a7ce2d9a61bfaa5132a5147f5f08b71589e5fa48c6f83ba6deb7538c5cb3559","observation_id":"dfb51c60-7593-4a3c-a539-9c0f8e795978","resolution":{"observed_at":"2026-08-07T12:59:21.482694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T12:59:21.585019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.585019Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:828c9a3b9b0eaad2b7a1355f1c7824ad61f445c68b80a5bf7614afee6496edb3","observation_id":"e0a63174-7431-42af-8c92-dd95f1880b22","resolution":{"observed_at":"2026-08-07T12:59:21.585019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:24.615846Z","title":null,"venue":null,"work_id":"14416ddc-d217-435c-8b9f-628c3b3fad56","year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.742628Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:5efb94b6cd9791aec5a15a6568c446b1680145e127057b44bfd434cffa00a147","observation_id":"699b119a-0813-4c66-8920-4c58e0225a34","resolution":{"observed_at":"2026-08-07T12:59:24.706564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-07T12:59:21.841015Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.841015Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:53715fd956bdeda3f0bef1871da1ee431b07c7c358b856ecb3726ea51b97118c","observation_id":"c93cfb6a-aad6-46df-8592-84352ab045ac","resolution":{"observed_at":"2026-08-07T12:59:21.841015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10460","last_updated":"2025-05-28T12:32:29Z","snapshot_observed_at":"2026-08-08T01:11:14.602172Z","submitted_at":"2025-03-13T15:29:22Z","title":"Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10460","snapshot_observed_at":"2026-08-07T12:59:21.956041Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:21.956041Z"},"links":{"cited_paper":"/paper/2503.10460","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:5fec4044c268b50e2b1b97ca60735073b1fed2373db0df03db57b76e35f307de","observation_id":"40d1d414-ca7a-4e9a-8d5a-2ee63473299f","resolution":{"observed_at":"2026-08-07T12:59:21.956041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:24.425773Z","title":"Zhang, W","venue":null,"work_id":"f684b508-6098-4b41-b0db-4b0936f40b09","year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.076981Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:a1836583801e9e4de2f0d606027a14be4378e770441337d4eaead6a421c1c456","observation_id":"deb10754-20f1-4f67-b05d-d636b3530df1","resolution":{"observed_at":"2026-08-07T12:59:24.519630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:24.172653Z","title":"Jiang, Y","venue":null,"work_id":"947f6cb1-1e27-4fdb-b0ed-b8a113df7b27","year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.208111Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:40fc65f1b24f36cfc716f9dd47918cfa93ab55940704e7f159b9c932ca2bf450","observation_id":"97be1d3a-03fc-41f3-a6e9-d4326a340a24","resolution":{"observed_at":"2026-08-07T12:59:24.272710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:22.296769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.296769Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:1b3e4610dc7ab2bd19fe315039987744bbe77cf33177fe50e0bdb34b2c8ea998","observation_id":"83d0c1a8-6092-48b4-858e-ac0f90b51c9e","resolution":{"observed_at":"2026-08-07T12:59:22.296769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:23.946559Z","title":null,"venue":null,"work_id":"024375db-2490-4bbd-942e-324be5a3c1c0","year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.365820Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:e39ce51dfbe3c9bb7c7cb8dadaeed8ba1328d7b027242266f76baf9a7d06f9e0","observation_id":"8f977acf-2f75-4a43-af1b-84457d8b858c","resolution":{"observed_at":"2026-08-07T12:59:24.038461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:23.725033Z","title":"Bansal, T","venue":null,"work_id":"558ba8da-3584-4b08-bcc9-f3a3ac2ac963","year":null},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.459073Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:ed3f7e25eec0bbfbe02d9cc973d1ba36166672d35a40192e00f3bf8d47b3876d","observation_id":"795d9b8f-73d6-49f7-b812-0e8a96d55842","resolution":{"observed_at":"2026-08-07T12:59:23.844769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T12:59:22.596946Z","title":"Lerer, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.596946Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:0d4980bc7d9eb46f548b7ccd4bfae61cc60e7d6143f34ebafe3cfc14b204e2a4","observation_id":"1ca04bda-1f1b-44e7-b44d-3c3c52e73e67","resolution":{"observed_at":"2026-08-07T12:59:22.596946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:59:22.692295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.692295Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:216c44923fb55fd642a3aecfa06318547ae5f54ae7e0b8ba345061f7bc727f2a","observation_id":"7da94750-5079-4bce-b70c-4ae33764ce60","resolution":{"observed_at":"2026-08-07T12:59:22.692295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-08T00:04:35.299538Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T12:59:22.779575Z","title":"Huang, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.779575Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:e7a7a8bad7e66fcc52831e1502524bfe94a93874a6be256a4e5e76cd99f3c7de","observation_id":"3e0959b3-67cf-4dbc-b435-144b138447c1","resolution":{"observed_at":"2026-08-07T12:59:22.779575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T12:59:22.902200Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:22.902200Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:8174a1e93d7b6694c97597616938289e3d8e575dca244880bfaa176e3256894f","observation_id":"064d151c-f6d6-48f8-abe0-6684ee452d39","resolution":{"observed_at":"2026-08-07T12:59:22.902200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:59:23.018390Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:23.018390Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:da674bc973525ff7523d388a9c00cbff3bfc8b49460172afeadba4ae6c94521a","observation_id":"93489210-a930-4f3e-b293-6f091b59bba1","resolution":{"observed_at":"2026-08-07T12:59:23.018390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:23.141014Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:23.141014Z"},"links":{"citing_paper":"/paper/2505.23091"},"observation_digest":"sha256:32426e6e1c218fa5e39cb4f36e82cf5165d7b3955495aab341ebaf9b907df5fd","observation_id":"8f16e8fb-f784-4672-a0c3-8e0d2dff52f7","resolution":{"observed_at":"2026-08-07T12:59:23.141014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23091","last_updated":"2025-06-23T08:47:25Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:05:53.204971Z","submitted_at":"2025-05-29T04:51:56Z","title":"Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 4 inbound Pith citation observations for arXiv:2505.23091."}