{"as_of":"2026-08-07T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a62d334707295383d372025f4ceecb0edf7f528e010eb530e8bc0a7594730e1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:01:37.530069Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:10:08.032034Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T15:01:37.530069Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16673","last_updated":"2025-05-22T13:39:32Z","snapshot_observed_at":"2026-08-07T14:55:04.641472Z","submitted_at":"2025-05-22T13:39:32Z","title":"R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:01:37.530069Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2505.16673"},"observation_digest":"sha256:3ff5246f8d32988bb853c4dc134625bc77599180cd4d9e7f4b43b3f273f96dd0","observation_id":"43041165-440b-400b-96f9-d1d2cafa7e9f","resolution":{"observed_at":"2026-08-07T15:01:37.530069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T14:31:15.321786Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-07T20:39:20.855122Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:15.321786Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:12541c86488816e4ca17f8ed55de32a57ec4ba346d20343fee7636391c763993","observation_id":"00eac3aa-c4fa-40f9-ac6b-2a9297bbe228","resolution":{"observed_at":"2026-08-07T14:31:15.321786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T14:01:22.483974Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20236","last_updated":"2025-05-26T17:16:36Z","snapshot_observed_at":"2026-08-07T13:54:23.640348Z","submitted_at":"2025-05-26T17:16:36Z","title":"Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:01:22.483974Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2505.20236"},"observation_digest":"sha256:1871087a640b5172862be172213e7b56208d854878b634d0ed27b14f7602421a","observation_id":"c52f5b08-33f5-4921-a7eb-fdd7fb77eefd","resolution":{"observed_at":"2026-08-07T14:01:22.483974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T12:01:03.055536Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00855","last_updated":"2025-06-01T06:28:36Z","snapshot_observed_at":"2026-08-07T11:54:17.799870Z","submitted_at":"2025-06-01T06:28:36Z","title":"MedBookVQA: A Systematic and Comprehensive Medical Benchmark Derived from Open-Access Book","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:03.055536Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2506.00855"},"observation_digest":"sha256:8b00fbd14ff00811c442cf24034aa11c91e084703442d3b3dcb3da6b6d71b5fc","observation_id":"7a5d3b8e-0064-4738-9167-8b751905a84a","resolution":{"observed_at":"2026-08-07T12:01:03.055536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T10:55:14.826127Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reason- ing.arXiv preprint arXiv:2504.16656, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-07T10:46:30.489099Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:55:14.826127Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2506.04034"},"observation_digest":"sha256:10fc4a7636a940d525900e18bac517bb043f637fc64e0c78d0dc11ee94bb91d0","observation_id":"b797d668-c259-444f-899a-0e6aa87ddfc8","resolution":{"observed_at":"2026-08-07T10:55:14.826127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T05:27:04.960499Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning.arXiv preprint arXiv:2504.16656, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07905","last_updated":"2025-06-09T16:20:54Z","snapshot_observed_at":"2026-08-07T21:24:53.935343Z","submitted_at":"2025-06-09T16:20:54Z","title":"WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:04.960499Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2506.07905"},"observation_digest":"sha256:2fbfa48032d1b82fcbb4b5961cb6bea6f73d3d1ff64d3731ed1ffe60c06bc4a3","observation_id":"c9527092-abfe-40c2-90fc-066cb510a9a0","resolution":{"observed_at":"2026-08-07T05:27:04.960499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-07T00:40:40.201848Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13066","last_updated":"2025-06-16T03:19:31Z","snapshot_observed_at":"2026-08-07T02:53:10.665842Z","submitted_at":"2025-06-16T03:19:31Z","title":"FinLMM-R1: Enhancing Financial Reasoning in LMM through Scalable Data and Reward Design","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:40.201848Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2506.13066"},"observation_digest":"sha256:3de671bf4f4905aa1d06d2994e9fd4bc1c87c8a0e5ce83e869302c6e0404a88f","observation_id":"822e85af-b74d-4cbe-8011-983260eafac0","resolution":{"observed_at":"2026-08-07T00:40:40.201848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-06T19:14:05.468540Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06167","last_updated":"2025-07-10T15:41:04Z","snapshot_observed_at":"2026-08-07T10:37:03.707334Z","submitted_at":"2025-07-08T16:47:16Z","title":"Skywork-R1V3 Technical Report","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:05.468540Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2507.06167"},"observation_digest":"sha256:1834388e7032c3ed27472f349a79d17d9d59d2408e1d7706007161082f692ab6","observation_id":"37c69bd4-167e-4749-ae2e-08166d75dcbc","resolution":{"observed_at":"2026-08-06T19:14:05.468540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2507.06448","last_updated":"2026-04-14T16:31:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-08T23:22:34Z","title":"Perception-Aware Policy Optimization for Multimodal Reasoning","version":5},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-19T05:11:54.685897Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2507.06448"},"observation_digest":"sha256:1f1871f2152b0faf0708357060e3f94eb8ab8b21ddec4e77fae86772b54923e6","observation_id":"f68c5350-190b-4d9d-8bb9-663afbc9c051","resolution":{"observed_at":"2026-05-19T05:12:04.894974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-06T18:43:13.461715Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learn- ing for reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07562","last_updated":"2025-07-10T09:05:49Z","snapshot_observed_at":"2026-08-07T12:51:50.265761Z","submitted_at":"2025-07-10T09:05:49Z","title":"The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:43:13.461715Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2507.07562"},"observation_digest":"sha256:48e9b2daaf8b99f41ea9fc983558d3aa44d2e69f7af2c578c3704957901bebd4","observation_id":"1c3f7eaa-e072-4070-a191-14f807f18d2d","resolution":{"observed_at":"2026-08-06T18:43:13.461715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-06T11:35:16.929602Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.929602Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:f770fe947aac0c54e7dead730862f88254f39098a78b32eedebcc276b3d6a3ec","observation_id":"7557b985-2c27-4fa3-a62c-bb6b5b8b145b","resolution":{"observed_at":"2026-08-06T11:35:16.929602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-05-10T11:58:58.660564Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2508.18265"},"observation_digest":"sha256:05b46a3e1917801af31e32e8e33d25e6a0d3244132e54240adcf75e502a245c7","observation_id":"4c08be35-c821-4880-8015-d56a3704094c","resolution":{"observed_at":"2026-05-10T11:58:58.831501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:9f3292702f2bd4135791b0bb0579bf2df1cfb92e6433fa63a502ae6fffe352fd","observation_id":"b2df9d6a-be8e-4b2f-ba4f-e856480b8e1c","resolution":{"observed_at":"2026-05-18T19:21:48.436079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2511.19972","last_updated":"2026-05-07T02:58:13Z","snapshot_observed_at":"2026-08-06T20:13:12.622191Z","submitted_at":"2025-11-25T06:31:57Z","title":"Boosting Reasoning in Large Multimodal Models via Activation Replay","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-17T05:05:48.682057Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2511.19972"},"observation_digest":"sha256:0cd89c1fa8b557286a07187264a6ffc5ac4949c74d90b0d7a18353e8ec9cd67a","observation_id":"d23576fd-95c2-4705-993c-d1c6faa8a2bc","resolution":{"observed_at":"2026-05-17T05:09:03.913660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2604.19902","last_updated":"2026-04-21T18:25:25Z","snapshot_observed_at":"2026-08-02T14:48:34.514966Z","submitted_at":"2026-04-21T18:25:25Z","title":"MMCORE: MultiModal COnnection with Representation Aligned Latent Embeddings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T03:27:50.144706Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2604.19902"},"observation_digest":"sha256:833ec4f594427a21d74f827525653526dfc6a9543341bcd109860a6b7b9f7706","observation_id":"b7ae3f4e-507d-498b-8fa1-8a22ed821df6","resolution":{"observed_at":"2026-05-10T03:29:21.666566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2605.07274","last_updated":"2026-05-08T05:37:08Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T05:37:08Z","title":"Structured Role-Aware Policy Optimization for Multimodal Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-11T01:24:20.286120Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2605.07274"},"observation_digest":"sha256:4f947d41876cdb118bd91fab158c58090ce51e120168e289772d4dc3988e1367","observation_id":"58fdb66b-61b1-44cb-b81d-fe39515eeb57","resolution":{"observed_at":"2026-05-11T04:25:58.316033Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2606.23543","last_updated":"2026-06-22T16:17:30Z","snapshot_observed_at":"2026-07-06T23:58:16.163783Z","submitted_at":"2026-06-22T16:17:30Z","title":"VeriEvol: Scaling Multimodal Mathematical Reasoning via Verifiable Evol-Instruct","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T08:34:27.719022Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2606.23543"},"observation_digest":"sha256:e33071c6f88bd4a2cca1bbc2f96743ae95f8786e0efb35d6fe1ad4658dc3263a","observation_id":"d3a16a42-9743-40dd-bb18-c9f6530313e1","resolution":{"observed_at":"2026-07-04T10:39:46.028994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":"2504.16656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-07-04T20:10:08.032034Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":"eb56fa03-88a4-4a9b-b449-b695b39f7832","year":2025},"citing_paper":{"arxiv_id":"2606.25906","last_updated":"2026-06-24T14:54:41Z","snapshot_observed_at":"2026-07-31T02:04:59.749233Z","submitted_at":"2026-06-24T14:54:41Z","title":"OracleAnalyser: Analysing Implicit Semantics of Oracle Bone Scripts through MLLMs with Post-training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-25T20:36:16.927195Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2606.25906"},"observation_digest":"sha256:57c0fb711e99ec20d0fbdbc06a5434088a480c05464c988c242e90a2b1b6176e","observation_id":"19cae604-2808-4b8b-bb41-6ef22e2c502e","resolution":{"observed_at":"2026-07-04T20:10:08.034694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.16656/citation-record","integrity":"/paper/2504.16656/integrity","json":"/paper/2504.16656/citation-record.json","paper":"/paper/2504.16656"},"outbound":[],"paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2504.16656."}