{"as_of":"2026-08-22T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a226ef30747eedb11e2ecb6443eed20a7a7040a3e70d05a90f7fa5bd6b57b625","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":48,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:12:18.669805Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T11:41:02.675605Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-16T05:12:18.669805Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21277","last_updated":"2025-05-21T06:08:31Z","snapshot_observed_at":"2026-08-21T11:45:05.225710Z","submitted_at":"2025-04-30T03:14:28Z","title":"Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models","version":2},"reference_index":134,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:18.669805Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2504.21277"},"observation_digest":"sha256:9551d26ceb0c284435494743c13e277488f72a9f7e7768e5fc0096e08c400048","observation_id":"ae8d8474-6395-471d-9ed2-dad6e7b3dcb0","resolution":{"observed_at":"2026-08-16T05:12:18.669805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T15:42:56.467361Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14231","last_updated":"2025-05-20T11:40:43Z","snapshot_observed_at":"2026-08-19T19:20:03.422136Z","submitted_at":"2025-05-20T11:40:43Z","title":"UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:56.467361Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.14231"},"observation_digest":"sha256:fcdf8575b26eec9c7522553797ebaf7807ec0c849d67f884347719c4a070a508","observation_id":"3363e78c-dbd3-49b5-a566-eea2ce310682","resolution":{"observed_at":"2026-08-07T15:42:56.467361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T14:49:07.789675Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-16T18:16:09.696569Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:07.789675Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:583b9f88a6ca9bb4669efe7f177555cafbada261326d46642a2a9e84226a0039","observation_id":"131b1d12-7e74-488f-9639-5a66260a5684","resolution":{"observed_at":"2026-08-07T14:49:07.789675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T14:31:16.116604Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-16T23:13:31.947741Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:16.116604Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:f580d9b817743566e466e663255b8c13d7e1a7233a77262b73724b02a6883f37","observation_id":"54ee01f6-ba4b-4c0a-bea4-e51e7d7f9665","resolution":{"observed_at":"2026-08-07T14:31:16.116604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T13:24:54.235680Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22019","last_updated":"2025-06-03T05:28:55Z","snapshot_observed_at":"2026-08-17T09:42:33.328787Z","submitted_at":"2025-05-28T06:30:51Z","title":"VRAG-RL: Empower Vision-Perception-Based RAG for Visually Rich Information Understanding via Iterative Reasoning with Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:54.235680Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.22019"},"observation_digest":"sha256:e6e79b3f788d42cc546d9c1e19160ddb8903b141426fb64398b21fd7bedd740d","observation_id":"512576cf-8bdd-4828-88db-3d113f7ce37f","resolution":{"observed_at":"2026-08-07T13:24:54.235680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T13:12:58.487945Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22334","last_updated":"2025-07-23T07:37:08Z","snapshot_observed_at":"2026-08-18T08:49:01.935048Z","submitted_at":"2025-05-28T13:21:38Z","title":"Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:58.487945Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.22334"},"observation_digest":"sha256:75be24433d3d027cedc6339e15d18e4e4e53417492a9ea4624519bbb05ed570a","observation_id":"d68c3269-b1d9-48f9-8ace-48cd4b1d7387","resolution":{"observed_at":"2026-08-07T13:12:58.487945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T12:35:46.108172Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24863","last_updated":"2025-05-30T17:58:36Z","snapshot_observed_at":"2026-08-20T12:36:21.991307Z","submitted_at":"2025-05-30T17:58:36Z","title":"AlphaOne: Reasoning Models Thinking Slow and Fast at Test Time","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:46.108172Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2505.24863"},"observation_digest":"sha256:bb18ffe4e7856c11c1b546afa58bf1c20930d9c98710531f0d2cfd7850daa68d","observation_id":"3a2ae015-0241-454b-8d78-6ab933a81cb4","resolution":{"observed_at":"2026-08-07T12:35:46.108172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T10:55:14.875009Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-16T17:02:27.821392Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:55:14.875009Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2506.04034"},"observation_digest":"sha256:6f94d3626c619d79f22974d26ca8bd1a53415c6ccc5492f051e115afa2af6bad","observation_id":"f6575182-2a03-4c9a-a160-4fad195fd962","resolution":{"observed_at":"2026-08-07T10:55:14.875009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T05:27:05.125750Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07905","last_updated":"2025-06-09T16:20:54Z","snapshot_observed_at":"2026-08-17T18:35:49.211491Z","submitted_at":"2025-06-09T16:20:54Z","title":"WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:05.125750Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2506.07905"},"observation_digest":"sha256:75c350e945b8d96e4325a9c3076bcfd362283ce25eaab6a056286310e8c77f4a","observation_id":"d120e7ae-903b-489a-aa89-14f38d5d8a2f","resolution":{"observed_at":"2026-08-07T05:27:05.125750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-15T20:07:32.911052Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13363","last_updated":"2025-06-16T11:10:25Z","snapshot_observed_at":"2026-08-19T10:05:20.964979Z","submitted_at":"2025-06-16T11:10:25Z","title":"Efficient Medical VIE via Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T20:07:32.911052Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2506.13363"},"observation_digest":"sha256:59e68820a6957f31d1964de4f0336812b414d14d89d64718c2d870693f626e5a","observation_id":"b2f7a081-d9ec-4414-bb4c-2ecd80e87187","resolution":{"observed_at":"2026-08-15T20:07:32.911052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-07T00:13:38.613601Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14907","last_updated":"2025-06-17T18:25:56Z","snapshot_observed_at":"2026-08-18T19:23:57.125565Z","submitted_at":"2025-06-17T18:25:56Z","title":"PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:38.613601Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2506.14907"},"observation_digest":"sha256:eac58495928a83eede18c1c6c764296bce495e21bad2a036ae9775e3d16cb523","observation_id":"318971f5-3c8e-4986-9e14-17882b99da2e","resolution":{"observed_at":"2026-08-07T00:13:38.613601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2507.00748","last_updated":"2026-04-12T11:20:16Z","snapshot_observed_at":"2026-08-14T18:19:57.659492Z","submitted_at":"2025-07-01T13:48:57Z","title":"Improving the Reasoning of Multi-Image Grounding in MLLMs via Reinforcement Learning","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T06:50:02.607136Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2507.00748"},"observation_digest":"sha256:dd0fdcf30eb7c0030f7971ae7c1e4b947baf6eae27f77ac61b4c44d00fbc945d","observation_id":"b5c2021d-9678-414a-904f-2e5d2f55041b","resolution":{"observed_at":"2026-05-19T06:52:07.981908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-05T23:29:16.461188Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05383","last_updated":"2025-08-07T13:31:21Z","snapshot_observed_at":"2026-08-16T02:43:13.171373Z","submitted_at":"2025-08-07T13:31:21Z","title":"StructVRM: Aligning Multimodal Reasoning with Structured and Verifiable Reward Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:29:16.461188Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2508.05383"},"observation_digest":"sha256:2638353116bbea024bffea19f2d021b5cb0794ad6aaa06b6178e56a9f1bffc0c","observation_id":"ca86a00a-d62e-4365-a261-53a173b04924","resolution":{"observed_at":"2026-08-05T23:29:16.461188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-05T23:25:49.286524Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05388","last_updated":"2025-08-07T13:38:49Z","snapshot_observed_at":"2026-08-06T12:42:41.700036Z","submitted_at":"2025-08-07T13:38:49Z","title":"An Explainable Machine Learning Framework for Railway Predictive Maintenance using Data Streams from the Metro Operator of Portugal","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:25:49.286524Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2508.05388"},"observation_digest":"sha256:08bcc87e773128d2b15dd35e684069add7ec58d8e68d71b8d8b11df55e22224a","observation_id":"05bd08eb-7222-4cb6-880d-87c3c8d19e68","resolution":{"observed_at":"2026-08-05T23:25:49.286524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-04T08:15:58.361229Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21978","last_updated":"2026-06-18T16:29:38Z","snapshot_observed_at":"2026-08-13T02:25:37.938690Z","submitted_at":"2025-10-24T19:08:48Z","title":"Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models","version":2},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-04T08:15:58.361229Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2510.21978"},"observation_digest":"sha256:42dc83e7e60eb7c424d07abb03537d2e84969582eb2b9d78e55c441fd68c725c","observation_id":"b47c1fe3-3739-4914-b810-0b8a7b30ce6a","resolution":{"observed_at":"2026-08-04T08:15:58.361229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2511.11113","last_updated":"2026-04-20T07:37:36Z","snapshot_observed_at":"2026-08-09T22:36:48.890275Z","submitted_at":"2025-11-14T09:42:42Z","title":"VIDEOP2R: Video Understanding from Perception to Reasoning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-17T22:24:41.760120Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2511.11113"},"observation_digest":"sha256:8e51b501c171bae40e1a14ff77760241637a772a9bc034d4d672954903dedfa9","observation_id":"09e4aa05-6496-48db-a02d-4fc0d6edfcf2","resolution":{"observed_at":"2026-05-17T22:25:22.654708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2512.03043","last_updated":"2026-04-28T12:07:36Z","snapshot_observed_at":"2026-08-13T15:37:47.305433Z","submitted_at":"2025-12-02T18:59:52Z","title":"OneThinker: All-in-one Reasoning Model for Image and Video","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T02:09:39.820651Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2512.03043"},"observation_digest":"sha256:447c49750ce77d6d832f25563551fe5d7873a767fc9afb1b0a15826e06275045","observation_id":"2865d547-2a01-4168-afe4-567ee1a15d04","resolution":{"observed_at":"2026-05-17T02:11:26.599580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-03T18:15:08.183639Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.06276","last_updated":"2026-07-28T07:07:11Z","snapshot_observed_at":"2026-08-15T01:13:36.123242Z","submitted_at":"2025-12-06T03:59:21Z","title":"RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T18:15:08.183639Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2512.06276"},"observation_digest":"sha256:9ccc434aaee37f965dc3754b1cb183bcb9546862281b453db3f55c5026273c47","observation_id":"2dd413a9-b3c8-492c-8eac-b7f26b238764","resolution":{"observed_at":"2026-08-03T18:15:08.183639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2512.06721","last_updated":"2026-05-07T12:58:39Z","snapshot_observed_at":"2026-08-12T21:41:38.158777Z","submitted_at":"2025-12-07T08:21:07Z","title":"ProAgent: Harnessing On-Demand Sensory Contexts for Proactive LLM Agent Systems in the Wild","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T00:38:54.001341Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2512.06721"},"observation_digest":"sha256:2e497f1503dc454dd36b781eb530f96e0ba751434c7cd05858c01de4d3209224","observation_id":"71fe76fd-1a14-4f4b-bde2-9582ca997613","resolution":{"observed_at":"2026-05-17T00:41:24.002284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-03T12:31:20.389170Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02918","last_updated":"2026-08-20T10:10:30Z","snapshot_observed_at":"2026-08-22T18:13:17.928241Z","submitted_at":"2026-01-06T11:00:17Z","title":"Zoom-IQA: Image Quality Assessment with Reliable Region-Aware Reasoning","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T12:31:20.389170Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2601.02918"},"observation_digest":"sha256:2837afe95707352ef38e6b39f97275453956682af4e7869e3ced61be443e9493","observation_id":"7a2cbe96-a7ea-458a-8649-21e4cc364f6a","resolution":{"observed_at":"2026-08-03T12:31:20.389170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2601.06993","last_updated":"2026-04-10T19:45:13Z","snapshot_observed_at":"2026-08-14T17:07:02.674582Z","submitted_at":"2026-01-11T17:07:47Z","title":"Can Textual Reasoning Improve the Performance of MLLMs on Fine-grained Visual Classification?","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T14:51:26.368439Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2601.06993"},"observation_digest":"sha256:50c6a2cc469725bfbed02e2a96a1c7e5905cbed748094bc38c9b126de05888d0","observation_id":"1d764c15-923c-4e85-99a5-88fa76f4428e","resolution":{"observed_at":"2026-05-16T14:53:00.616722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2602.00181","last_updated":"2026-04-14T16:44:13Z","snapshot_observed_at":"2026-08-15T21:28:05.921564Z","submitted_at":"2026-01-30T04:45:43Z","title":"CamReasoner: Reinforcing Camera Movement Understanding via Structured Spatial Reasoning","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T10:02:20.477517Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2602.00181"},"observation_digest":"sha256:3333cdd6e7e2045a56e8693517a7f58a32d603ca8d39a4686b3c016a1f9ce7dc","observation_id":"134255b6-36c8-4b8f-ab2e-40551bd5d901","resolution":{"observed_at":"2026-05-16T10:02:42.508887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-02T19:57:33.519473Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06652","last_updated":"2026-06-11T03:22:36Z","snapshot_observed_at":"2026-08-14T07:03:59.496846Z","submitted_at":"2026-02-28T04:33:11Z","title":"PaLMR: Towards Faithful Visual Reasoning via Multimodal Process Alignment","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T19:57:33.519473Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2603.06652"},"observation_digest":"sha256:a6242dbd828e7000bdd5de0ef9d90d77a8cf9916e2b52fda229c41d4198569bc","observation_id":"1453a838-9af6-498b-a1f3-d2f3aca6e466","resolution":{"observed_at":"2026-08-02T19:57:33.519473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-14T23:22:13.847876Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning.arXiv preprint arXiv:2504.07954,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.10757","last_updated":"2026-06-20T10:12:15Z","snapshot_observed_at":"2026-08-13T21:01:04.544839Z","submitted_at":"2026-03-11T13:32:58Z","title":"CodePercept: Code-Grounded Visual STEM Perception for MLLMs","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-14T23:22:13.847876Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2603.10757"},"observation_digest":"sha256:b899eddade2bae720f0a77386f467ab7a4fd270c5638765c2d0d675fcd2f3f1a","observation_id":"653f93b5-ec73-4dff-97e5-21730460aae8","resolution":{"observed_at":"2026-07-14T23:22:13.847876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.03307","last_updated":"2026-04-16T08:04:16Z","snapshot_observed_at":"2026-08-17T00:04:40.616003Z","submitted_at":"2026-03-31T03:57:56Z","title":"V-Reflection: Transforming MLLMs from Passive Observers to Active Interrogators","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T23:57:47.657243Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.03307"},"observation_digest":"sha256:c1005c434a7c7c6d292c7ad2e9a3b5dec3bcb3adc02f354855597f35de09b2b2","observation_id":"83b88eaf-9ed7-4802-aeb5-e0b6c180f8db","resolution":{"observed_at":"2026-05-13T23:58:28.586668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.08545","last_updated":"2026-04-09T17:59:57Z","snapshot_observed_at":"2026-08-21T00:53:35.266454Z","submitted_at":"2026-04-09T17:59:57Z","title":"Act Wisely: Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T18:35:21.514502Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.08545"},"observation_digest":"sha256:376be54e5197533c4aeb7ad430adf4e789b0d844dbb545d667629489096b2ecd","observation_id":"03360d8f-d0ee-411e-aba6-b93696797b5d","resolution":{"observed_at":"2026-05-11T00:20:53.791165Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.18483","last_updated":"2026-07-01T12:23:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T16:35:57Z","title":"Steadily moving semi-infinite fracture in plane poroelasticity","version":2},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-07-05T11:39:05.686584Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.18483"},"observation_digest":"sha256:4df00bba5e9fef60d525e365fbbbee5d9ebfd9258f4dc1dd9f79395518d9aa23","observation_id":"471b1c4a-5dc7-4667-8d48-6679a0729125","resolution":{"observed_at":"2026-07-05T11:41:02.677026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.18484","last_updated":"2026-04-20T16:37:16Z","snapshot_observed_at":"2026-08-16T04:03:07.239582Z","submitted_at":"2026-04-20T16:37:16Z","title":"XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-10T05:46:36.865150Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.18484"},"observation_digest":"sha256:f3555110dd7b412da5b99752c2e5b7699c9691fef39e3ff71cafd9b2ed5aed1f","observation_id":"1b3b8c61-45ed-4b6e-b32b-58230ffa91b3","resolution":{"observed_at":"2026-05-10T05:51:10.303502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.20705","last_updated":"2026-04-22T15:46:42Z","snapshot_observed_at":"2026-08-15T22:24:27.472726Z","submitted_at":"2026-04-22T15:46:42Z","title":"SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T01:23:32.849326Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.20705"},"observation_digest":"sha256:40c3c79d0553b6108391399954fdfc07ad8245635e28549ed1a16bdebb321810","observation_id":"013d3648-2590-407f-9943-9e8bc8b7be78","resolution":{"observed_at":"2026-05-11T13:36:08.633735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2604.22498","last_updated":"2026-04-24T12:26:49Z","snapshot_observed_at":"2026-08-11T13:39:31.014053Z","submitted_at":"2026-04-24T12:26:49Z","title":"CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T12:26:01.568507Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2604.22498"},"observation_digest":"sha256:05c0e4017940b3a9ecaa0ab08c9e40d79122f1ce836fb7b08cda8dcfde08bc2c","observation_id":"754de6ce-fdbc-4d95-8492-d22ba9e68312","resolution":{"observed_at":"2026-05-11T19:16:08.342294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.01402","last_updated":"2026-05-11T02:53:21Z","snapshot_observed_at":"2026-08-14T21:45:49.748028Z","submitted_at":"2026-05-02T11:49:03Z","title":"Injecting Distributional Awareness into MLLMs via Reinforcement Learning for Deep Imbalanced Regression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-09T14:36:29.666730Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.01402"},"observation_digest":"sha256:8ff8a29406cfaeed6b8d69dc65faeda218ec537a578d56be5326291154539083","observation_id":"3bc4e86f-2a6c-4127-9d6a-d4392f44e1d4","resolution":{"observed_at":"2026-05-11T16:51:09.309286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.01402","last_updated":"2026-05-11T02:53:21Z","snapshot_observed_at":"2026-08-14T21:45:49.748028Z","submitted_at":"2026-05-02T11:49:03Z","title":"Injecting Distributional Awareness into MLLMs via Reinforcement Learning for Deep Imbalanced Regression","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T04:52:09.685243Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.01402"},"observation_digest":"sha256:40799fb5dafa498c641b19727db0ebf76f03015493ae0bcb6b0a56b9dd22bfc1","observation_id":"9cc4566b-bd7b-40b5-8c5a-6c53122a417a","resolution":{"observed_at":"2026-05-12T05:51:26.126862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T07:14:48.918959Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:168f276f0e6cac46820d080375659f8a7598723a1982094cef091abb538ccc85","observation_id":"a9c3f915-f5ba-46bf-b7f4-de634d8f2efa","resolution":{"observed_at":"2026-05-13T07:17:29.071938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-14T21:47:50.595481Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:9aa6e93f84e18f6e8254c0338648d7652ff9c4bbc6ba6bba657ec487c94d43a5","observation_id":"aede9686-4b49-444d-97bf-70e3bd2a780f","resolution":{"observed_at":"2026-05-14T21:48:00.502847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.14068","last_updated":"2026-05-15T18:52:42Z","snapshot_observed_at":"2026-08-05T10:58:54.115730Z","submitted_at":"2026-05-13T19:46:22Z","title":"CurveBench: A Benchmark for Exact Topological Reasoning over Nested Jordan Curves","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-15T05:35:02.980473Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.14068"},"observation_digest":"sha256:a2f556a66950367fb4167b436097e1e0be1ceb2bb2df3df4c243f5e19d06ee84","observation_id":"739c202d-54a7-48c9-a7a5-0a7ededea585","resolution":{"observed_at":"2026-05-15T05:39:48.044228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.14068","last_updated":"2026-05-15T18:52:42Z","snapshot_observed_at":"2026-08-05T10:58:54.115730Z","submitted_at":"2026-05-13T19:46:22Z","title":"CurveBench: A Benchmark for Exact Topological Reasoning over Nested Jordan Curves","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T20:40:47.750678Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.14068"},"observation_digest":"sha256:013e99a5dc8920310a74b43c9e52c1ee3f5d4fa82a193aed7433a3e95330dad6","observation_id":"c1c34f59-9dc7-4120-afc6-d10ba06562ba","resolution":{"observed_at":"2026-05-20T20:43:43.444374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.16079","last_updated":"2026-05-15T15:43:28Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T15:43:28Z","title":"VideoSeeker: Incentivizing Instance-level Video Understanding via Native Agentic Tool Invocation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T19:37:09.244578Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.16079"},"observation_digest":"sha256:88f1179482080991233a66ea8ffc449aa3bf0d927c7fcc6798fffd2644a35795","observation_id":"048032d9-4f39-43d3-b943-7d2ca08caca8","resolution":{"observed_at":"2026-05-20T19:38:56.151767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.18903","last_updated":"2026-05-17T13:26:09Z","snapshot_observed_at":"2026-08-15T02:25:30.143493Z","submitted_at":"2026-05-17T13:26:09Z","title":"Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T13:29:11.509966Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.18903"},"observation_digest":"sha256:5b061aeec93484fb998774b9030d5238fb588179e03cb1571bb3edb10de76847","observation_id":"772dcefb-41e5-4bf0-9feb-5315db61efca","resolution":{"observed_at":"2026-05-20T13:33:19.317425Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.20165","last_updated":"2026-05-19T17:50:25Z","snapshot_observed_at":"2026-08-15T00:00:35.968759Z","submitted_at":"2026-05-19T17:50:25Z","title":"CaMo: Camera Motion Grounded Evaluation and Training for Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-20T05:27:30.938311Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.20165"},"observation_digest":"sha256:9e2915dcbbb6df892c1e3b88355f5a43a4fca1e72b7085b201b42f0f4519d5ae","observation_id":"c023d8d4-1963-497e-8158-a53ef0397e09","resolution":{"observed_at":"2026-05-20T05:28:04.573557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2605.29198","last_updated":"2026-05-29T15:12:05Z","snapshot_observed_at":"2026-07-06T23:38:37.178378Z","submitted_at":"2026-05-28T00:17:49Z","title":"Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T08:59:03.375697Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2605.29198"},"observation_digest":"sha256:0496d6bc70b8e5f07c4e5cad956699813461dae9fbdb743ca1289bba30b289dc","observation_id":"8c666529-1689-4752-93a3-7448513c3cd5","resolution":{"observed_at":"2026-06-29T09:03:15.876522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2606.26196","last_updated":"2026-06-24T15:20:32Z","snapshot_observed_at":"2026-08-17T15:34:17.600386Z","submitted_at":"2026-06-24T15:20:32Z","title":"From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models","version":1},"reference_index":171,"source":"pdf_text","source_observed_at":"2026-06-26T01:50:54.242508Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2606.26196"},"observation_digest":"sha256:bf24f3107567447c867c27302fa756669761d94e2299b1d2ffd7482298a9e744","observation_id":"3c63fc7a-baf4-4113-8d65-f3e6dcbb0f01","resolution":{"observed_at":"2026-07-04T15:09:54.977454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.07954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-05T11:41:02.675605Z","title":"arXiv preprint arXiv:2504.07954 , year =","venue":"cs.CV","work_id":"35656592-ffc7-4aef-9baf-0f8694c0c987","year":2025},"citing_paper":{"arxiv_id":"2607.01191","last_updated":"2026-07-01T17:24:26Z","snapshot_observed_at":"2026-08-16T22:04:44.997946Z","submitted_at":"2026-07-01T17:24:26Z","title":"Perceive-to-Reason: Decoupling Perception and Reasoning for Fine-Grained Visual Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-02T13:24:17.538850Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2607.01191"},"observation_digest":"sha256:51aaf382cc9a81b3a8f20ff95654ec23280f4e6805463c3d5b67fa8b734c0bea","observation_id":"00dc9687-0d54-45e4-9029-c3c156ae5d36","resolution":{"observed_at":"2026-07-02T13:26:58.415910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-07-12T11:31:14.532101Z","title":"Perception-r1: Pioneering perception policy with reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02551","last_updated":"2026-06-26T16:05:57Z","snapshot_observed_at":"2026-08-19T20:30:06.172935Z","submitted_at":"2026-06-26T16:05:57Z","title":"DELTAVID: Enhancing Fine-Grained Spatiotemporal Perception with Cross-Video Differences","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-12T11:31:14.532101Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2607.02551"},"observation_digest":"sha256:5673bb55ff00e5192b05f11cfd94ccb436eb5a84ca01ca1dcbed67c489e78a92","observation_id":"35d974e9-fbad-4f29-9edf-19989a11d0e1","resolution":{"observed_at":"2026-07-12T11:31:14.532101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-02T01:25:28.694126Z","title":"arXiv preprint arXiv:2504.07954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14682","last_updated":"2026-07-16T07:43:39Z","snapshot_observed_at":"2026-08-17T01:29:14.073081Z","submitted_at":"2026-07-16T07:43:39Z","title":"Stop Thinking, Start Looking: Efficient Post-Training for Multimodal Document Question Answering via Reasoning-Free Alignment","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T01:25:28.694126Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2607.14682"},"observation_digest":"sha256:1c3162fc6bc33dbe6ca6433afefe472fff3f3868db52fee2305220dbf402d1cd","observation_id":"54621a2c-7471-45b4-94fc-9b72a41f2ae0","resolution":{"observed_at":"2026-08-02T01:25:28.694126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-01T22:32:28.980145Z","title":"arXiv preprint arXiv:2504.07954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15732","last_updated":"2026-08-14T05:05:03Z","snapshot_observed_at":"2026-08-19T23:09:22.971665Z","submitted_at":"2026-07-17T08:13:01Z","title":"IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-08-01T22:32:28.980145Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2607.15732"},"observation_digest":"sha256:dc44fa763e1e18ca818c40d7dbbd7174ff903f5e8801991ef17b17ca5fea332b","observation_id":"141dcf71-7f39-4c77-a1a5-63b7bb52163e","resolution":{"observed_at":"2026-08-01T22:32:28.980145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-04T04:21:09.633302Z","title":"arXiv preprint arXiv:2504.07954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15732","last_updated":"2026-08-14T05:05:03Z","snapshot_observed_at":"2026-08-19T23:09:22.971665Z","submitted_at":"2026-07-17T08:13:01Z","title":"IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models","version":2},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-08-04T04:21:09.633302Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2607.15732"},"observation_digest":"sha256:1e01c551ab6b562274a52685ebc14b3a902473ec36b4a78f8b0c5df60954d9d0","observation_id":"8cb68f21-faca-4452-8d73-7fbfea0e70dc","resolution":{"observed_at":"2026-08-04T04:21:09.633302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-05T18:36:14.869453Z","title":"arXiv preprint arXiv:2504.07954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03471","last_updated":"2026-08-14T04:57:01Z","snapshot_observed_at":"2026-08-19T23:09:25.672455Z","submitted_at":"2026-08-04T11:07:19Z","title":"Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-08-05T18:36:14.869453Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2608.03471"},"observation_digest":"sha256:844064dc1ffe2431d168596f18a6e63c8f867eea6e0388e8c4ed9569f2ae7bb8","observation_id":"86241d39-3a7a-48cf-b4fd-83c5afcb81af","resolution":{"observed_at":"2026-08-05T18:36:14.869453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07954","snapshot_observed_at":"2026-08-16T00:18:18.138194Z","title":"arXiv preprint arXiv:2504.07954 (2025) 14","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12220","last_updated":"2026-08-12T16:14:25Z","snapshot_observed_at":"2026-08-22T16:12:39.312285Z","submitted_at":"2026-08-12T16:14:25Z","title":"SCOUT: Unlocking Enhanced Spatial Reasoning via Structured Chain-of-Thought and Multi-Objective Process Reward","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:18:18.138194Z"},"links":{"cited_paper":"/paper/2504.07954","citing_paper":"/paper/2608.12220"},"observation_digest":"sha256:ef687f7bdd97b7a80d272aac50cbf92d8f69e8ec299301211ecb44f58533e3e5","observation_id":"4189cd70-4d04-4c72-8181-5dc7d919a096","resolution":{"observed_at":"2026-08-16T00:18:18.138194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.07954/citation-record","integrity":"/paper/2504.07954/integrity","json":"/paper/2504.07954/citation-record.json","paper":"/paper/2504.07954"},"outbound":[],"paper":{"arxiv_id":"2504.07954","last_updated":"2025-04-10T17:58:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T12:42:16.250629Z","submitted_at":"2025-04-10T17:58:27Z","title":"Perception-R1: Pioneering Perception Policy with Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 48 inbound Pith citation observations for arXiv:2504.07954."}