{"as_of":"2026-08-07T08:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ba9dd85a5c1bff2a4ca7f8f231a7708ce5f6f7a748352b7ca35877ce334bca0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:31:13.737069Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2511.05271","last_updated":"2026-03-11T08:46:41Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-07T14:31:20Z","title":"DeepEyesV2: Toward Agentic Multimodal Model","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T05:32:29.266583Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2511.05271"},"observation_digest":"sha256:a1e12931775af414ca815f3b19247af9788bfc8cb1a65151d174193274828d7e","observation_id":"3eebcfac-f75a-4bb9-ba5d-69145ee7db7c","resolution":{"observed_at":"2026-05-16T05:32:29.579338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2512.01843","last_updated":"2026-05-18T11:10:13Z","snapshot_observed_at":"2026-07-06T22:37:26.652349Z","submitted_at":"2025-12-01T16:28:13Z","title":"PhyDetEx: Detecting and Explaining the Physical Plausibility of T2V Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T17:57:57.263574Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2512.01843"},"observation_digest":"sha256:ac3008c32b5360d23f49c9c107df5ab801130040142a7ec9a180a6148a51c135","observation_id":"90e92e39-f412-4ebf-90c2-fb05c19a2c0e","resolution":{"observed_at":"2026-05-21T18:00:27.234207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:a2758534570a712123b27e1433c1a0518b8e3e838a6cb1c153f4237c375b144c","observation_id":"6b6f1835-d10b-4e24-ae05-668478a595b6","resolution":{"observed_at":"2026-05-16T22:38:37.829832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-03T12:31:13.737069Z","title":"VLM-R3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought.arXiv preprint arXiv:2505.16192, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02918","last_updated":"2026-07-09T13:46:12Z","snapshot_observed_at":"2026-08-03T22:15:08.335889Z","submitted_at":"2026-01-06T11:00:17Z","title":"Zoom-IQA: Image Quality Assessment with Reliable Region-Aware Reasoning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T12:31:13.737069Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2601.02918"},"observation_digest":"sha256:1db106726b3655c0c7b4af8b404c5cc40b180c84ec1b4222a3d3d292c14ed055","observation_id":"7bd2ed84-da36-4a67-97fb-fe33e2faaae2","resolution":{"observed_at":"2026-08-03T12:31:13.737069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-02T20:40:30.764822Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for en- hanced multimodal chain-of-thought.arXiv preprint arXiv:2505.16192,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22766","last_updated":"2026-06-07T11:29:15Z","snapshot_observed_at":"2026-08-06T01:15:52.220969Z","submitted_at":"2026-02-26T08:56:23Z","title":"Imagination Helps Visual Reasoning, But Not Yet in Latent Space","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T20:40:30.764822Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2602.22766"},"observation_digest":"sha256:ef66b529505ccc6f3977cdcf8460c570fe99d6f5b4bba3204f3de00be63108a3","observation_id":"a120669a-8048-4583-8d48-6b584cac864b","resolution":{"observed_at":"2026-08-02T20:40:30.764822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2604.02794","last_updated":"2026-04-03T07:02:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T07:02:13Z","title":"CharTool: Tool-Integrated Visual Reasoning for Chart Understanding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-13T20:07:23.153064Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2604.02794"},"observation_digest":"sha256:b34612d7dfedcb0941384cd5304c05d4b8e03101116b949a47574dcc8f957fec","observation_id":"d20484e1-aae1-4b27-946d-95ca8299eeeb","resolution":{"observed_at":"2026-05-13T20:08:12.762712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2604.24339","last_updated":"2026-04-27T11:31:15Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T11:31:15Z","title":"See Further, Think Deeper: Advancing VLM's Reasoning Ability with Low-level Visual Cues and Reflection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T04:46:16.497585Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2604.24339"},"observation_digest":"sha256:8614bd5e53f7925095c82dcd1b08f15db41ae9a3e2d1db335eee22b1ec97d46a","observation_id":"697bb1cf-2eea-47d3-9e26-3cff66cbf941","resolution":{"observed_at":"2026-05-11T21:36:17.630361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.02730","last_updated":"2026-05-04T15:31:11Z","snapshot_observed_at":"2026-08-02T14:48:33.210016Z","submitted_at":"2026-05-04T15:31:11Z","title":"Perceptual Flow Network for Visually Grounded Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T18:40:55.753827Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.02730"},"observation_digest":"sha256:2953d9d7ae301286d51f9df78917cb277f13300a986b9072c8b688b5c4fd43af","observation_id":"8243bba0-66b1-4c28-95a8-0c40596e4190","resolution":{"observed_at":"2026-05-09T06:15:38.910256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.03485","last_updated":"2026-05-05T08:20:48Z","snapshot_observed_at":"2026-07-06T23:16:25.301792Z","submitted_at":"2026-05-05T08:20:48Z","title":"MHPR: Multidimensional Human Perception and Reasoning Benchmark for Large Vision-Languate Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T01:20:54.441367Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.03485"},"observation_digest":"sha256:9fb59036d6250433f13f978e4ff2f826dda4c73572504ea2427b4a2c45d03aee","observation_id":"262f28c4-bf5f-4a80-a590-b54756f9abbb","resolution":{"observed_at":"2026-05-11T23:11:15.625813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.05045","last_updated":"2026-05-10T12:13:49Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T15:41:24Z","title":"When Relations Break: Analyzing Relation Hallucination in Vision-Language Model Under Rotation and Noise","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:40:14.089081Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.05045"},"observation_digest":"sha256:87d5d2130b30d9ed267a6185a7631d0e6c83acae400b6b52cf9447127c103e78","observation_id":"60ec0b92-9072-4c86-9b6b-d5661b39d939","resolution":{"observed_at":"2026-05-11T17:21:09.116990Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.05045","last_updated":"2026-05-10T12:13:49Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T15:41:24Z","title":"When Relations Break: Analyzing Relation Hallucination in Vision-Language Model Under Rotation and Noise","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:52:44.531016Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.05045"},"observation_digest":"sha256:71be02c838c67b9cbe80d09fb1c38f56c9efaccba68ad8788999f4e0e859622d","observation_id":"3f53fdc3-3fd8-4364-a2ed-1beb43ac3a8d","resolution":{"observed_at":"2026-05-12T06:51:29.288270Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T07:14:48.918959Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:53a707b46d5712a3f3c1b625237db49baab8081bfd96dd8245c5e9bdcf602bfb","observation_id":"ed2eb08a-8cf8-4e43-a016-e37db3fc75c4","resolution":{"observed_at":"2026-05-13T07:17:29.145840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:47:50.595481Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:3739a1eb92e9ecbadf98bd5bd102df7ee91e83bc4ef050fa9da7360dff67bf1d","observation_id":"09482764-0ac1-4214-b55c-2cbba6b5b528","resolution":{"observed_at":"2026-05-14T21:48:00.615749Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2606.26631","last_updated":"2026-06-25T05:47:52Z","snapshot_observed_at":"2026-07-07T00:00:56.276365Z","submitted_at":"2026-06-25T05:47:52Z","title":"Position Rebinding Cache Reuse: Replay-Free Visual Revisiting for Interleaved Multimodal Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T05:08:09.884231Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2606.26631"},"observation_digest":"sha256:313880227b003e105dd5ba729caa6d5d7806467ebc41f732a2f6e853171c0352","observation_id":"9f1803a0-0cc1-4b0c-bd37-dce56e429f34","resolution":{"observed_at":"2026-07-04T13:29:52.008722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2606.29672","last_updated":"2026-06-30T11:29:35Z","snapshot_observed_at":"2026-08-07T03:23:21.094365Z","submitted_at":"2026-06-29T00:39:22Z","title":"How LLMs See Creativity: Zero-Shot Scoring of Visual Creativity with Interpretable Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-30T06:50:08.686114Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2606.29672"},"observation_digest":"sha256:9b00bafa888bac91f57964075516bdf1a42ae5d23966eb19cc390caeb9a89a01","observation_id":"00ebaf5f-2631-4fd4-a108-c12080a2a6ef","resolution":{"observed_at":"2026-06-30T06:54:20.015685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2606.29672","last_updated":"2026-06-30T11:29:35Z","snapshot_observed_at":"2026-08-07T03:23:21.094365Z","submitted_at":"2026-06-29T00:39:22Z","title":"How LLMs See Creativity: Zero-Shot Scoring of Visual Creativity with Interpretable Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-01T07:11:29.002616Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2606.29672"},"observation_digest":"sha256:f9293503fcb81383b439c9d56f24bf74ccbd434b791833fced5b9db630803233","observation_id":"6595ff6c-e86a-42fe-aaa4-b29ab7409254","resolution":{"observed_at":"2026-07-01T07:15:28.984824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-01T00:59:25.996486Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought.arXiv preprint arXiv:2505.16192, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25993","last_updated":"2026-07-28T17:09:16Z","snapshot_observed_at":"2026-08-01T00:59:15.902226Z","submitted_at":"2026-07-28T17:09:16Z","title":"Beyond Zooming: Learning Multi-Tool Visual Reasoning for Ultra-High-Resolution Remote Sensing","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:25.996486Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2607.25993"},"observation_digest":"sha256:b38e37408d5e5482f940bd7cbe750ea3cf273c4d33f3b421d2062f613f81a0ed","observation_id":"b360c749-1614-45a1-8676-f81404cd65e4","resolution":{"observed_at":"2026-08-01T00:59:25.996486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-07-31T16:13:17.400413Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-03T12:39:00.211104Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.400413Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:a418651872c35a161115a5985b78351e7b57969f0c9094f041a9e389dba27250","observation_id":"0608c6b9-0449-4965-9822-d85057b798a4","resolution":{"observed_at":"2026-07-31T16:13:17.400413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16192/citation-record","integrity":"/paper/2505.16192/integrity","json":"/paper/2505.16192/citation-record.json","paper":"/paper/2505.16192"},"outbound":[],"paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T06:24:45.708178Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2505.16192."}