{"as_of":"2026-08-06T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b41ffb006103825b8a271275a033c8dea74503350ee19e9abf674bf9370e6ac8","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T00:59:29.584299Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.00710/citation-record","integrity":"/paper/2511.00710/integrity","json":"/paper/2511.00710/citation-record.json","paper":"/paper/2511.00710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"17e168ee-0843-4a72-8584-dc67ed433cc0","year":2022},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:258dae7ca49abdf33a94d21cf542d06f31c54c35ce91c5c6e986d67bf01c79c1","observation_id":"2316059d-5590-43dc-a36c-32534d6de703","resolution":{"observed_at":"2026-05-18T01:00:35.272095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:9ea7c5b5a4f458e9eb10346e7845694473707422f38fa9bdaf0cbbf28679c1bb","observation_id":"1a67c20b-5143-44a7-a37e-93bdb3f72e9c","resolution":{"observed_at":"2026-05-18T01:00:34.273634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:d3842f4d9f5c34822ae48792dc0ccda59152db52c11a7325e7d3a9cd4ec732e2","observation_id":"79ab8197-3bf9-4a69-9c4f-efb6e241d782","resolution":{"observed_at":"2026-05-18T01:00:34.278151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:38eca8d7b1a4318175d062fda12186999131bb83820ef6a928f2e47618b42d81","observation_id":"b1788fd3-b179-4b8f-aa42-b86e6ce6c91f","resolution":{"observed_at":"2026-05-18T01:00:34.269351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-07-06T20:49:27.466064Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:dc206c26ea47717e58b440f191c316add980bb0e4464d6392c9b6de07c52f2ac","observation_id":"be2d22c2-e302-435b-81e4-3d7679467cb9","resolution":{"observed_at":"2026-05-18T01:00:34.249459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2504.08837","doi":"10.48550/arxiv.2504.08837","metadata_source":"pith","pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","venue":"cs.LG","work_id":"b13ff087-9614-48cc-8991-ad75b6543bbc","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:75ce848d7fe4b269b0f978386700c2da9d05bdcbc0cb901383ba24fd84a43cb8","observation_id":"c16e97bd-ee15-4ce7-8ad3-dd9496696245","resolution":{"observed_at":"2026-05-18T01:00:34.287514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.01713","doi":"10.48550/arxiv.2506.01713","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Srpo: Enhancing multimodal llm reasoning via reflection-aware rein- forcement learning.arXiv preprint arXiv:2506.01713","venue":"arXiv (Cornell University)","work_id":"69703666-e5e4-4375-917d-0df8ccc043cd","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:55aa41d29584074bf56ecc20e8449025b70a408c8d7d37e69d72b0036b404145","observation_id":"d17eea14-dd59-43cf-83b6-309b72468a2c","resolution":{"observed_at":"2026-05-18T01:00:34.264169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14669","last_updated":"2025-02-25T08:56:11Z","snapshot_observed_at":"2026-08-03T21:14:54.735946Z","submitted_at":"2025-02-20T16:05:18Z","title":"AlphaMaze: Enhancing Large Language Models' Spatial Intelligence via GRPO","version":3},"cited_work":{"arxiv_id":"2502.14669","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14669","snapshot_observed_at":"2026-07-04T08:59:43.320957Z","title":"Alphamaze: Enhancing large language models’ spatial intelligence via grpo","venue":null,"work_id":"f9a54edc-5dbc-4aed-8077-88223352d9e8","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2502.14669","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:fa416939a5892b0e370528bdaded8931ed67b63a9eeffbff800214f7ffee9b5c","observation_id":"1c220fca-7c23-4a59-9a6d-c52bcdc1890e","resolution":{"observed_at":"2026-05-18T01:00:34.259202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to navigate in complex environments","venue":null,"work_id":"9d8f17e3-25ca-4db0-93c5-f8044b81dcac","year":2017},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:ad18b36d9f35e0cbe8dedbb35ff8305d2b83a907f4e1a5d8fdfa076515daa352","observation_id":"423bc05a-b91c-47e2-ae9c-44728c60694d","resolution":{"observed_at":"2026-05-18T01:00:35.269094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14607","last_updated":"2025-03-18T18:05:38Z","snapshot_observed_at":"2026-07-06T20:54:55.393096Z","submitted_at":"2025-03-18T18:05:38Z","title":"Can Large Vision Language Models Read Maps Like a Human?","version":1},"cited_work":{"arxiv_id":"2503.14607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.14607","snapshot_observed_at":"2026-07-04T08:59:43.331948Z","title":"Can large vision language models read maps like a human?","venue":null,"work_id":"889aef51-cafa-4fb2-a121-d724195ca728","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2503.14607","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:0960f6279ab1c846094579522a02a0cac6165a306971e1a567a2e2303fdd6d53","observation_id":"07ee29a3-e891-4c5d-8ed0-10e437e5c914","resolution":{"observed_at":"2026-05-18T01:00:34.282715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T12:26:57.149499Z","title":"Can mllms guide me home? a benchmark study on fine-grained visual reasoning from transit maps","venue":null,"work_id":"091a3cea-e51b-4619-aa05-6dd854c38cb7","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:e748ab17a3e3febf6d67a776acf50bae9fe8ce8ce97f7f3511528958c8ff728f","observation_id":"99a10cf7-9e3a-41c6-854b-16341229ecaa","resolution":{"observed_at":"2026-05-18T01:00:34.254687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"e3116fca-6b4b-4bf1-949a-7a668f1bf45d","year":2022},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:90de1d65cc4c7250482306e3a7daf01cd349f5489dc0bd7e645304b257d4251a","observation_id":"1a3b39e6-9a4b-4400-83b2-1d0f1ce0a28e","resolution":{"observed_at":"2026-05-18T01:00:35.260400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning","venue":null,"work_id":"4ae7d1d4-0c1d-4afc-b100-f81bfb61f04d","year":2023},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:a3adef0239c60d492e6002d58ea31bc2c5faa9a3b5dd88f44c360c9608017bfb","observation_id":"e320745e-59cb-43f6-a9a0-966350d7fd0e","resolution":{"observed_at":"2026-05-18T01:00:35.275080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:d682100f3fa88f46f497dd6ef7e21c58e30218f0aa78601bf8bf19601cd4c3c9","observation_id":"0d333c45-4989-4b9c-b800-6f8c453dff9c","resolution":{"observed_at":"2026-05-18T01:00:34.292214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain of thought prompting elicits reasoning in large language models","venue":null,"work_id":"d4db286b-4227-4bdf-8a6a-5b00f2e0ee45","year":2022},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:b6e6da4aca2f117e87ac680a7fa0f28b471951865b798664afe205f07b4da313","observation_id":"cad7de51-1115-4151-b77d-4de34a206a25","resolution":{"observed_at":"2026-05-18T01:00:35.265990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13362","last_updated":"2025-07-06T10:51:12Z","snapshot_observed_at":"2026-08-05T08:09:33.615988Z","submitted_at":"2025-07-06T10:51:12Z","title":"Enhancing Spatial Reasoning in Vision-Language Models via Chain-of-Thought Prompting and Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.13362","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.13362","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enhancing spatial reasoning in vision-language models via chain-of-thought prompting and reinforcement learning","venue":null,"work_id":"59b66da2-a9ca-41c3-aa89-2359963af0ee","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2507.13362","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:756a1051952827fbc39c98059eebea8717668207e60bca59d759c199e9f3f3f5","observation_id":"205bf49e-2912-4f14-97fd-2c0ad26eddea","resolution":{"observed_at":"2026-05-18T01:00:34.244407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cot-vla: Visual chain-of-thought reasoning for vision-language-action models","venue":null,"work_id":"a307a406-684d-4441-8b1e-0f69556c7c1d","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:4417192109bc2348f8f37994f3d63bd0516578b87965ccacf95135ae6a753522","observation_id":"2a183e25-41f9-4635-a495-b98ced13be2f","resolution":{"observed_at":"2026-05-18T01:00:35.263175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T00:59:29.584299Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2511.00710"},"observation_digest":"sha256:4d3c777e58fc0e330f332d50dd163e728c6905993eb70061d6ec980657969eb5","observation_id":"d46a5da2-d0ab-4352-b507-0691fca6735e","resolution":{"observed_at":"2026-05-18T01:00:34.295974Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.00710","last_updated":"2026-04-13T19:25:25Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T21:19:41Z","title":"Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":6},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2511.00710."}