{"as_of":"2026-08-06T16:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1f3032d87d88e1afbe577a0ce977d652db1277bfa6cfb734976aafb467b9552","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T23:48:32.613988Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.20755/citation-record","integrity":"/paper/2604.20755/integrity","json":"/paper/2604.20755/citation-record.json","paper":"/paper/2604.20755"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T21:21:26.318938Z","title":"In: Proceedings of the IEEE international confer- ence on computer vision","venue":null,"work_id":"31686120-1e3a-4e24-aad2-d2a238c991e9","year":2015},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:6cc57381ccdc0886099c1ebe3cd6207e5a506b81cd069990e3f6045292a29cf6","observation_id":"e7531695-9222-4ea0-8fe5-de4f11b6c95a","resolution":{"observed_at":"2026-05-23T12:25:39.933153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:1479e7f37b464a96c735afa52b8d3b543031ba645ffe4947eb8ef45060dff5c4","observation_id":"14a4b975-f72b-44a3-9212-deb7cbf04889","resolution":{"observed_at":"2026-05-11T14:01:04.345675Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:51a7d28b4711ef073bb5e82e2d7ce7fd0b6cf1f369f54ab59b31fe07e025df71","observation_id":"a141ad44-568a-41a1-a9f3-4a2808d66810","resolution":{"observed_at":"2026-05-11T14:01:04.359205Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01459","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2510.01459 (2025)","venue":null,"work_id":"b51a63d3-9dbd-4ffe-960d-ffc9917df9a6","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:0468eac6d586e218ce750e95b8af23289662143cfae00ce1941791df6155f029","observation_id":"cd740892-986f-4001-ad1c-e37e312630d9","resolution":{"observed_at":"2026-05-11T14:01:04.324347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02164","last_updated":"2020-06-14T19:14:22Z","snapshot_observed_at":"2026-07-06T08:19:15.735829Z","submitted_at":"2019-09-05T00:25:17Z","title":"TabFact: A Large-scale Dataset for Table-based Fact Verification","version":5},"cited_work":{"arxiv_id":"1909.02164","doi":"10.48550/arxiv.1909.02164","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.02164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:1909.02164 , year =","venue":"arXiv (Cornell University)","work_id":"8f8e6b3d-18b5-4a41-85d3-bcccd1c4d867","year":1909},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/1909.02164","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:2776cacea758883b864747da495488de705f2582bf04a9eb5d9cedef14121dd4","observation_id":"7c8f5d0d-ee73-4258-b32f-ad0de296f08e","resolution":{"observed_at":"2026-05-11T14:01:04.371132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:9d8caa7cca67dd426b61f71c73f55f7bcd32865e94793c4b6a79f6d550da120f","observation_id":"b73116fd-f6e6-487b-9eab-9280529c5824","resolution":{"observed_at":"2026-05-11T14:01:04.313665Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T02:41:50.342916Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"148e15b3-6351-48fa-83db-8753fbc5978f","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:59124e78da84ff2537dde8674bd85a5beaac7ff43155d2402578f63bec0c958b","observation_id":"1d840e53-6e25-48f5-b9ba-acc2a6ac3546","resolution":{"observed_at":"2026-05-23T12:25:39.936329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"9342203d-ceaf-4bba-ae60-69bef483b64e","year":2021},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c679cb10906153919cfc5e407b7e4ada08935b7000a788e884f2d83ce14472ea","observation_id":"de792a38-d75f-482e-b0af-3734b130e7a8","resolution":{"observed_at":"2026-05-23T12:25:39.939476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"efedb4dd-c665-4130-b601-242f5b2ded38","year":2022},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:e1291d24c87afd7330afe3278faf0e5429bf85aa06a60eba5f116861e1563224","observation_id":"2759972d-e9ee-4285-abee-340c7848ce8b","resolution":{"observed_at":"2026-05-23T12:25:39.942588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:5b8baba4348a90c20fba96892c6e3c36106dff0ce50f912d312f65c0b1cb8843","observation_id":"3dce7d08-13d2-4494-9a00-a4a1f1133671","resolution":{"observed_at":"2026-05-11T20:23:31.624298Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"43e2f06e-abf0-4083-8e12-06e17bc92ac7","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:8226333f5820c64cc4172832326dc3a9a1d867623fde8c791ee8ca4e755731d5","observation_id":"9f18a831-66a2-497e-8cb1-bfd9163cc19d","resolution":{"observed_at":"2026-05-23T12:25:39.945803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:55:36.119342Z","title":"Nature Machine In- telligence2(11), 665–673 (2020)","venue":null,"work_id":"6d2c53f3-d6c8-4ca6-bf21-35a6d248e0d8","year":2020},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:8cddc7c5e4946ff321c603d733c08938d7c78fe2158845e1ffe08e723586a56a","observation_id":"d6d5701e-c428-476d-b7b8-492e8874e250","resolution":{"observed_at":"2026-05-23T12:25:39.991978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 58th Annual Meeting of the Associa- tion for Computational Linguistics","venue":null,"work_id":"9aa51567-757d-47d2-8126-40e2495f9556","year":2020},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:1f83728d669b8de297d41f1826ac1790d5b5482578424c8909f3796da3ec8074","observation_id":"3645585f-515a-483b-b317-a48e4936d700","resolution":{"observed_at":"2026-05-23T12:25:39.920496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08516","last_updated":"2024-11-13T11:02:04Z","snapshot_observed_at":"2026-07-06T19:49:38.886114Z","submitted_at":"2024-11-13T11:02:04Z","title":"Tree-of-Table: Unleashing the Power of LLMs for Enhanced Large-Scale Table Understanding","version":1},"cited_work":{"arxiv_id":"2411.08516","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.08516","snapshot_observed_at":"2026-06-28T22:22:43.456184Z","title":"InProceedings of the 54th Annual Meeting of the Association for Computational Lin- guistics (Volume 1: Long Papers), pages 474–483, Berlin, Germany","venue":null,"work_id":"21f6ac8c-ce88-427e-88e5-347daa54f1fc","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2411.08516","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:14101479fd01801dc53fb50bc8b4940594191549e6015badcbf9542938306034","observation_id":"23e2c592-1539-466a-9e5d-48c9b6f17134","resolution":{"observed_at":"2026-05-11T14:01:04.277987Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"6de47785-d5a7-4773-9caf-57487c91da70","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c0264b6c8f6643948c33798c41e66a1ff8c4137c3e9ff1f392b39479bdc7cff6","observation_id":"c5449baf-2fac-4989-844a-0093707b6dd4","resolution":{"observed_at":"2026-05-23T12:25:39.913817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c008abbe-f8e8-4694-bbf0-01c3e703c501","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c6f95389e02314949e00aa09c8e557457e06d7569509f69a4174392c2a041e9d","observation_id":"38fdaa89-0503-4504-b572-61dfe423a94b","resolution":{"observed_at":"2026-05-23T12:25:39.904846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":"2407.07895","doi":"10.48550/arxiv.2407.07895","metadata_source":"pith","pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","venue":"cs.CV","work_id":"746ec475-051a-45ef-a6ed-2de8118466e4","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:2572c9f7a2b498223a810182f767bbe46da85e062698d7f29a1358028e1813bd","observation_id":"54904160-13b5-4c6d-aaf1-7f7077404f0a","resolution":{"observed_at":"2026-05-11T14:01:04.112367Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T21:36:35.012615Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ee98bb5c-fff9-4bd0-87c9-ce9b71d5253c","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:00f98f3a263dc19f2347bf23a93730488c019ec833406b5645ee0478497fc5ec","observation_id":"0ee351c0-c2b7-4dd0-8890-07a718f334f8","resolution":{"observed_at":"2026-05-23T12:25:39.923713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T21:36:34.984357Z","title":"Advances in neural information processing systems35, 2507– 2521 (2022)","venue":null,"work_id":"b3f0ca0c-d151-4e6c-a064-64b8a97abc74","year":2022},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:2696533c0ef8f151078d0ad32f4ecb8425a514038da45bce98907ac2ab9b14b0","observation_id":"87577d7c-0070-444e-af71-2cb265209cf0","resolution":{"observed_at":"2026-05-23T12:25:39.917230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14610","last_updated":"2023-03-02T07:41:55Z","snapshot_observed_at":"2026-08-02T10:24:59.821810Z","submitted_at":"2022-09-29T08:01:04Z","title":"Dynamic Prompt Learning via Policy Gradient for Semi-structured Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":"2209.14610","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.14610","snapshot_observed_at":"2026-07-05T17:41:17.457873Z","title":"arXiv preprint arXiv:2209.14610 , year =","venue":"cs.LG","work_id":"b02aa44e-3fa1-4e2f-a1d4-adc73c214fdc","year":2022},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2209.14610","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:18e89b0c8d37e5b8615592e5b808c6d10e96982f3649db6d4eea751e29618e6d","observation_id":"e873eadc-c41f-4092-8528-5a7a74e87e95","resolution":{"observed_at":"2026-05-11T14:01:04.237102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.06639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:09:40.613714Z","title":"Reinforcement learning with verifiable rewards: Grpo’s effective loss, dy- namics, and success amplification","venue":null,"work_id":"6fe29bef-6823-4df6-870e-d01a3e5e3ea7","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:d414e65378acfc87e2c3ccbe381bb6f6d8565d56f7e0263151f380be68df50f6","observation_id":"a63c66f7-e4ec-43b0-8ea9-7e3419a7f65d","resolution":{"observed_at":"2026-05-11T14:01:04.258594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:34:31.276904Z","title":null,"venue":null,"work_id":"562bc844-2b04-4268-8b8a-6e52d2eca618","year":2015},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:7181c54274a4cc49083b3ce706a01c4c72f7b10f136209f98a6f4f2bc0de6808","observation_id":"e964af31-ac64-457f-83e3-5280ddf2020a","resolution":{"observed_at":"2026-05-23T12:25:39.910068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 5th Workshop on Trustworthy NLP (TrustNLP 2025)","venue":null,"work_id":"5b0a74d6-c4ff-4a04-b4da-33986d6b571f","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:34f4bae6a6c225db77c34db0e7228e222250de39dbe0d6e682c3977253c08618","observation_id":"c08f7ce0-08a7-47b3-8c2d-0df95998d187","resolution":{"observed_at":"2026-05-23T12:25:39.929925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"955b85f1-5f60-40d1-8cdc-0eae17f555fc","year":2021},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c6bdaee21985395fad93f7ae83cc92c580ec2b287b12105199a2d4e46b7b42bf","observation_id":"1b974626-cb9c-471f-9fef-8439cbea0546","resolution":{"observed_at":"2026-05-23T12:25:39.973576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:33feda2e38af75d4355fd1279afdeef55f8f30988a300aad6566c020a5097f3c","observation_id":"afc4a129-41e9-460e-a735-a8551c1e7c45","resolution":{"observed_at":"2026-05-11T14:01:04.176964Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-07-06T21:01:17.931818Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":"2503.23829","doi":"10.48550/arxiv.2503.23829","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crossing the reward bridge: Expanding RL with verifiable rewards across diverse domains","venue":"ArXiv.org","work_id":"a1dbfba1-b433-4260-abc6-bf28628844b9","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:b67c4adb20dc97679cdae60f2e593dcecec1e2d6151e3794eb96cf59bf897989","observation_id":"369ad831-a096-4da0-8abc-13cba5e99796","resolution":{"observed_at":"2026-05-11T14:01:04.148354Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.06434","last_updated":"2020-06-10T03:49:08Z","snapshot_observed_at":"2026-07-06T09:28:04.742222Z","submitted_at":"2020-06-10T03:49:08Z","title":"TableQA: a Large-Scale Chinese Text-to-SQL Dataset for Table-Aware SQL Generation","version":1},"cited_work":{"arxiv_id":"2006.06434","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.06434","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2006.06434 , year=","venue":null,"work_id":"3a66f423-4ecf-4d6f-951b-fa4982d73102","year":2006},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2006.06434","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:67e35013ea7aeba8fb85d9c8bf7e6ef7ebf492ef1f81e85affb5c607efcab25a","observation_id":"7379f85f-6c98-47cd-bc37-5822faeff673","resolution":{"observed_at":"2026-05-11T14:01:04.300153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"github.io/blog/qvq-72b-preview/","venue":null,"work_id":"e8933960-ad56-4bb9-9baa-90382ba2a58f","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:11399c14a0b669d8429ed2495327fa9b8983058b8fadc470cbb6856924e9db6c","observation_id":"6fddbc7a-39c1-4096-8d1b-02ff7b9d508b","resolution":{"observed_at":"2026-05-23T12:25:39.926741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21771","last_updated":"2026-05-23T17:30:43Z","snapshot_observed_at":"2026-08-02T10:08:09.522525Z","submitted_at":"2025-05-27T21:09:11Z","title":"MMTABREAL: Real-World Benchmark for Multimodal Table Understanding","version":2},"cited_work":{"arxiv_id":"2505.21771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21771","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.21771 , year =","venue":null,"work_id":"17a2cdc2-8743-463a-afdc-1784dbe7cc36","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2505.21771","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:144935a0bdcd8152f42c678de1bebfe6c2b11b638135e6814eb83f965e09530f","observation_id":"e4aa65e4-50a6-42b5-a2ec-36755766fcfa","resolution":{"observed_at":"2026-05-28T01:04:06.972736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18548","last_updated":"2025-03-13T16:48:34Z","snapshot_observed_at":"2026-08-04T13:35:41.508269Z","submitted_at":"2025-02-25T15:56:56Z","title":"What is the Alignment Objective of GRPO?","version":3},"cited_work":{"arxiv_id":"2502.18548","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.18548","snapshot_observed_at":"2026-07-02T20:27:21.677423Z","title":"arXiv preprint arXiv:2502.18548 , year=","venue":null,"work_id":"193cc54f-dca9-40c7-9b40-08d6c8039772","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2502.18548","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:04006822a6d9398780b74671343cec4655b1053cfe36812886cf6a1a64acbf01","observation_id":"4d04fe06-516c-4049-9ca4-eb37bc0c4bb0","resolution":{"observed_at":"2026-05-11T14:01:04.225009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"efe96470-fb70-4033-863a-29ca59de9c0d","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:4fd58bfe4361ad7279996d8fbfc31ea5b65397e5004d66cb6ce8ba9ced8943f8","observation_id":"bbb00c15-dc23-40bb-b0d7-e61d4e7274d2","resolution":{"observed_at":"2026-05-23T12:25:39.962465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10291","last_updated":"2025-03-13T12:03:37Z","snapshot_observed_at":"2026-07-06T20:51:59.624697Z","submitted_at":"2025-03-13T12:03:37Z","title":"VisualPRM: An Effective Process Reward Model for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":"2503.10291","doi":"10.48550/arxiv.2503.10291","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VisualPRM: An effective process reward model for multimodal reasoning","venue":"ArXiv.org","work_id":"46b472b9-53d9-497b-9538-71913aa4aa92","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2503.10291","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:5581c56a39c2217cec1695fdb2abb59b93bd26e2d83430d01e92371305342c9b","observation_id":"c97eab3c-2eb9-442d-ad84-ff0870ecc7c8","resolution":{"observed_at":"2026-05-11T14:01:04.215642Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2503.12605","doi":"10.48550/arxiv.2503.12605","metadata_source":"pith","pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","venue":"cs.CV","work_id":"a8fbb385-8ed1-4952-9ee8-8d03be2b6821","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:df34656a051bdbaff1a820713d24087d8d3be609664f76592304b5c7d77dc89d","observation_id":"46bd3169-b2ad-4be6-92b3-d8ef67147f6f","resolution":{"observed_at":"2026-05-15T17:18:53.866178Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04398","last_updated":"2024-01-19T01:05:05Z","snapshot_observed_at":"2026-07-06T17:13:08.935785Z","submitted_at":"2024-01-09T07:46:26Z","title":"Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding","version":2},"cited_work":{"arxiv_id":"2401.04398","doi":"10.48550/arxiv.2401.04398","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.04398","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMLU-pro: A more robust and challenging multi-task language understanding benchmark","venue":"arXiv (Cornell University)","work_id":"a51a0225-7c53-4112-b1e2-76edf0097a44","year":2023},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2401.04398","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:3436d16177f3b9301ddf35775233bd81e954021695971dea4ccfec8301ff1f62","observation_id":"ed777cd7-a167-4788-a212-6ff02f2b01d0","resolution":{"observed_at":"2026-05-11T14:01:04.095951Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12415","last_updated":"2026-05-13T02:38:34Z","snapshot_observed_at":"2026-07-06T21:25:52.131700Z","submitted_at":"2025-05-18T13:40:18Z","title":"Table-R1: Region-based Reinforcement Learning for Table Understanding","version":3},"cited_work":{"arxiv_id":"2505.12415","doi":"10.48550/arxiv.2505.12415","metadata_source":"pith","pith_arxiv_id":"2505.12415","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.12415 (2025)","venue":"cs.CL","work_id":"c97f3c33-e710-4aa4-86b6-19a3b1b4c67a","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2505.12415","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:3529753c033d1e8f493f6d46ece95ea103ecb591e899cfb62d1d3cbeaa1f0392","observation_id":"da1dc0b6-8082-40e8-8ac6-7c43bb071723","resolution":{"observed_at":"2026-05-14T01:54:41.224976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 60th Annual MeetingoftheAssociationforComputationalLinguistics(Volume1:LongPapers)","venue":null,"work_id":"97b90306-b2ab-48bd-97be-8db12c32b47c","year":2022},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:bc72c86e5fe28934cf0065f9c3ccdefa4907863bf658a7b1760149d9d4ec54f7","observation_id":"8bafda1b-f83a-4513-b526-68abdfcd4f7b","resolution":{"observed_at":"2026-05-23T12:25:39.955337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:d43cf56a75178af669ac66baf7cd0c16a8def3723ead0b96b17fe4255f7df996","observation_id":"4d83f2b2-947c-48b1-bf5b-f372fd0e09db","resolution":{"observed_at":"2026-05-11T14:01:04.267394Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":"2504.05118","doi":"10.1109/access.2024.3384487","metadata_source":"pith","pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","venue":"cs.AI","work_id":"c2351652-65f7-47cd-ae80-dbcd72a6eb20","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:d854f92cf9e768aba10a894a4a03096de731d82877458d3990050301e281a9be","observation_id":"4cdcb9db-4dd2-4cc3-9e98-8167b6bf4829","resolution":{"observed_at":"2026-05-13T09:36:04.819624Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:51:39.910858Z","title":"IEEE transactions on pattern analysis and machine intelligence46(8), 5625–5644 (2024)","venue":null,"work_id":"17ea5e93-cb9f-4c22-a3de-4b582327dbff","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:33411ceb069eace5b16710a81053cc63abc9289222499647b1825b1c01199ebd","observation_id":"1e422387-fde7-4fe6-b286-8e91a1cd2eb1","resolution":{"observed_at":"2026-05-23T12:25:39.958801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frontiers of Computer Science19(9), 199348 (2025)","venue":null,"work_id":"219921d3-c9d7-429d-bb4d-cace3f545284","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:9dc9c43b0f03de699c3eb5ccd8c8d68b8c279cc8ebb2ab51407fc356c0fc7ab5","observation_id":"2972fa92-d096-4a8f-8851-13991ca7b36b","resolution":{"observed_at":"2026-05-23T12:25:39.965892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Findings of the Association for Computational Linguistics: ACL 2025","venue":null,"work_id":"a88376e0-2cef-4aa7-858b-13d478486493","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:2ad6663cac74d334fd7277ecf93697ad1a07fdee7bf8219b4348a8fd1efcc9ad","observation_id":"db5af329-360b-481e-8daf-2e8df3c2f746","resolution":{"observed_at":"2026-05-23T12:25:39.969033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":"2302.00923","doi":"10.48550/arxiv.2302.00923","metadata_source":"pith","pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","venue":"cs.CL","work_id":"cf983328-0c5e-4840-8f51-2b24cf4b21ee","year":2023},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:ce986bb53c6c7e1216ddaada2b5f6c376535e5d02f9ac9172b464c71c8b589b7","observation_id":"57a14436-1756-4103-b0de-8b5e7cd5e0a8","resolution":{"observed_at":"2026-05-12T18:12:27.664923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:02:58.475729Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"29caee6a-1163-4850-a09e-04d59a8cece2","year":2025},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c81906bfacf5fcc425a06407bb20efc4d284bbfcf1aed8501206e7c4f6bbba92","observation_id":"78315117-d4e4-4732-8502-6cf81d6b4544","resolution":{"observed_at":"2026-05-23T12:25:39.977079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems37, 7185–7212 (2024)","venue":null,"work_id":"36b3dc81-4613-492a-831c-e03d36ed26ef","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:39f64342be819879777dd6e57b0cc32d8dab3eee9549ace4aaae09ebac32ecab","observation_id":"f7c482b7-142f-49fd-ab85-68b479eaa51b","resolution":{"observed_at":"2026-05-23T12:25:39.981473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"8ecb1b61-8215-4799-8d8e-ccf1fc9e07dd","year":2024},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:901451eda841387d6de21015d3f6edf82ba668ce58cffeff677a2e2ce15c22b4","observation_id":"033de221-ba66-4293-b584-ec6d14f74e87","resolution":{"observed_at":"2026-05-23T12:25:39.985757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International journal of computer vision130(9), 2337–2348 (2022) 18 Authors Suppressed Due to Excessive Length","venue":null,"work_id":"358e8b9a-015c-4565-98ae-ba4699228458","year":2022},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:bac928f495e2d6f2be9bd003a625fa007951fc219d0668c6bac289cefc361cdf","observation_id":"8f03200c-8031-4ee3-81be-aed363c6bd03","resolution":{"observed_at":"2026-05-23T12:25:39.949049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":"2304.10592","doi":"10.18653/v1/2024.findings-emnlp.692","metadata_source":"pith","pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","venue":"cs.CV","work_id":"a7e3a737-e007-42bc-be89-c4d34c5ee071","year":2023},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:c00cf897bb459880b498da64e3cedcf365705cd399001255b7bdc7d4ec41ef39","observation_id":"8d2ab397-cd32-4ae3-8062-07b304d4c77a","resolution":{"observed_at":"2026-05-11T14:01:04.197764Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T17:23:55.433296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T17:23:55.433296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6cf28e1e-1404-42da-82b7-2205d527c54f","year":2021},"citing_paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:32.613988Z"},"links":{"citing_paper":"/paper/2604.20755"},"observation_digest":"sha256:335594235715d5f28f5dcfd4ded8793a18b7b61fa7c2799e62acf2dde9a01014","observation_id":"58f9a9aa-102a-46d8-8bef-e5a490ac62c2","resolution":{"observed_at":"2026-05-23T12:25:39.952039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.20755","last_updated":"2026-04-22T16:44:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T03:59:28.787636Z","submitted_at":"2026-04-22T16:44:33Z","title":"V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":15,"parse_uncertain":0,"unresolved":6,"verified_exact":8,"verified_fuzzy":19},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2604.20755."}