{"as_of":"2026-08-06T01:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56cd4ba26444397c13a8deea595a8c476a2ecfdf1ad948d34a544e9dbdf187ff","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T17:20:28.036531Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03660/citation-record","integrity":"/paper/2604.03660/integrity","json":"/paper/2604.03660/citation-record.json","paper":"/paper/2604.03660"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aaea516c-4f24-4f88-907e-870191831b59","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:708487cd5ee0867e233e5b5c4caee6a0597a154129454ca9cdf714e5d493c4a0","observation_id":"1bd81b5a-703b-49cb-9d01-9b7afaacf362","resolution":{"observed_at":"2026-05-14T05:07:15.161978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:c629d9f51b469ae10ece4c1c688f3be59384a51ca8061a7c6983985d9f2638b7","observation_id":"e18f4a3a-5595-4c8a-b0f9-eda22480cb9e","resolution":{"observed_at":"2026-05-13T17:23:02.431158Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:36e18ec24545f6bc43bba05b440817a0dc40c328722b90a83d51a26f954560cc","observation_id":"afec114b-f876-4836-8bd1-16be1a663273","resolution":{"observed_at":"2026-05-13T17:23:02.412865Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2df74136-65ad-4bb1-b082-f90aa80a853c","year":2026},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:f220f95673095f88e61c2de18daf81b0a3e5a73b4e5174b89b187314862ebad4","observation_id":"3470787b-dedb-48f5-8be4-b9c0b7c5472b","resolution":{"observed_at":"2026-05-14T05:07:15.166422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19378","last_updated":"2026-04-15T03:29:38Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:31:31Z","title":"TableMaster: A Recipe to Advance Table Understanding with Language Models","version":6},"cited_work":{"arxiv_id":"2501.19378","doi":"10.48550/arxiv.2501.19378","metadata_source":"pith","pith_arxiv_id":"2501.19378","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"TableMaster: A Recipe to Advance Table Understanding with Language Models","venue":"cs.CL","work_id":"04284d16-3cb3-42a8-a1ab-5c3c6a9739c4","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2501.19378","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:9cbe857b6fe5f786279c2b5cde7d142b8115610990b308b6aab456ac13db4785","observation_id":"4016898d-11f2-464f-abab-65bbb56e334a","resolution":{"observed_at":"2026-05-13T17:23:02.425094Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2023 Con- ference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"57af9608-ddd3-4c0a-bd90-53b728a31e1d","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:250f053ba388f2c1255585fb4f6557a4b17e2b4ca091caa108ec800a1c1000d2","observation_id":"e6939018-8581-4f9f-84c8-906cebff313f","resolution":{"observed_at":"2026-05-14T05:07:15.168573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10439","last_updated":"2021-02-10T08:21:18Z","snapshot_observed_at":"2026-08-04T17:38:00.331226Z","submitted_at":"2020-10-20T16:48:14Z","title":"Open Question Answering over Tables and Text","version":2},"cited_work":{"arxiv_id":"2010.10439","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.10439","snapshot_observed_at":"2026-07-03T04:47:37.849464Z","title":"arXiv preprint arXiv:2010.10439 , year=","venue":null,"work_id":"cf964511-4be0-42e1-9c28-827f71bcefca","year":2010},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2010.10439","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:025c9f757c8a549c7fdceaa3771eef12f7a769636baf3c919fb9d97bfe87eed5","observation_id":"d33b01b9-98f5-4636-8dd2-2fb11cfab808","resolution":{"observed_at":"2026-05-13T17:23:02.422104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02164","last_updated":"2020-06-14T19:14:22Z","snapshot_observed_at":"2026-07-06T08:19:15.735829Z","submitted_at":"2019-09-05T00:25:17Z","title":"TabFact: A Large-scale Dataset for Table-based Fact Verification","version":5},"cited_work":{"arxiv_id":"1909.02164","doi":"10.48550/arxiv.1909.02164","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.02164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:1909.02164 , year =","venue":"arXiv (Cornell University)","work_id":"8f8e6b3d-18b5-4a41-85d3-bcccd1c4d867","year":1909},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/1909.02164","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:1dd3637e8e7d1867d73b741a035f52deef15c97acb597f4336b3d1c9695a00e7","observation_id":"fabe4d04-a5a7-4929-b5c0-1a0f63d28245","resolution":{"observed_at":"2026-05-13T17:23:02.404401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the ACL (2020) 5, 6","venue":null,"work_id":"03fce330-8b26-4a6e-9221-b8fa11abedce","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:20b4521eb8f4c2241ee1bc952c99109d632a6239ee68699f0143c83bc5966a43","observation_id":"75df66af-3542-4bd6-9e90-96fc1d9e51c0","resolution":{"observed_at":"2026-05-14T05:07:15.172691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01584","last_updated":"2024-10-15T01:16:20Z","snapshot_observed_at":"2026-07-06T18:24:38.958815Z","submitted_at":"2024-06-03T17:59:06Z","title":"SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models","version":3},"cited_work":{"arxiv_id":"2406.01584","doi":"10.48550/arxiv.2406.01584","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01584","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SpatialRGPT: Grounded spatial reasoning in vision-language models","venue":"arXiv (Cornell University)","work_id":"cece8f93-8aed-46f8-a36b-261804d5acb3","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2406.01584","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:f50068f93610f73ffcb4815619aa98302ee78159c45e6ad56769144d2d06847d","observation_id":"9a45f726-1e72-4ffd-bf4c-fc25f0c75fab","resolution":{"observed_at":"2026-05-13T17:23:02.419126Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.262420Z","title":"Glyph: Scaling context windows via visual-text compres- sion","venue":null,"work_id":"fd554aed-9fbc-48cb-bbcd-f2beff67c3d3","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d23ff537717d35465a6ab7b6cff6d3bafbb04f88877bb78e8f94caa12a1e7c0a","observation_id":"74d685d9-71f6-4712-b44d-0b779e3d2a08","resolution":{"observed_at":"2026-05-13T17:23:02.416170Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Annual Meeting of the Association for Computational Linguistics (2021),https://api.semanticscholar.org/CorpusID:2370913772","venue":null,"work_id":"441f1f23-a069-411f-97bc-04df206c5712","year":2021},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d5e48f2e155e98aae777ef64000a4941fa9f965118b9483e421114aa8b843fc1","observation_id":"a5fab2a0-2ccc-477e-acf4-a688ce5c5923","resolution":{"observed_at":"2026-05-14T05:07:15.179431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66a2092f-0884-4444-b655-09e382d227eb","year":2022},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:6bd72b7cc27b32d6a2c1158fc118e16443cabb9367287fe297049be25ab1e5a9","observation_id":"518b7398-a832-4491-858a-e6ae6ba5be3e","resolution":{"observed_at":"2026-05-14T05:07:15.174670Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2305.06500","doi":"10.48550/arxiv.2305.06500","metadata_source":"pith","pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","venue":"cs.CV","work_id":"f3aac728-ded0-4e55-aa9e-4a1635d4313d","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:28b1bae560a078c79cef33bbec5473be96505593c80afef61bb41bb20833c5fe","observation_id":"2d51da12-27bf-4f3d-adba-0e6931017734","resolution":{"observed_at":"2026-05-13T17:23:02.428275Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.knosys.2025","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T07:56:46.826077Z","title":"Gslta- cdfsar: Global sequences and local tuples alignment for cross- domain few-shot action recognition","venue":null,"work_id":"950c2b45-d1b0-46b4-821e-e4d9b2f1427d","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:ad5af517c5ecc91fa8f2e4b1a0463bffc065351b41a32da8839234e55f5a433d","observation_id":"57263958-101a-4cb5-b263-de90ebe59ccc","resolution":{"observed_at":"2026-05-13T17:23:02.027157Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nature645, 633–638 (2025) 2","venue":null,"work_id":"edb3f61c-3390-4527-8a77-6cd1d98d022a","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:bedda3da9a21a45f4588f8c9b0731709d3f79e23415247a5142cf6d1800ea191","observation_id":"02d8496c-7c7f-4145-a85c-e6e202efb38a","resolution":{"observed_at":"2026-05-14T05:07:15.176960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05452","last_updated":"2025-01-09T18:59:58Z","snapshot_observed_at":"2026-07-06T20:18:53.977126Z","submitted_at":"2025-01-09T18:59:58Z","title":"ReFocus: Visual Editing as a Chain of Thought for Structured Image Understanding","version":1},"cited_work":{"arxiv_id":"2501.05452","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.05452","snapshot_observed_at":"2026-07-04T19:20:07.268611Z","title":"Refocus: Visual editing as a chain of thought for structured image understanding.arXiv preprint arXiv:2501.05452","venue":null,"work_id":"05d227cf-e8a1-4bf7-811f-4749bb245838","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2501.05452","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:f134fda2ad94f0a4e55eb12c8d9402717fa61ea3035b7384dc72b745a991d0dc","observation_id":"1ee1dbbd-ac54-421e-b3d6-e99745b3c56d","resolution":{"observed_at":"2026-05-13T17:23:02.410245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"09e893d2-1b89-42da-90f6-56dc204da181","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:7626152d5fcd3a0ea1d7956d70bd4c6bd938440995d99a58e562a1285fb2e1db","observation_id":"d19f6b17-9244-46dd-bfa5-6797524bddc3","resolution":{"observed_at":"2026-05-14T05:07:15.164401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"e386af8b-4b4c-4900-85ed-88cefeee4f35","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:71d27c76c0d8e4fbc326784d41b6782fc854d2b35c4dcbaf22686220cad345da","observation_id":"4023ea36-cbff-42b1-b4de-10399b70c0bc","resolution":{"observed_at":"2026-05-14T05:07:15.170655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Annual Meeting of the Association for Computational Linguistics (2020),https://api.semanticscholar.org/CorpusID:2186140952","venue":null,"work_id":"bdb4947c-5b5e-4756-ada2-bc2191bebd7b","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:2417d9ae9d94309d404361edb803c97d7dd8a6bb8a0d5abee24d2bbd1097dafe","observation_id":"8b685fe9-823c-4cb2-ab33-bce77fc95d28","resolution":{"observed_at":"2026-05-14T05:07:15.160053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Annual Meeting of the Associa- tion for Computational Linguistics (2020),https://api.semanticscholar.org/ CorpusID:2148029012","venue":null,"work_id":"2ef386d8-41bb-4dd2-b6d7-6acfb9af4a11","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:cc567770bec821584b32c0ac4eeb3adc47dfa4b1f7e2df3aeca6273d4759ca1a","observation_id":"cf03cb74-6a69-4cd2-938a-ff6c5ff01732","resolution":{"observed_at":"2026-05-14T05:07:15.157968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05271","last_updated":"2026-03-11T08:46:41Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-07T14:31:20Z","title":"DeepEyesV2: Toward Agentic Multimodal Model","version":4},"cited_work":{"arxiv_id":"2511.05271","doi":"10.48550/arxiv.2511.05271","metadata_source":"pith","pith_arxiv_id":"2511.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepEyesV2: Toward Agentic Multimodal Model","venue":"cs.CV","work_id":"0bc8f779-a287-4c6f-95b2-daffd15ad044","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2511.05271","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:47155cea5a59b5238ec69c9634c06596b221e1682f56a6b4d88dbecdb1c4dfb9","observation_id":"8140e57b-9212-4ea0-b83f-86ccfafa754b","resolution":{"observed_at":"2026-05-16T05:32:29.694372Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":"2211.09699","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-07-01T00:35:10.154544Z","title":"A., and Luo, J","venue":null,"work_id":"0b312d17-4e70-4d0d-ae07-c4a07a338426","year":2022},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:8d31f3e4cd3cb296a07a6efce86a94fc411f9e1a3459032e77d1888176f90373","observation_id":"fc7e8496-8281-43bf-bcc8-769778750263","resolution":{"observed_at":"2026-05-13T17:23:02.401153Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics 6, 49–61 (2017) 2","venue":null,"work_id":"974a414b-2373-4f49-b88b-b4f0f4beaa2a","year":2017},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:057eaf16d1c84acdecaa214097984f33e545fb508ed9b02111de47828e13500c","observation_id":"dbe7bf39-87d4-4d82-b29c-a9087cbaa020","resolution":{"observed_at":"2026-05-14T05:07:15.129152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.11099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2512.11099 , year=","venue":null,"work_id":"c93d3972-0896-492b-9136-8b8d7d198f5d","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:96d9d4158720e6544363cc23db38dd6130b51d6bfb771de62133eab78a2709bd","observation_id":"8dd17c73-0e49-41ee-a988-095b35f8a5a0","resolution":{"observed_at":"2026-05-13T17:23:02.439038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"5c02da93-965b-43f0-9718-1d44f3aad45d","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:a606f539da439420ea99f3adfeb9cb55f6b90184e27b23c04b36988cbf876376","observation_id":"605444ad-d1a8-4feb-a600-eeff14a94813","resolution":{"observed_at":"2026-05-14T05:07:15.112714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6af827d8-28d6-46a1-82e0-3e0b08dc5ce9","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:3c9243915d6e628187a1d16625530c76a5da257ea17ffdd03e6bda49169aac67","observation_id":"b01a2c06-ee49-44ea-a5b5-f315582e6857","resolution":{"observed_at":"2026-05-14T05:07:15.153898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European Confer- ence on Computer Vision (2021),https://api.semanticscholar.org/CorpusID: 2509248702 18 X","venue":null,"work_id":"a4104dfb-b6d9-401e-948a-2019630645a1","year":2021},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d1ae74c4358a6413d9fb9d05a0be5cfe6200709ba173a2673f9f49510cdcde5d","observation_id":"35c676fa-dc3f-4c0b-b2a7-51f205ac3962","resolution":{"observed_at":"2026-05-14T05:07:15.155925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19205","last_updated":"2024-04-30T02:05:18Z","snapshot_observed_at":"2026-07-06T18:07:27.432252Z","submitted_at":"2024-04-30T02:05:18Z","title":"TableVQA-Bench: A Visual Question Answering Benchmark on Multiple Table Domains","version":1},"cited_work":{"arxiv_id":"2404.19205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.19205","snapshot_observed_at":"2026-07-04T21:00:09.470383Z","title":"arXiv preprint arXiv:2404.19205 , year =","venue":null,"work_id":"6158fe16-6333-4da2-ab5d-d0d3ee6ee6da","year":2026},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2404.19205","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:b0e7ed3d4716b9f87b14deabaf9b5f6ae46d6e675c7c03911d3d311b2ab74386","observation_id":"5497679c-f7e5-4a65-ab44-b53890819249","resolution":{"observed_at":"2026-05-13T17:23:02.407152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Findings of the Association for Computational Lin- guistics: ACL 2023","venue":null,"work_id":"b97cb01b-3c71-4e99-ae78-9712ab583a8b","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:071fa3340682f293cd4dfcba3a105671fd65e21c9a26fa04d02b341e8cb57056","observation_id":"cfc04530-4454-4a51-9cb7-d76cc8c0642e","resolution":{"observed_at":"2026-05-14T05:07:15.131309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems36, 34892–34916 (2023) 4","venue":null,"work_id":"98b80239-84ae-4a50-bd54-2914cec28356","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:9b89e5e6d51939c6f1d8847ff956e22635ededac6794daaa1ce72a6ca81bf37b","observation_id":"ec6fb69a-55fe-4a3d-844a-4ea0a8d53039","resolution":{"observed_at":"2026-05-14T05:07:15.120669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European conference on computer vision","venue":null,"work_id":"3b5d940a-4d13-4194-b772-8b732badafa8","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:1e65391b225b329295caed7f038736d57aebd98ac5301314d09c8779fe157d4f","observation_id":"cab46594-54a0-4e3b-8914-ab8249b68460","resolution":{"observed_at":"2026-05-14T05:07:15.133466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neurocomputing p","venue":null,"work_id":"9dbd8df9-cf2f-418c-93da-efe75313b4c0","year":2026},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d6037c4a0bcd42ef48bba238e7ba6432f375d51c54827657c887acac32251cb4","observation_id":"6f2ff96e-e7c2-44d5-a677-46d157cc3d7d","resolution":{"observed_at":"2026-05-14T05:07:15.122611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07966","last_updated":"2026-04-21T15:48:38Z","snapshot_observed_at":"2026-07-06T22:27:15.482704Z","submitted_at":"2025-09-09T17:52:26Z","title":"Visual-TableQA: Open-Domain Benchmark for Reasoning over Table Images","version":2},"cited_work":{"arxiv_id":"2509.07966","doi":"10.48550/arxiv.2509.079665","metadata_source":"pith","pith_arxiv_id":"2509.07966","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Visual-TableQA: Open-Domain Benchmark for Reasoning over Table Images","venue":"cs.CV","work_id":"4ba5de94-6c20-4119-8c50-797c1641beca","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2509.07966","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:2e7b94996133d43116a9c5ac5384839fadb6309dc3d0acfb4c11fa8230b46511","observation_id":"f4a25ec6-e7e0-456d-8dda-0d1cdff69248","resolution":{"observed_at":"2026-05-13T17:23:02.030244Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Confer- ence on Computer Vision","venue":null,"work_id":"09858ccb-bee4-4beb-bbcc-815a12308150","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:8dc7136b7026d12b74e96c73b5b341c7b01537cad8b90856e3c88581dac9e38c","observation_id":"dc0b777f-a9b7-4107-bbd9-f6735c34ea08","resolution":{"observed_at":"2026-05-14T05:07:15.118017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 IEEE/CVF Conference on Com- puter Vision and Pattern Recognition (CVPR) pp","venue":null,"work_id":"d494e9c5-ea59-4b4d-b23f-66e4e5706ea7","year":2022},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:c7e722548d74305a7e3d0feb8c63c1c56353364b15d9ad1b187a88ef1216dee2","observation_id":"2dd60e96-6ca2-4f5c-91b9-2da9e08aced7","resolution":{"observed_at":"2026-05-14T05:07:15.137763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP)","venue":null,"work_id":"796022f7-246b-4088-aa57-ac662c3eba11","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:5d759c5c2f320c9e73da9b6a766849d06638f6d344548f6e8ccecf3e88f1017a","observation_id":"3da7b347-5a72-4caf-a882-9f487533cfce","resolution":{"observed_at":"2026-05-14T05:07:15.141897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"30bb2a60-43af-4e55-992c-1e7c85c11fb5","year":2015},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:c2b08fa758976f2af70195d42d0af7661f61854d056c527d209084a515763f51","observation_id":"53018009-84d3-4d6b-b5b8-949ccc078a7c","resolution":{"observed_at":"2026-05-14T05:07:15.143945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:16:16.764150Z","title":"In: Proc","venue":null,"work_id":"452f975d-5e1f-47e0-967f-db1ed9da0d80","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:b415e52435f9e40ece0868eee51cba5a88300ffc632398fed2a64de13505113e","observation_id":"e7dcdfa4-3f2a-4ee3-bc89-1224cb50b43f","resolution":{"observed_at":"2026-05-13T17:23:02.025006Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2511.17238 (2025) 2","venue":null,"work_id":"09f77be1-199e-4a49-a0b9-8b77f65b7c75","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:59f07ef3dd2c0803e90af3581c29f1e84e6c25584f9908d5996297597d7354ad","observation_id":"c6f2de14-c777-400c-bc98-9d6794b07b08","resolution":{"observed_at":"2026-05-13T17:23:02.442735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23918","last_updated":"2025-07-03T16:49:39Z","snapshot_observed_at":"2026-07-06T21:49:47.325553Z","submitted_at":"2025-06-30T14:48:35Z","title":"Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers","version":3},"cited_work":{"arxiv_id":"2506.23918","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.23918","snapshot_observed_at":"2026-07-11T03:17:51.399835Z","title":"Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers","venue":"cs.CV","work_id":"760ebd7d-977d-4280-afae-adb421d49ed4","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2506.23918","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:8472963e98c302e4a11be1ed0158e336a507108e71e3f065da2a73273d910d98","observation_id":"d6b6ec57-67b6-46b7-9001-5e449a51ff46","resolution":{"observed_at":"2026-05-13T17:23:02.458466Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceed- ings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"89b10d4c-284b-4239-8c3c-0915302aed90","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:a5070f093b00f914521809cb2b2299cb6a9bf35a0eac787c90a507dfbf3113e0","observation_id":"4580162a-37db-482e-a3aa-6842a0414d50","resolution":{"observed_at":"2026-05-14T05:07:15.124712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":"2405.09818","doi":"10.48550/arxiv.2405.09818","metadata_source":"pith","pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","venue":"cs.CL","work_id":"2661b9a6-25cc-41a1-8100-612d2b801289","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:a8811201c8f6314db5028a89a7196034ae5e3aec0daade08f87390ef3b448188","observation_id":"e4c4f1e0-99cc-4328-a294-5254b9e5a1b3","resolution":{"observed_at":"2026-05-13T17:23:02.482164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T17:49:22.013335+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:96dfe50cda35f0916968b8423fc5668399e839ad25343ca47c16bdbc60659956","observation_id":"6be5c98b-e9b9-4bec-961d-d31103a588ab","resolution":{"observed_at":"2026-05-13T17:23:02.478270Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: International Conference on Learning Representations (ICLR) 2025 (2025),https://openreview.net/forum? id=GGlpykXDCa, oral 5, 6","venue":null,"work_id":"aa51eac4-ddb4-42db-ba14-6e93228f599c","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:5b773b7d5c37f6b515db583f151ebb38e03ffec4eac946a7e70932e62f1320a1","observation_id":"e94c75da-52cc-4230-b850-3b84af755f30","resolution":{"observed_at":"2026-05-14T05:07:15.135629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Findings of the Association for Computational Linguistics: ACL 2025","venue":null,"work_id":"b33fff50-243f-4734-8277-821dce11d11f","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:afd404d83f874207c2b96f8dd6697dd3e60196efcd27077a98fef45f66d03184","observation_id":"bce9fff9-00ff-4ec2-9ae6-a6787647742e","resolution":{"observed_at":"2026-05-14T05:07:15.126919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09174","last_updated":"2025-03-18T07:13:18Z","snapshot_observed_at":"2026-08-02T11:40:55.318442Z","submitted_at":"2024-08-17T11:40:10Z","title":"TableBench: A Comprehensive and Complex Benchmark for Table Question Answering","version":2},"cited_work":{"arxiv_id":"2408.09174","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.09174","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXivabs/2408.09174(2024),https: //api.semanticscholar.org/CorpusID:2719028395, 6","venue":null,"work_id":"32ea140f-8ce4-4103-92c1-e625d2d8c20b","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2408.09174","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d007fc1b73c051d3b3e16a945b0e4a556dc8919be255cf7afde63f5f9a3cec57","observation_id":"267946d2-a589-49da-88f0-23bb407b6b0a","resolution":{"observed_at":"2026-05-13T17:23:02.485778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.05587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:36:23.843345Z","title":"ArXivabs/2506.05587(2025),https://api.semanticscholar","venue":null,"work_id":"2f37c763-39ca-4de0-a29b-1d6582b05080","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:bcef9d29771839fd079c169ca6e252de041473006df47256ac14fa7f909bb86f","observation_id":"f4b471f6-697d-4f67-8896-76ae9a9209a2","resolution":{"observed_at":"2026-05-13T17:23:02.453990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21471","last_updated":"2026-05-07T07:59:46Z","snapshot_observed_at":"2026-08-02T23:27:20.204280Z","submitted_at":"2025-11-26T15:04:18Z","title":"SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition","version":4},"cited_work":{"arxiv_id":"2511.21471","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.21471","snapshot_observed_at":"2026-07-04T08:59:43.334805Z","title":"SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition","venue":"cs.AI","work_id":"81942f57-c90d-41fc-9036-779f35d52bed","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2511.21471","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:d988db33525e0665f5cffc6dd06b40ac9f17d7a313bb13dee35518e6f05e87dc","observation_id":"e4cdcbc1-3adc-4d2f-9347-1af500ea56e8","resolution":{"observed_at":"2026-05-13T17:23:02.471677Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.958436Z","title":"Visual planning: Let’s think only with images","venue":null,"work_id":"de8a30bf-f8d1-46d8-b619-a8e07a7503cb","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:b28e7a5bb03168520bfb782f2f7c3f06a79ffd3e040e9eb06257258964fd47ff","observation_id":"e930f7e3-abb6-40a9-a4f9-1a7b99f719fc","resolution":{"observed_at":"2026-05-13T17:23:02.449756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Vol- ume 1: Long Papers)","venue":null,"work_id":"85b9258d-d073-4ab7-b86c-fcc583fbfe7c","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:25ae96da204a55af96c771a65f6955a6acb9dd71257281d55410e6925551960d","observation_id":"4b1d121e-1fa0-4c06-8106-97e519f868b6","resolution":{"observed_at":"2026-05-14T05:07:15.115622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":"2408.01800","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-07-10T11:37:03.161139Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","venue":"cs.CV","work_id":"0f06e436-0c76-4e3c-be5e-6168f6bc4336","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:23f107c8925c59a36024f1ffa780fcd1c2fc5af41ae77dc6c51711deb0212d9f","observation_id":"5bc83d71-23eb-4351-959c-fc96faa5867b","resolution":{"observed_at":"2026-05-13T17:23:02.446298Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2510.07098 (2025) 4","venue":null,"work_id":"9fc42e4c-4aef-49aa-88cd-7ca1c6041f2e","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:b825abc412df61c6e2ec056814609c434e4459f4ff57f4101795dc31f5fed54e","observation_id":"63d7295d-69c5-48bc-acf8-96484e3a2335","resolution":{"observed_at":"2026-05-13T17:23:02.461864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19813","doi":"10.48550/arxiv.2508.19813","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ArXivabs/2508.19813(2025),https://api.semanticscholar.org/CorpusID: 2809185872","venue":"arXiv (Cornell University)","work_id":"1f500d6d-1523-4788-be03-c4945010947c","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:eff6b81dd1ebf3d8be5b3877a4bba244ec4b0dc00bce28a1cb77eeb5e5f1d668","observation_id":"9b85669d-b78a-46a0-a2c5-db65541c3769","resolution":{"observed_at":"2026-05-13T17:23:02.465775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.013264","doi":"10.48550/arxiv.2406.013264","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"CoRRabs/2406.01326(2024).https://doi.org/10.48550/ ARXIV.2406.01326,https://doi.org/10.48550/arXiv.2406.013264, 5, 6","venue":null,"work_id":"fd140957-8852-4aa5-aa43-305e04fee556","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:3553c1891869d2382432c0e6c3953ac0fad1ef657503492383698b2e904fe7c2","observation_id":"1a80d085-970b-47c8-bfd7-b556e8a2f49a","resolution":{"observed_at":"2026-05-13T17:23:02.022956Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Findings of the Association for Computational Linguistics: IJCNLP-AACL 2023 (Findings)","venue":null,"work_id":"d7285ac4-a8e3-45ca-b569-53b4972be747","year":2023},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:310e0aadba6ac7d8492f988d02fb67d39e9150982cff133b3b5d3496c16482e8","observation_id":"6fcf02ca-2642-423d-bf70-4d968b7ab0af","resolution":{"observed_at":"2026-05-14T05:07:15.145979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"c2a9faa1-eccd-4992-ada5-7bda979a72df","year":2024},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:0394f91761cc4e9ba0043980241f5e8dea3f33d65b28e63d7098c95e8e4a4db8","observation_id":"09fad102-1052-45a1-8279-5fa9ca1063d2","resolution":{"observed_at":"2026-05-14T05:07:15.147975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2505.14362","doi":"10.48550/arxiv.2505.14362","metadata_source":"pith","pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","venue":"cs.CV","work_id":"5f6cf57b-2407-4127-b39c-d8a61494e474","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:ae785108ac1da66a58ba58a167953c1f851a6e4b74eb964d8e2d678b37d69a45","observation_id":"ae16582b-6256-4a59-a8af-f0c089cfc7bb","resolution":{"observed_at":"2026-05-13T17:23:02.474802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European conference on computer vision","venue":null,"work_id":"f11c155b-0dd7-43b2-b961-3c1b9ff47682","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:44db6e5fe732e95f614c98a1daf33634c7cc8885a207e984857e691af6a2c9fc","observation_id":"ba81c1f9-869c-4904-a602-cc88d64dd4c8","resolution":{"observed_at":"2026-05-14T05:07:15.151755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the European Conference on Com- puter Vision (ECCV) (2020),https://api.semanticscholar.org/CorpusID: 2082678585, 6","venue":null,"work_id":"c395c016-89f9-4c1c-9000-7935027896db","year":2020},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:09d2f11112191bffcec5fa2dab7d923ba46303ab4caba0c7ecb778d69a719654","observation_id":"694b2875-fd9e-4dcc-bd36-ea54d9fb23e5","resolution":{"observed_at":"2026-05-14T05:07:15.139874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the ACL (2021) 5, 6","venue":null,"work_id":"7a630e74-bdf8-4707-9cc6-a17ca982d561","year":2021},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:9c6e183baeba5595bf836b733a67267e8a256e9d58cdf89fc06dab0345ca56dd","observation_id":"155776ff-a3e9-43d6-998d-7bb11b47b4d6","resolution":{"observed_at":"2026-05-14T05:07:15.149878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T17:20:28.036531Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2604.03660"},"observation_digest":"sha256:efa61dd6e7a743735b57ea769a214bea138a99d34c2dce5e66f45f4aa2cc47d5","observation_id":"3104be28-c9b3-42bf-9aa0-6cc98bb7a6ca","resolution":{"observed_at":"2026-05-13T17:23:02.468752Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03660","last_updated":"2026-04-04T09:26:09Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T09:26:09Z","title":"TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":1,"metadata_mismatch":16,"parse_uncertain":0,"unresolved":5,"verified_exact":13,"verified_fuzzy":27},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2604.03660."}