{"as_of":"2026-08-07T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97a4123ac97adffb63c98a46d1ebd780fb62e516ffb90a6d67036dba19d1440b","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:12:12.857120Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T01:20:57.490329Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T13:36:09.441352Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.19469","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19469","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Surgery-r1: Ad- vancing surgical-vqla with reasoning multimodal large lan- guage model via reinforcement learning","venue":null,"work_id":"9d82352b-f3b1-4f17-8167-f6597499a356","year":2025},"citing_paper":{"arxiv_id":"2604.20319","last_updated":"2026-04-22T08:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T08:18:21Z","title":"SurgCoT: Advancing Spatiotemporal Reasoning in Surgical Videos through a Chain-of-Thought Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T01:20:57.490329Z"},"links":{"cited_paper":"/paper/2506.19469","citing_paper":"/paper/2604.20319"},"observation_digest":"sha256:764a2569e1f61f28f0a73b547cef09eb5ba54353e581577ca0e0c40ef330a063","observation_id":"a0d79053-ef30-4d96-8b51-effcfd95991b","resolution":{"observed_at":"2026-05-11T13:36:09.445468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19469/citation-record","integrity":"/paper/2506.19469/integrity","json":"/paper/2506.19469/citation-record.json","paper":"/paper/2506.19469"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.166268Z","title":"Concepts and trends in autonomy for robot-assisted surgery,","venue":null,"work_id":"4f071d3e-6648-4ad3-b434-6403a113bb6d","year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.340298Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:8888797533dacbe13ae28caba5ca90ff666e68efaacc29e6311ebaf664dae3c7","observation_id":"bd697da2-b79a-442a-b65f-f0e3d050d967","resolution":{"observed_at":"2026-08-06T23:12:14.173621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:11.376982Z","title":"Video-instrument synergistic network for referring video instrument segmentation in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.376982Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:d5e409b52d959d7c2ac92f76bb113cb96e4348d3ee15e03a748f93120b4d91b7","observation_id":"cfd39512-8508-47db-8ef8-20a0cb87cf53","resolution":{"observed_at":"2026-08-06T23:12:11.376982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.14886","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.750067Z","title":"Surgical scene understanding in the era of foundation ai models: A comprehensive review,","venue":null,"work_id":"72f8a241-a9e3-454a-b3b8-f3abb57dc47d","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.489433Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:6ec534dd59470475d1ecc7e95537f07344db396b70a52e1af623210b5e7821b5","observation_id":"ab67220b-0ff0-411a-9e3a-34e603e06a02","resolution":{"observed_at":"2026-08-06T23:12:13.764243Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.125863Z","title":"Dynamic interactive relation capturing via scene graph learning for robotic surgical report generation,","venue":null,"work_id":"32f570cc-1939-4aeb-ba58-bc82ce0afd67","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.593164Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:04e2123165e6d253cd905e5f5235000e50db9fffcc2e96172a1aa5c2faf2220a","observation_id":"6e8a677e-16a2-4d2f-a440-12d07a17961a","resolution":{"observed_at":"2026-08-06T23:12:14.134619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.093151Z","title":"Surgical-vqla: Trans- former with gated vision-language embedding for visual question localized-answering in robotic surgery,","venue":null,"work_id":"7c1e2676-4c69-482c-9c6f-59e566a9f9bd","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.688527Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:26db2d713e0468f7bec6444df36d4013c86830b4b8db00d0b7257db1e5e30e81","observation_id":"e760edad-c1b7-4f84-80bd-7371f65f92d5","resolution":{"observed_at":"2026-08-06T23:12:14.104660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.068424Z","title":"Cat-vil: co-attention gated vision- language embedding for visual question localized-answering in robotic surgery,","venue":null,"work_id":"f2e1336c-eb62-4f8e-8e5d-b6bdbbe778db","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.782589Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ce261253447eae34ed148021566d73b227ddd9c783aa84f889fc96b2291539ce","observation_id":"b681fea7-dda6-461b-8703-b9b884e2920c","resolution":{"observed_at":"2026-08-06T23:12:14.076170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.035055Z","title":"Enhancing visual reasoning with llm-powered knowledge graphs for visual question localized-answering in robotic surgery,","venue":null,"work_id":"e83cebaa-cbb3-4433-bfa3-5a39c96f70c0","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.844089Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:e205d82eb042468c5ccabfd0d6337e25fb6e563d330079dbd5c71aaa1aa591b9","observation_id":"d6747373-95e1-489d-b022-668002a275f4","resolution":{"observed_at":"2026-08-06T23:12:14.043677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T23:12:11.980924Z","title":"Gpt-4 technical report. arxiv 2303.08774,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:11.980924Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a45e643a1fb9b3f3ae6ff405a0b2193cbd401ff9a8922691b8fd29839f33db5c","observation_id":"29dac86e-9eab-47d5-898c-2b4ae9589523","resolution":{"observed_at":"2026-08-06T23:12:11.980924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T23:12:12.114296Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.114296Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:aea7ca045cbfd6443221e9e81afa6080b23846ccb197c427e583a7a6535e8b53","observation_id":"784c6ea1-a4cb-4e60-acf0-64322a506138","resolution":{"observed_at":"2026-08-06T23:12:12.114296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16664","last_updated":"2024-10-23T16:27:48Z","snapshot_observed_at":"2026-08-07T03:46:19.220558Z","submitted_at":"2024-02-26T15:35:24Z","title":"LLM-Assisted Multi-Teacher Continual Learning for Visual Question Answering in Robotic Surgery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16664","snapshot_observed_at":"2026-08-06T23:12:12.276314Z","title":"Llm-assisted multi-teacher continual learning for visual question answering in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.276314Z"},"links":{"cited_paper":"/paper/2402.16664","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:b0ca9ec222cf4ff23cc463fc53e676d538f589d5c3933071743764c3c974be2a","observation_id":"911b0418-63a3-4064-8520-d5ed2a09d0d5","resolution":{"observed_at":"2026-08-06T23:12:12.276314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T23:12:12.352837Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.352837Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7cbe41197f5a5b06da7abc330f3f2dfc067708b5a562ca69fad7e8ce304a0a68","observation_id":"7742205c-8c04-4a3b-b966-e500c0e12a92","resolution":{"observed_at":"2026-08-06T23:12:12.352837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:14.009243Z","title":"Otter: A multi-modal model with in-context instruction tun- ing,","venue":null,"work_id":"542154a5-6129-4b5d-be95-a40a1f62eb85","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.483938Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:e0f7e8da36efbe11d9a85939d3ca1c86f2e5059ca183e3465d99b44e609ff51d","observation_id":"4eca0bd3-3398-41b4-a2a1-434f4c374f34","resolution":{"observed_at":"2026-08-06T23:12:14.017830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10948","last_updated":"2025-03-16T02:23:30Z","snapshot_observed_at":"2026-08-03T12:44:11.709304Z","submitted_at":"2024-03-22T08:38:27Z","title":"Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10948","snapshot_observed_at":"2026-08-06T23:12:12.503145Z","title":"Surgical-lvlm: Learning to adapt large vision-language model for grounded visual question answering in robotic surgery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.503145Z"},"links":{"cited_paper":"/paper/2405.10948","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:39d33e29b375783e97e881351a17c7c31b7ecbe78c6d8c1b2ccdb5cb422a0d69","observation_id":"7d6a7c04-3975-4b2c-8d0f-bf7970b85d68","resolution":{"observed_at":"2026-08-06T23:12:12.503145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11347","last_updated":"2025-03-15T02:35:48Z","snapshot_observed_at":"2026-07-06T20:23:18.251842Z","submitted_at":"2025-01-20T09:12:06Z","title":"EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11347","snapshot_observed_at":"2026-08-06T23:12:12.627569Z","title":"Endochat: Grounded multimodal large language model for endoscopic surgery,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.627569Z"},"links":{"cited_paper":"/paper/2501.11347","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:720ff6413390a37e58ead73a1a9f2aeb6d833c45cb811dc5a24ed0b4a7bdea63","observation_id":"5cf0f6de-075d-481a-aa46-24909667bbcb","resolution":{"observed_at":"2026-08-06T23:12:12.627569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-06T23:12:12.655869Z","title":"A survey on hallucination in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.655869Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ad714593a6e8ec3b5e00a33020d59af22e165daadd369696e0bd4b3f792588a7","observation_id":"163e1094-d61a-4214-b2e8-7daf56552e77","resolution":{"observed_at":"2026-08-06T23:12:12.655869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T23:12:12.661327Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.661327Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:2251fd7933a96e97a3b4241b2ef35fcc2c5b3a519bf8321e226272ff9a6d1f51","observation_id":"95a736b1-c5fa-41f9-a2f3-36bc164ccf8e","resolution":{"observed_at":"2026-08-06T23:12:12.661327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:12:12.668699Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.668699Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:fd49c12b33d4ad47eeca2a98b6baf47008bc5ab191bc5bccbb80276ea7d1f141","observation_id":"edabc439-2543-4743-b1a0-17d8b09e2f00","resolution":{"observed_at":"2026-08-06T23:12:12.668699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14135","last_updated":"2024-12-18T18:24:47Z","snapshot_observed_at":"2026-08-03T23:00:22.560900Z","submitted_at":"2024-12-18T18:24:47Z","title":"Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14135","snapshot_observed_at":"2026-08-06T23:12:12.674901Z","title":"Scaling of search and learning: A roadmap to reproduce o1 from reinforcement learning perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.674901Z"},"links":{"cited_paper":"/paper/2412.14135","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:c7321c39a72fb0b8ebc38b09f419476d337220d56a1934992a3452cd4f6b11e3","observation_id":"9984e66c-a7c6-402c-8922-84dea3f6083e","resolution":{"observed_at":"2026-08-06T23:12:12.674901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T23:12:12.682873Z","title":"Automatic chain of thought prompting in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.682873Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:9133b64cb408bc202355eb2d757663e8c5a787a9ab3d65bd68fc02481ef7083a","observation_id":"ecbf9516-801e-4646-90d2-b0560d9acc53","resolution":{"observed_at":"2026-08-06T23:12:12.682873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-06T23:12:12.688769Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.688769Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:046a7d72c6fb8862d12d302a8c48e8b0ab640e44d33eb9c5d136023d6bfadfd7","observation_id":"6a9393af-ed01-4f5b-b4d7-83a19c9309e6","resolution":{"observed_at":"2026-08-06T23:12:12.688769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18013","last_updated":"2025-03-23T10:21:14Z","snapshot_observed_at":"2026-08-03T15:36:35.615655Z","submitted_at":"2025-03-23T10:21:14Z","title":"Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18013","snapshot_observed_at":"2026-08-06T23:12:12.695884Z","title":"Vision-r1: Evolving human-free alignment in large vision- language models via vision-guided reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.695884Z"},"links":{"cited_paper":"/paper/2503.18013","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:5c0f61d53f419785128f198b7e5fac0dc1b0654ddcd93ec7b1958092c14c6b04","observation_id":"11926f27-4162-4895-8f2b-c855a4d22f50","resolution":{"observed_at":"2026-08-06T23:12:12.695884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-06T23:12:12.708747Z","title":"Video-r1: Reinforcing video reasoning in mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.708747Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:312432665c258dd0156aa668759559dc6cc34dcd7324c141b3d4b56322715e5c","observation_id":"14e73cbf-1563-4072-b7dd-1fb2720c3fb2","resolution":{"observed_at":"2026-08-06T23:12:12.708747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.715293Z","title":"Med-r1: Reinforcement learning for generalizable medical reasoning in vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.715293Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:21b897597c870de28bef4e4ffdbabbee388e5d2c9e0f453b7d59f467c10c9a6d","observation_id":"1378fa37-0922-4fe9-bf05-d13e38584077","resolution":{"observed_at":"2026-08-06T23:12:12.715293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-06T23:12:12.721082Z","title":"Huatuogpt-o1, towards medical complex reasoning with llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.721082Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a4440b3ad9e9f0bdcdb33406d0ec285fe8b7b8d9495695b08460acf3908458d5","observation_id":"427df6e0-825a-431b-9410-84e29b6a4a42","resolution":{"observed_at":"2026-08-06T23:12:12.721082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-07-06T16:29:39.982733Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-06T23:12:12.727040Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.727040Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:6bfeeb2d6c9f2374d41ffa315ac8cc10b79667acaf659f490b03373317937427","observation_id":"cc933ffa-6545-4645-ae21-a3a1bff3e0ed","resolution":{"observed_at":"2026-08-06T23:12:12.727040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:12:12.732788Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.732788Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:3e99701590b401316726ad66879c51b9c2702e577736a706bbf1de8298897012","observation_id":"9a515ed5-d779-42ea-908a-6b772492f5c1","resolution":{"observed_at":"2026-08-06T23:12:12.732788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T23:12:12.739097Z","title":"Aligning large multimodal models with factually augmented rlhf,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.739097Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:eadd73f2c8fbddd0c41c3f13fc9c3d84b1a4f0d58f9106af7c2f0d40b9b978c0","observation_id":"9a80e5d9-411f-4fdd-8c1a-0c49d5ae2f18","resolution":{"observed_at":"2026-08-06T23:12:12.739097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.745011Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.745011Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:2b6154f5e4533c61e754165add6cc88634c34b5beda97fb76fef816b6e690fc9","observation_id":"c5d0ac4f-3bda-4696-bd88-3e959df2a637","resolution":{"observed_at":"2026-08-06T23:12:12.745011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01584","last_updated":"2024-10-15T01:16:20Z","snapshot_observed_at":"2026-07-06T18:24:38.958815Z","submitted_at":"2024-06-03T17:59:06Z","title":"SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01584","snapshot_observed_at":"2026-08-06T23:12:12.750753Z","title":"Spatialrgpt: Grounded spatial reasoning in vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.750753Z"},"links":{"cited_paper":"/paper/2406.01584","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a87a5e8a69b46b114967a3eb4ab952bd69eda6a3a3f514a30e0696020bfe2d39","observation_id":"1cb6f7bd-1dfe-4715-881b-fbe525c78b9a","resolution":{"observed_at":"2026-08-06T23:12:12.750753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14171","last_updated":"2025-07-02T21:00:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:59:54Z","title":"Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14171","snapshot_observed_at":"2026-08-06T23:12:12.756251Z","title":"Thinking in space: How multimodal large language models see, remember, and recall spaces,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.756251Z"},"links":{"cited_paper":"/paper/2412.14171","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:4dfd50e127f5b3c3ab6e3ee3785374af6a820575def2b75e32bd3c39b97bcd7a","observation_id":"364724d7-0984-4df3-9e81-5a3c1ade3d92","resolution":{"observed_at":"2026-08-06T23:12:12.756251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.972989Z","title":"Langloc: Language-driven localization via formatted spatial description genera- tion,","venue":null,"work_id":"68cddae4-5216-4562-87f5-057e11f928b4","year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.761595Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:ee10396955f064b4cc410219c536852448222497b4ac6056a11c7aa9fc9bd6e7","observation_id":"05c073c1-fc3b-49ff-bc03-159e8a3a529f","resolution":{"observed_at":"2026-08-06T23:12:13.980112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T23:12:12.768154Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.768154Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:f6c8492226706a1789e1c8203eacb6374a7c9cc30e447300af298db83dbf3e59","observation_id":"f5101bf7-41c8-4e75-9dd1-4178d6f09b16","resolution":{"observed_at":"2026-08-06T23:12:12.768154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.912172Z","title":"Surgical-vqa: Visual question answering in surgical scenes using transformer,","venue":null,"work_id":"6ed5ccb4-c09d-47b5-a3be-2e99f3e419b5","year":2022},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.779282Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:90d56280a797051c44f903ef9f9688dcf298261182a375ad550325e0689e3c94","observation_id":"4352587b-6c54-497e-849a-5a90884d80bb","resolution":{"observed_at":"2026-08-06T23:12:13.922312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.889978Z","title":"Beyond bilinear: Generalized multimodal factorized high-order pooling for visual question answering,","venue":null,"work_id":"223a05e1-a2a3-49a5-a5ff-553f2e3cfecf","year":2018},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.784644Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:7dd3487bd2e15e29b8274315de703be580d54574fdf48e2d66956c83463cd392","observation_id":"dbc56a84-e3da-4f42-b0f6-cc6eef8646df","resolution":{"observed_at":"2026-08-06T23:12:13.895806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.867519Z","title":"Block: Bilinear superdiagonal fusion for visual question answering and visual relation- ship detection,","venue":null,"work_id":"ffba0590-d608-4a0e-a1bb-b3ba2c7f1f75","year":2019},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.791470Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:08519be8616f64d2006d6d555895a3ae8e97d5221f8b29730859ab2879c11f27","observation_id":"7c35949f-2a47-494d-85cf-98290fc3d337","resolution":{"observed_at":"2026-08-06T23:12:13.872822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.848793Z","title":"Mutan: Multi- modal tucker fusion for visual question answering,","venue":null,"work_id":"daaab9d1-cfa4-4baa-95c0-d475c52c6571","year":2017},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.798619Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:91dcac6e2ec4e48c1c4d967e3e472ed2c76ff640a9d6111d9425ad4f951f5e7a","observation_id":"fb416d27-3a48-4e2d-ac3e-5d2fd8e00d98","resolution":{"observed_at":"2026-08-06T23:12:13.854178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:13.825504Z","title":"Surgicalgpt: end- to-end language-vision gpt for visual question answering in surgery,","venue":null,"work_id":"aa2a5c2a-0dea-4978-bd4a-e97139c2c8b2","year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.807977Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:3998bd4d081579c32352f5d4fbc76f6bed12e363c6e9f678804debd162f0ae20","observation_id":"64124cf8-9188-46a3-8933-19be1b1d7bec","resolution":{"observed_at":"2026-08-06T23:12:13.832918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11190","last_updated":"2020-08-03T01:55:24Z","snapshot_observed_at":"2026-08-05T21:16:20.262505Z","submitted_at":"2020-01-30T06:37:07Z","title":"2018 Robotic Scene Segmentation Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.11190","snapshot_observed_at":"2026-08-06T23:12:12.816231Z","title":"2018 robotic scene segmentation challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.816231Z"},"links":{"cited_paper":"/paper/2001.11190","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:1270661076f818c2db225d37589eb3bb603a8bc620e76e721437a5d00602eec8","observation_id":"464c2954-80a4-47f8-b714-e862ca54a132","resolution":{"observed_at":"2026-08-06T23:12:12.816231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06426","last_updated":"2019-02-21T17:01:02Z","snapshot_observed_at":"2026-07-06T07:33:44.696417Z","submitted_at":"2019-02-18T07:08:36Z","title":"2017 Robotic Instrument Segmentation Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06426","snapshot_observed_at":"2026-08-06T23:12:12.826059Z","title":"2017 robotic instrument segmentation challenge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.826059Z"},"links":{"cited_paper":"/paper/1902.06426","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:b833518856930c7fe864f40bc2e4c6c757dd64f25a54b431a5c11a23b2e6296d","observation_id":"30b3032c-54da-4f24-9c6c-e35bcac52831","resolution":{"observed_at":"2026-08-06T23:12:12.826059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.832743Z","title":"A review on evaluation metrics for data classification evaluations,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.832743Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:72704acafbbbaa933bc08b30907e7b6a513600beb2019ab05cfd2bf336197e8d","observation_id":"ada20978-0cb4-447c-8932-df36c11596fe","resolution":{"observed_at":"2026-08-06T23:12:12.832743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.838951Z","title":"Generalized intersection over union: A metric and a loss for bounding box regression,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.838951Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:a5c941507ccdfbb53785b298374ea14ffd42a9be257deb5eec8906754b6baed5","observation_id":"6470ce9e-7fcf-41e3-a7e1-6d99c2e56055","resolution":{"observed_at":"2026-08-06T23:12:12.838951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.845636Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.845636Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:1991d3d7367fb666ddb2e93b4697595368e3d7af5e0b30a7e0e86f8a7d4689fd","observation_id":"ad8bc998-1407-4e1c-b31a-b1a81205c427","resolution":{"observed_at":"2026-08-06T23:12:12.845636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:12:12.850954Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.850954Z"},"links":{"citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:6a66dcd765661f354c2a1a8a3262fa8a0853149bf93620eff9a47d9b391729f0","observation_id":"94b649a3-3737-4dbc-8bd3-1c8d53c93269","resolution":{"observed_at":"2026-08-06T23:12:12.850954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:12:12.857120Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:12.857120Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.19469"},"observation_digest":"sha256:724893b5075785935788bb33aa36c1c283d21b5af5d77b1ff841700ef1296b2f","observation_id":"c18551c6-e599-4abc-8a1d-48fd6edc248a","resolution":{"observed_at":"2026-08-06T23:12:12.857120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19469","last_updated":"2025-06-24T09:53:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:04:35.654096Z","submitted_at":"2025-06-24T09:53:10Z","title":"Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.19469."}