{"as_of":"2026-08-08T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:482db9f9b2554696c1eb100eba530857b1cd95e3c4277b53ec79342bb3cd8f37","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:11:47.567352Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19610/citation-record","integrity":"/paper/2506.19610/integrity","json":"/paper/2506.19610/citation-record.json","paper":"/paper/2506.19610"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.166929Z","title":"Bioengineering10(3), 380 (2023)","venue":null,"work_id":"a9c409f4-21bf-4978-a3c9-05fba9610101","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:44.768365Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:1f2ba4b6645fb13a0a7d773bdda3dc6d9466f8c530add40174552daac4b485e5","observation_id":"ab56e807-9636-4f1f-981d-6d0a99227a15","resolution":{"observed_at":"2026-08-06T23:11:49.170078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.156660Z","title":null,"venue":null,"work_id":"df8b8472-bf88-4d80-9038-eb7d637c5b8c","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:44.868836Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:8d01e9eaf9f7e65eb58026b0b3c47b522424790f99105bf3ad11fc30c3aa90ed","observation_id":"a6a3105e-3854-465d-a957-c39abe0c93e6","resolution":{"observed_at":"2026-08-06T23:11:49.160172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:45.025910Z","title":"In: Proceedings of CLEF (Conference and Labs of the Evaluation Forum) 2019 Working Notes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.025910Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:8bbd923f5cd45bbeb8ecadeb8c0faeff8cc8d8140b038529b0b157208ab01027","observation_id":"84c6fdfe-414f-4330-af3e-514dda1370df","resolution":{"observed_at":"2026-08-06T23:11:45.025910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.139224Z","title":null,"venue":null,"work_id":"f6e454f7-f4bb-4c2c-988a-2d222c331a35","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.148638Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:5a1f06899061136b51bcf7912e45c62fabfff459adf681f1239033244062ee3d","observation_id":"c68ae7ef-836f-404b-b4b2-912b239138f2","resolution":{"observed_at":"2026-08-06T23:11:49.142649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.129148Z","title":"In: Proceedings of the 30th ACM Interna- tional Conference on Multimedia","venue":null,"work_id":"88a7729f-2695-44a7-b71f-1653fa84c9ee","year":2022},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.249200Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:54d6f5e18923f4a8dd0e07c2dece45cd994637d292d9f9a04ff697111aa1f01c","observation_id":"b63ea16b-2ae9-4bde-8a62-abac6fcbf0e0","resolution":{"observed_at":"2026-08-06T23:11:49.132801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.118894Z","title":null,"venue":null,"work_id":"f8a7a9f9-979f-4de2-af86-b5472259337f","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.327589Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:c4c806b2727b15ba2607ccb9ddba0b681e3e0ef80b55e5865eeecd006a8d2082","observation_id":"bd5b26cd-3434-4955-b29e-29e95e6ea24f","resolution":{"observed_at":"2026-08-06T23:11:49.122495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12372","last_updated":"2024-10-07T08:06:13Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:53:19Z","title":"MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12372","snapshot_observed_at":"2026-08-06T23:11:45.441753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.441753Z"},"links":{"cited_paper":"/paper/2404.12372","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:c3216be35ebbb21d2f512631e78a4274e08c0e8bdfb93e659107eed3108f8392","observation_id":"3a035e3b-4228-4493-8483-3955a0358e9c","resolution":{"observed_at":"2026-08-06T23:11:45.441753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.108451Z","title":"In: Proceedings of the 2021 International Conference on Multimedia Retrieval","venue":null,"work_id":"aa6ba820-42a5-4f6b-8a96-d92d628820c7","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.507395Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:18218faa5975f354b6b2c7ae3cbc3cae7e6481c04c6aa562ce237d84b0a9c46f","observation_id":"583f5383-bba9-4dc3-8ab2-e580f165b55b","resolution":{"observed_at":"2026-08-06T23:11:49.112114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.097923Z","title":null,"venue":null,"work_id":"593f838a-0109-4636-bf14-53d11faf6d5c","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.553423Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:59330122a6f148409ea2aad608b4e47356f5cde2ac36d6aca89b9bdab8d36d18","observation_id":"7f1c79f9-f699-45fe-ab6b-281d42a87bb6","resolution":{"observed_at":"2026-08-06T23:11:49.101468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02797","last_updated":"2025-01-16T02:31:20Z","snapshot_observed_at":"2026-07-06T17:11:58.725249Z","submitted_at":"2024-01-05T13:22:12Z","title":"PeFoMed: Parameter Efficient Fine-tuning of Multimodal Large Language Models for Medical Imaging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02797","snapshot_observed_at":"2026-08-06T23:11:45.618607Z","title":"arXiv preprint arXiv:2401.02797 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.618607Z"},"links":{"cited_paper":"/paper/2401.02797","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:3a7e2bc21ef1ca1ac4ca29747f281d4cada1f38b57fb46ba6ff854bd8541b261","observation_id":"af359957-d2aa-45cc-be68-3ad557b436f3","resolution":{"observed_at":"2026-08-06T23:11:45.618607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-06T23:11:45.674583Z","title":"arXiv preprint arXiv:2003.10286 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.674583Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:5ed5874f685eb129f4abcb821fb61cf4f38e66c399cbc0bd19998fdf07d539c6","observation_id":"c1e378e8-b54f-4da4-a4c8-fdc492abbda2","resolution":{"observed_at":"2026-08-06T23:11:45.674583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12849","last_updated":"2025-06-15T13:42:46Z","snapshot_observed_at":"2026-08-07T00:34:09.105878Z","submitted_at":"2025-06-15T13:42:46Z","title":"CAPO: Reinforcing Consistent Reasoning in Medical Decision-Making","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12849","snapshot_observed_at":"2026-08-06T23:11:45.745150Z","title":"arXiv preprint arXiv:2506.12849 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.745150Z"},"links":{"cited_paper":"/paper/2506.12849","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:89be842f3319966e86cecfdc49168ee546416dc3c506ac9de31b2ec3207579cc","observation_id":"ac4bee25-5ee2-430f-a2cf-f2470ebc54a0","resolution":{"observed_at":"2026-08-06T23:11:45.745150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14692","last_updated":"2025-04-20T17:53:56Z","snapshot_observed_at":"2026-08-07T16:00:45.181263Z","submitted_at":"2025-04-20T17:53:56Z","title":"OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14692","snapshot_observed_at":"2026-08-06T23:11:45.867138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.867138Z"},"links":{"cited_paper":"/paper/2504.14692","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:c0414ecc4796a13e7c261f8ba575bd52215a93a045253049caed94fabe4340a2","observation_id":"2d9ee975-fa18-4d4f-be38-500cc7621c67","resolution":{"observed_at":"2026-08-06T23:11:45.867138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15334","last_updated":"2025-06-06T02:50:17Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T08:56:52Z","title":"Modality-Fair Preference Optimization for Trustworthy MLLM Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15334","snapshot_observed_at":"2026-08-06T23:11:45.902077Z","title":"arXiv preprint arXiv:2410.15334 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.902077Z"},"links":{"cited_paper":"/paper/2410.15334","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:636616bc13d4094cdee6321d9b7c9023865c6272e9ee5ceb61486fbda98c8c06","observation_id":"6aff2449-e255-4017-98b9-686c20e5728c","resolution":{"observed_at":"2026-08-06T23:11:45.902077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00805","last_updated":"2025-06-01T03:11:00Z","snapshot_observed_at":"2026-08-07T11:55:19.489761Z","submitted_at":"2025-06-01T03:11:00Z","title":"HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00805","snapshot_observed_at":"2026-08-06T23:11:45.967272Z","title":"arXiv preprint arXiv:2506.00805 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:45.967272Z"},"links":{"cited_paper":"/paper/2506.00805","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:7c5e9f948cc13ce38ec51b98328ecb01e005160bd997851df129fa3c6d746e38","observation_id":"05ccbcef-1e70-4497-beca-28d787d1beef","resolution":{"observed_at":"2026-08-06T23:11:45.967272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04514","last_updated":"2024-04-06T05:59:02Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T05:59:02Z","title":"Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04514","snapshot_observed_at":"2026-08-06T23:11:46.047700Z","title":"arXiv preprint arXiv:2404.04514 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.047700Z"},"links":{"cited_paper":"/paper/2404.04514","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:a7bf833faecff2cc792c77604a957d15c4e64d0c51e65c50c7813c4aa9512b4d","observation_id":"a1ad24e4-5e56-4f70-b626-6dd19f423b2c","resolution":{"observed_at":"2026-08-06T23:11:46.047700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.129278Z","title":"In: Find- ingsoftheAssociationforComputationalLinguistics:EMNLP2024.pp.3843–3860 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.129278Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:dc4d89c65ffef98127abbd7044742cddea6c6a8ad963095ed783fc6b67489ce5","observation_id":"36c18eee-4a13-49c9-928b-81b84b7c3ca5","resolution":{"observed_at":"2026-08-06T23:11:46.129278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.081661Z","title":"In: 2021 IEEE 18th International Symposium on Biomedical Imaging","venue":null,"work_id":"a8fa9967-2185-4697-b3a9-9753d6cd96fd","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.217100Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:357357810a3329b2a5171e1861ea01bd88d1d100920e3c83fe39ed466de77390","observation_id":"41723efb-3d81-4335-9be6-82f2a54d54f0","resolution":{"observed_at":"2026-08-06T23:11:49.084777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01394","last_updated":"2021-04-03T13:01:19Z","snapshot_observed_at":"2026-08-08T15:51:22.683833Z","submitted_at":"2021-04-03T13:01:19Z","title":"MMBERT: Multimodal BERT Pretraining for Improved Medical VQA","version":1},"cited_work":{"arxiv_id":"2104.01394","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.01394","snapshot_observed_at":"2026-08-06T23:11:48.054339Z","title":"MMBERT: Multimodal BERT Pretraining for Improved Medical VQA","venue":"cs.CV","work_id":"8d94e50a-c351-490f-b2df-92f042278c9a","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.281433Z"},"links":{"cited_paper":"/paper/2104.01394","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:c45b30e1300c61344926cbc19134180bb96260e743e968144e9d9448d00c3999","observation_id":"907dee4b-530d-4b2f-8235-66046f6decaa","resolution":{"observed_at":"2026-08-06T23:11:48.140882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.343641Z","title":"Scientific data 5(1), 1–10 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.343641Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:defc031429c7e6e4cf85e4f8b8daae5ec5d9339638eafa1b356fff65ccc4179d","observation_id":"9499a12e-5bc1-4ac7-a1f0-08f8c80da03a","resolution":{"observed_at":"2026-08-06T23:11:46.343641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-07-29T15:30:39.490502Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-06T23:11:46.434701Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.434701Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:0a97917233297875a67a65c427b3d807933aa65b57c5269ffb33667427ba186b","observation_id":"48700bed-40d1-49b6-abc6-a5f6e4b9c8ae","resolution":{"observed_at":"2026-08-06T23:11:46.434701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.505899Z","title":"Advances in Neural Information Processing Systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.505899Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:9dcb4b39956c4636020d895b8a8dc65d9b2778d441eac42fad8b400584f3d59a","observation_id":"5bb856c1-a65a-49e2-bb9b-12c4eed75918","resolution":{"observed_at":"2026-08-06T23:11:46.505899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.057811Z","title":"In: 2022 IEEE/CVF Conference on Computer Vision and Pattern Recog- nition (CVPR)","venue":null,"work_id":"52cbd2bb-fcb2-412c-bc2c-0fb76ad02f52","year":2022},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.560639Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:ea985443e4834007455c7c4df827c1a9a768b22a4206b085f94f565288ce197d","observation_id":"4dd45ddd-ee77-47ea-ada8-2bd1d24afc79","resolution":{"observed_at":"2026-08-06T23:11:49.061186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.047162Z","title":null,"venue":null,"work_id":"023da7a0-03a9-435a-a80a-b79319c3330e","year":2021},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.642266Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:ad45cf3e25e13c4e5e12daf7defe4925a42844bea525c69e8bad8594c53d3ad3","observation_id":"1aefe957-281a-4481-b57e-97e3862d2a1a","resolution":{"observed_at":"2026-08-06T23:11:49.051084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:46.699157Z","title":"Advances in neural information processing systems36 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.699157Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:4d96a12918fdde83fce2c1be67f45837935ea7315f1d9af79538f8d995a1c403","observation_id":"abfcf717-2264-48c7-bf28-afcd04f3ab78","resolution":{"observed_at":"2026-08-06T23:11:46.699157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.027893Z","title":"IEEE Transactions on Emerging Topics in Computational Intelligence (2023)","venue":null,"work_id":"fc8eebf6-6e82-474c-bc48-469ff8429624","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.761213Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:a9a1f78961aa46d3d0dd52c7dc2ec3ae68845ab8263dc26a47e1e4d7ea1e8f40","observation_id":"525e39b5-42f0-4e47-85ff-be14166875d5","resolution":{"observed_at":"2026-08-06T23:11:49.031564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.016208Z","title":"In: Proceedings of the 2024 Conference on Empirical Meth- ods in Natural Language Processing","venue":null,"work_id":"16587802-4c04-471c-8463-16e14a46ba5c","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.838851Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:b79a16e07afdffa58f9c15c2795a10cdb0dd858acf23f22257526bd69eed75bb","observation_id":"1fdbe272-5dd9-4c0f-867c-aa27783ce246","resolution":{"observed_at":"2026-08-06T23:11:49.020016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:49.003732Z","title":"Nature Medicine pp","venue":null,"work_id":"ab14d3d3-7f0c-4e0f-a59b-0a4f1db40d5f","year":2025},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.886937Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:d4c0e4df247f8251d0b929d69979c1f1e7aa026ff18a247fd118f27ec40560a4","observation_id":"f051e981-0bbe-44cf-9129-c5cf56c847e3","resolution":{"observed_at":"2026-08-06T23:11:49.007501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.963364Z","title":"In: International Conference on Information Processing in Medical Imaging","venue":null,"work_id":"9b01560e-12f2-445d-b210-e9c0ac294a02","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:46.977415Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:eb1dcdff23ad083269449a6f80b31a5ab14af3514216b950f17233b916b396a6","observation_id":"633ddd3c-5e6c-4c34-9d03-0f89e8c9c69d","resolution":{"observed_at":"2026-08-06T23:11:48.996409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15011","last_updated":"2023-12-22T18:59:58Z","snapshot_observed_at":"2026-07-06T17:07:23.809593Z","submitted_at":"2023-12-22T18:59:58Z","title":"Gemini vs GPT-4V: A Preliminary Comparison and Combination of Vision-Language Models Through Qualitative Cases","version":1},"cited_work":{"arxiv_id":"2312.15011","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.15011","snapshot_observed_at":"2026-08-06T23:11:47.747486Z","title":"Gemini vs GPT-4V: A Preliminary Comparison and Combination of Vision-Language Models Through Qualitative Cases","venue":"cs.CV","work_id":"e18aad01-51e8-478a-8cfe-b5d0a0ef6c09","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.025420Z"},"links":{"cited_paper":"/paper/2312.15011","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:3b8383ece120b7a08d344319c7ad9c9a6464ab41e650288f8736c6f3d61e2569","observation_id":"de595bf9-b477-4cd4-a25b-7539d25a7145","resolution":{"observed_at":"2026-08-06T23:11:47.843956Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.763344Z","title":"NPJ Digital Medicine7(1), 20 (2024)","venue":null,"work_id":"0f78d6fa-033a-45bf-94f4-96b19b007c0b","year":2024},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.128968Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:af6702ab5df5120379c6ca9d2e2e3fb1a81992ba2e7947ab7d72351982757b6b","observation_id":"17ce1651-bc5d-4029-9031-7b18df3bbefe","resolution":{"observed_at":"2026-08-06T23:11:48.851091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:47.219617Z","title":"In: International Conference on Medical Image Computing and Computer- Assisted Intervention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.219617Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:103f05e8e8e158f901d2a5b2766c3433a518592bf9588174a6cd0c5e1f3e3b0d","observation_id":"ba46c4f6-caa2-44c1-8a60-6cd5fa1ae6fa","resolution":{"observed_at":"2026-08-06T23:11:47.219617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01097","last_updated":"2023-04-17T17:06:29Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T15:57:51Z","title":"DoctorGLM: Fine-tuning your Chinese Doctor is not a Herculean Task","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01097","snapshot_observed_at":"2026-08-06T23:11:47.244723Z","title":"arXiv preprint arXiv:2304.01097 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.244723Z"},"links":{"cited_paper":"/paper/2304.01097","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:f0a85d51454067a0bf34c8c6b694ab9541aa4a0190567726bf1a5560d31e124e","observation_id":"b2c682da-7f5b-4e9f-a1c1-8b5e21dabcbd","resolution":{"observed_at":"2026-08-06T23:11:47.244723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.553603Z","title":"arXiv e-prints pp","venue":null,"work_id":"9e23d687-eb6f-4dea-9f28-fdd2635f01bb","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.337658Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:3239d9cd9599f6fda7bfab89d2d91d03950b195fc1b4629b1763c7423ea206e2","observation_id":"9fbc6074-2042-4156-93c3-88bae1a942ad","resolution":{"observed_at":"2026-08-06T23:11:48.649571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-06T23:11:47.453315Z","title":"arXiv preprint arXiv:2302.00923 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.453315Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:62c28b53492cb3b33706faeea27c461bd2a73224d2646e087311651f6c3a289e","observation_id":"90270684-ff5a-4647-bdab-e290706fab79","resolution":{"observed_at":"2026-08-06T23:11:47.453315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:11:48.337864Z","title":"In: Thirty- seventh Conference on Neural Information Processing Systems (2023)","venue":null,"work_id":"b03dbb0a-bdf8-4e5a-aceb-f588ccc83ece","year":2023},"citing_paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:47.567352Z"},"links":{"citing_paper":"/paper/2506.19610"},"observation_digest":"sha256:648aad6f9d5985810ae5434280d5166c502b3245e1f786e85be4be62aff90ec1","observation_id":"0dc9890f-dd1f-449e-91fb-fa85ffb66d7c","resolution":{"observed_at":"2026-08-06T23:11:48.482334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19610","last_updated":"2025-06-27T08:04:32Z","latest_version":2,"primary_category":"cs.CE","snapshot_observed_at":"2026-08-06T23:04:21.674756Z","submitted_at":"2025-06-24T13:23:25Z","title":"V2T-CoT: From Vision to Text Chain-of-Thought for Medical Reasoning and Diagnosis"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.19610."}