{"as_of":"2026-08-08T21:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec2b1af8a88f9f90d5697781519945e8b78d5dbe43af01edce66657be33b7cdb","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:50:54.486096Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T06:30:16.612345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06496","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Med-grim: enhanced zero-shot medical vqa using prompt-embedded multimodal graph rag.arXiv preprint arXiv:2508.06496, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-07-13T07:16:50Z","snapshot_observed_at":"2026-07-16T23:19:14.481825Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":164,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2508.06496","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:4a55746452e00fe4fa467f418c8d9a28bc44993c5b5ed655f20ed0da1b2f410f","observation_id":"f7428869-4c5b-484c-9168-979a7864cfe6","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.06496/citation-record","integrity":"/paper/2508.06496/integrity","json":"/paper/2508.06496/citation-record.json","paper":"/paper/2508.06496"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.064920Z","title":"The inception team at vqa-med 2020: Pre- trained vgg with data augmentation for medical vqa and vqg","venue":null,"work_id":"9ad21a86-a748-4d06-9897-f98b993595a7","year":2020},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.306983Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:e133f6025a5dd9cbe0db08e74f78966ed262ec518a096c43647111cf6ac06433","observation_id":"14e827d4-3a7f-4295-8a7b-82a5f0ff9681","resolution":{"observed_at":"2026-08-06T15:50:55.068303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.312689Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.312689Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:2bf239bbeb156b8ee40268aa7889d24d46f1cdc4670dc77af3af94f707d9fa70","observation_id":"eb557038-88f4-4a43-b0ee-c850e2ccf7de","resolution":{"observed_at":"2026-08-06T15:50:54.312689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.047180Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":"6c135d27-dad5-421e-aa7b-9f1c4d2a5ef5","year":2018},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.317920Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:a585f157ddf8c129dc42c0daf60649b180c4db34960823f2c987e3af379db5b6","observation_id":"8602554d-77e0-436c-94d1-8e251e02e49a","resolution":{"observed_at":"2026-08-06T15:50:55.051579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.036640Z","title":"Vqa: Visual question answering","venue":null,"work_id":"b8bac8ca-dd0c-4715-acb6-68956c7c470d","year":2015},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.321588Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:a2d460bda4ba7de8ccacd53d8f31bc26382acb64a2a98e23d6a8d25f2ff86aa0","observation_id":"80d00b1a-e995-4d4e-b5be-d985abfe1037","resolution":{"observed_at":"2026-08-06T15:50:55.040451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.025970Z","title":"A-okvqa: A dataset for adap- tive open knowledge visual question answering","venue":null,"work_id":"2aaca8ab-a2df-4081-ae14-d2ad178d9d9c","year":2020},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.325609Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:7984405a629570cf629753a9123c615cb3ffe5458e153febfff94be6f6270eaa","observation_id":"6a4c2e4a-1e8d-441f-a620-affcf1635601","resolution":{"observed_at":"2026-08-06T15:50:55.029805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.015412Z","title":"Ocr-vqa: A dataset for visual question answering with text in the wild","venue":null,"work_id":"5b5c37cf-9882-4b51-b604-a765ead8f903","year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.329110Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:36696d8be1055c7d133e6cc994f61c67cfa58a6fdb3daa4381d91b96d57583a8","observation_id":"e792d4f3-7a7e-4d15-96f2-df33914590e8","resolution":{"observed_at":"2026-08-06T15:50:55.019110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:55.004346Z","title":"Okvqa: A dataset for open knowledge visual question answering","venue":null,"work_id":"eb6accbb-e76e-4b71-b804-d469061fbdf5","year":2019},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.334117Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:656eb9c0565358b0eb4c0a08062ed10a2cbb86055e52c3c5b9b5fb07e7c4f20d","observation_id":"cb724ada-2609-4830-b5cc-349b420eec7c","resolution":{"observed_at":"2026-08-06T15:50:55.008024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.993309Z","title":"Veagle: Advancements in multimodal rep- resentation learning","venue":null,"work_id":"f2bbd46b-f876-4517-813f-bc6f52164daa","year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.337541Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:449267bacb3514c030c6b0b8727f7033f851d07ab35f1902552c75cbf21e70fc","observation_id":"d71c85ab-0fa7-44fa-a174-c2d049d6783a","resolution":{"observed_at":"2026-08-06T15:50:54.997357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.982973Z","title":"Visualgpt: Data-efficient adaptation of pretrained language models for image captioning","venue":null,"work_id":"785e00be-4f82-4b9a-b014-dfede772a6ef","year":2022},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.341065Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:5af61421f690c58040027c5f1881330f3d775298cc5f3fc484b1ba7be3755b6c","observation_id":"4f6b2003-8a87-4d07-904a-7beaaa28f0c6","resolution":{"observed_at":"2026-08-06T15:50:54.986231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00123","last_updated":"2021-06-03T04:27:47Z","snapshot_observed_at":"2026-08-02T18:27:43.021339Z","submitted_at":"2020-04-30T22:10:00Z","title":"Unsupervised Learning of KB Queries in Task-Oriented Dialogs","version":2},"cited_work":{"arxiv_id":"2005.00123","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.00123","snapshot_observed_at":"2026-08-06T15:50:54.594418Z","title":"Unsupervised Learning of KB Queries in Task-Oriented Dialogs","venue":"cs.LG","work_id":"c860d379-d3cf-4882-9604-1de19064c3aa","year":2020},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.344783Z"},"links":{"cited_paper":"/paper/2005.00123","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:8a28238079a26126e1b60080755b0cff7f8c209a5a71b87793a610cde0de5b68","observation_id":"e7ccec12-a2b3-4400-957f-a558af30c738","resolution":{"observed_at":"2026-08-06T15:50:54.599287Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.08364","last_updated":"2020-11-05T12:15:58Z","snapshot_observed_at":"2026-08-07T13:10:04.345353Z","submitted_at":"2017-09-25T08:20:17Z","title":"Multi-level Chaotic Maps for 3D Textured Model Encryption","version":2},"cited_work":{"arxiv_id":"1709.08364","doi":null,"metadata_source":"pith","pith_arxiv_id":"1709.08364","snapshot_observed_at":"2026-08-06T15:50:54.574169Z","title":"Multi-level Chaotic Maps for 3D Textured Model Encryption","venue":"cs.CV","work_id":"363da8d8-7cf2-4f24-b0be-a4542bed77f4","year":2017},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.348419Z"},"links":{"cited_paper":"/paper/1709.08364","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:edfb02ae62602453a00617024bb92cefa51d3cd0cba83597d4ddcdf45965de42","observation_id":"b4f33e8a-ebaa-41b2-958b-5da2bf0b5877","resolution":{"observed_at":"2026-08-06T15:50:54.578734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.972700Z","title":"From local to global: A graph rag approach to query-focused sum- marization, 2025","venue":null,"work_id":"0d8355a2-1fdf-4b71-a91e-80a8ad84be33","year":2025},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.352614Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:42cfde34ae0afd911c48eba7e286ca3160d58db07899d6449c0acb6c4bbe4245","observation_id":"8cae71b0-d663-4c17-b572-2f014ef36f99","resolution":{"observed_at":"2026-08-06T15:50:54.975927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.962443Z","title":null,"venue":null,"work_id":"91191747-d516-464d-9f85-756849bc7fb3","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.356485Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:e49d1d5ba0b8fb7c5585fd1e864cd74ef95ee1071218765e4188d0deccd1b87d","observation_id":"39130238-8533-4adb-8d0d-1a2a8dd27a6d","resolution":{"observed_at":"2026-08-06T15:50:54.966356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.951850Z","title":"Prompt learning with knowledge graphs for zero- shot relation extraction","venue":null,"work_id":"8e160990-2ba9-4303-bff8-36209db4a4a1","year":2021},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.360598Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:8db8c04927bb4563d1ef5ff1b4755eed5093bf8f67d80df9d6d36435cfc04b47","observation_id":"dbbee4d6-7915-4b50-a854-cd9903bea7e6","resolution":{"observed_at":"2026-08-06T15:50:54.955411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.941825Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":"3df99600-1c36-430f-993d-444f0a9ef2ac","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.363866Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c31717a33b2fb7e212721e5dc878f148f52ecef0d5e43e473f760500d469936f","observation_id":"da219817-ea59-44c6-9930-56e48ceb66f2","resolution":{"observed_at":"2026-08-06T15:50:54.945171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.931581Z","title":"Girshick","venue":null,"work_id":"9a28685e-bf83-4130-a360-d2d18fc71692","year":2017},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.366895Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c1ab5feaaf9a15000432b43417fbf82c2745bc2102e484f11a75a415ce4c0c11","observation_id":"3cb271ab-e6c5-424f-881e-0af75fd87ede","resolution":{"observed_at":"2026-08-06T15:50:54.935163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-06T15:50:54.370611Z","title":"Medalpaca–an open-source collection of medical conversational ai models and training data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.370611Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:621a37021033ce35f57df3105bf65db2bf1005855dc9e2ba3ca1074859c30b64","observation_id":"06590fca-c945-4c04-95dc-75762879fd07","resolution":{"observed_at":"2026-08-06T15:50:54.370611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.920494Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":"72adeb74-f6f0-4aed-b3d7-60b37b581eb9","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.374634Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:d76def2b3a0b6a15a2b528dd03f49e977f754da10c64e1d55654ba012679747c","observation_id":"2612983a-d807-440f-95a2-f987135eebee","resolution":{"observed_at":"2026-08-06T15:50:54.923922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.909828Z","title":"Interpretable medical image visual question answering via multi-modal relationship graph learning.Med- ical Image Analysis, 97:103279, 2024","venue":null,"work_id":"e69c0a35-c2da-4390-8be5-5ce7ab5fdad2","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.378530Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:b53591008f8353dc1717344f3c2f12180768e4fcc1a1083740ef280862b598f7","observation_id":"b568daf0-229e-4f1d-9114-669fb58e0758","resolution":{"observed_at":"2026-08-06T15:50:54.914096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.898770Z","title":"Retrieval-augmented gener- ation for knowledge-intensive nlp tasks","venue":null,"work_id":"105bb259-d7eb-4daf-80a8-941778d21959","year":2020},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.382745Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:d6481e592d3ab20f81f40d92f0468938c25a6915f411c407f6bc3fd200d97016","observation_id":"cc70cdb8-06c0-4033-b745-1084bcd88cc1","resolution":{"observed_at":"2026-08-06T15:50:54.903043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.888162Z","title":"Llava-med: Training a large language- and-vision assistant for biomedicine in one day","venue":null,"work_id":"d7d8f2c6-4021-4604-8170-9e07157bd254","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.386519Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:489d943c32a776dfc73b6a24c0a408d77846f005db686aac27a45a037facfdaf","observation_id":"8f399d90-b07c-4872-86ac-fd52636dae0e","resolution":{"observed_at":"2026-08-06T15:50:54.891926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.878008Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"333764d2-ba15-46e3-a27d-4db7fcb13db1","year":2022},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.390443Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:7d6aea5a1702dbfaf22c225a02dfa9d2b41cb10e9000f50c829f4603b7618e7f","observation_id":"ff4757b2-8f03-42d8-80f1-8cd705676a68","resolution":{"observed_at":"2026-08-06T15:50:54.881829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.865946Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"2385c775-ba68-4e65-8f15-f3a9f208fc9a","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.394082Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c9f9e7225afa1f1caac0286aa50183a432c89fac6a05c5d7dc1b12ac78f50f6e","observation_id":"11c4b357-ce72-453d-8fb9-f29579305448","resolution":{"observed_at":"2026-08-06T15:50:54.870066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.854568Z","title":"Masked vision and language pre-training with uni- modal and multimodal contrastive losses for medical visual question answering","venue":null,"work_id":"92c3cd4f-2066-4a90-87ea-b75523c882f0","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.399164Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:0bbea6f2b81cdf29606540e9e89c49a3d113f1622ce5fc3f79365b49e256ae81","observation_id":"3f73eeb8-3a04-4743-ac04-452e461aecbd","resolution":{"observed_at":"2026-08-06T15:50:54.858316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.842704Z","title":"Lawrence Zitnick","venue":null,"work_id":"3a959d88-65a6-4219-ab39-d2757d59888b","year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.402739Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:1726a327c86e6ed779ccd0e40a98fcb423189e39050ca5a7ab57dd7ce2cbacec","observation_id":"3cc3c98d-0afc-4647-826f-f6afb737aacb","resolution":{"observed_at":"2026-08-06T15:50:54.846804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.831035Z","title":"Visual instruction tuning","venue":null,"work_id":"c23aa1d3-f665-433a-bd7d-8bb91ced67a4","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.406219Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:7d5842dcbac5e5fef14a4b25d59743bf9cf6f1bb60b4f018adbaa77ad4685439","observation_id":"004cbde5-821d-475d-9258-b497ccce5156","resolution":{"observed_at":"2026-08-06T15:50:54.834938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11852","last_updated":"2023-04-24T06:54:10Z","snapshot_observed_at":"2026-07-06T15:19:08.624764Z","submitted_at":"2023-04-24T06:54:10Z","title":"Can we Trust Chatbots for now? Accuracy, reproducibility, traceability; a Case Study on Leonardo da Vinci's Contribution to Astronomy","version":1},"cited_work":{"arxiv_id":"2304.11852","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11852","snapshot_observed_at":"2026-08-06T15:50:54.541333Z","title":"Can we Trust Chatbots for now? Accuracy, reproducibility, traceability; a Case Study on Leonardo da Vinci's Contribution to Astronomy","venue":"cs.CY","work_id":"a2e6199a-420a-4a54-9afa-6ea50f60fa27","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.409579Z"},"links":{"cited_paper":"/paper/2304.11852","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:2d2700df7e1a2a7416900d8ce5591791ddaef88f62aba0331723b503731f0758","observation_id":"02c580d1-817a-4479-8799-9b05251950e6","resolution":{"observed_at":"2026-08-06T15:50:54.548150Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.817929Z","title":"Foundation models for generalist medi- cal artificial intelligence","venue":null,"work_id":"9c46a135-4119-4679-9dcd-b6bc68654e6b","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.413049Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:be7fe9c173df58f14c78db00f9e570e95412a437d3ac0434abc2a4735b9d6e56","observation_id":"79a35448-1e64-4128-be24-e8998fcdfbd9","resolution":{"observed_at":"2026-08-06T15:50:54.822316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.805507Z","title":"Med-flamingo: a multimodal medical few-shot learner","venue":null,"work_id":"ccdbb0d0-e302-455a-a75b-3d09592200b3","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.417280Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:48d38c486c124f681cbbeaf24e2504de8a4e5b7e16580f544f83cdc796b83c02","observation_id":"df2e7e2e-9c2a-46e5-bc64-df92b5195c67","resolution":{"observed_at":"2026-08-06T15:50:54.809268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.793505Z","title":"K-pathvqa: Knowledge-aware multimodal rep- resentation for pathology visual question answering","venue":null,"work_id":"8e0cb6a1-4b09-4c8a-936b-540a020e3d48","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.420725Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:266f3cb9dbcb9343b1212808f886a007836b0969614355df5137b8eb5f1500d8","observation_id":"5e96866b-a842-4045-a505-371176785f11","resolution":{"observed_at":"2026-08-06T15:50:54.797037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.781622Z","title":"Overcoming data limi- tation in medical visual question answering","venue":null,"work_id":"87902ac1-b31f-4031-993f-2c81f1284991","year":2019},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.423859Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:8d526f343d732dfb99a2d48441f738a4e469c5efe3738584c9cef2887f02feb3","observation_id":"44b3a3d5-27fd-4a0a-bc36-d7e7d952c21d","resolution":{"observed_at":"2026-08-06T15:50:54.785426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.768963Z","title":"St-vqa: Visual question answering with a focus on scene texts","venue":null,"work_id":"dfa8d8c2-bf90-4171-9143-9b642695566f","year":2019},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.427548Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:4bd9b4e0e2caa5f4498d2b92d811930edb99bc49a3544e1e750145670bc16f88","observation_id":"c237a9e1-a7c8-4057-b873-569db0cf5b05","resolution":{"observed_at":"2026-08-06T15:50:54.773459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.430867Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.430867Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:43e37e26cd287bf5bdbc65b1ef221a0cd8a72d42af948612b291f4c3f6c3f7a8","observation_id":"2c23d8ba-83b4-42c1-8a05-38b2adcde634","resolution":{"observed_at":"2026-08-06T15:50:54.430867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.749626Z","title":"Docvqa: A dataset for document visual question answer- ing","venue":null,"work_id":"73051f82-d780-4460-aea9-8ceb8dfcd654","year":2020},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.434466Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:bad890c88524302e0d7ea20c75605a81f008a6072e7021a6d18319f31f46753c","observation_id":"a36ae1f0-dd3f-49b4-87ba-1cfe568394dd","resolution":{"observed_at":"2026-08-06T15:50:54.754225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.739447Z","title":"Maivar-t: Multimodal audio-image and video action recognizer using transformers","venue":null,"work_id":"beff5900-5c8b-423f-9633-6ca37646c08c","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.438125Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:584e219ef696c5e14fc28ee629309ac60a15a1822be62610fc5add913d278c54","observation_id":"bf596faf-5546-48a2-b1bf-d2465cda53ee","resolution":{"observed_at":"2026-08-06T15:50:54.742797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.729440Z","title":"Sharma, A","venue":null,"work_id":"7accf1ac-f15c-4220-96a9-5efb98877366","year":2019},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.441123Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:eebf97d2b09d0b0092d9e7ab16b6795c85fe1ceacaa7258f7ed918e835856f66","observation_id":"549747e7-e4be-4ec6-9b43-30f5f64eeb55","resolution":{"observed_at":"2026-08-06T15:50:54.733101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.718575Z","title":"Multimodal few-shot learning with frozen language models","venue":null,"work_id":"2d6236b2-ab74-4bab-8223-149cddea5490","year":2021},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.444663Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c893317f5ca4f54c17f53e707a75d384ba2f3494d699d3333a78162254d68c20","observation_id":"a02c14d9-bb8f-41b0-9b45-e0a1cba96ad5","resolution":{"observed_at":"2026-08-06T15:50:54.722054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.706878Z","title":"Attention is all you need","venue":null,"work_id":"3e77f6f8-18a3-4281-8ae1-c58d91353c69","year":2017},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.447854Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:f7c8a420e0306859d761c5f7433502c81e34e7cf309dc2527c7e42b78084fb7a","observation_id":"347f422c-576d-4397-a796-06d37ee99ffa","resolution":{"observed_at":"2026-08-06T15:50:54.711077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.694398Z","title":"Medical graph rag: Towards safe medical large language model via graph retrieval-augmented generation","venue":null,"work_id":"c4078b49-a5de-400b-8037-21f50fe088c6","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.451614Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:b2d5e64b01bb5919d9374261a383f0cdb35258d66c6c1ab705cc7c83ce04dbd2","observation_id":"a1a75ff0-74c1-46f4-ba75-805f6df4ab5a","resolution":{"observed_at":"2026-08-06T15:50:54.699090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.683766Z","title":"Mmed-rag: Versatile multimodal rag system for medical vi- sion language models","venue":null,"work_id":"e1552694-f0b9-47a3-b473-23289c1afdab","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.454992Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:37a54c178244cfded40f6a4afc004ccae6ffcbd54d0d261176ed6be0a38f84ff","observation_id":"92cc7a48-8678-4f67-8c0b-8788de69aa39","resolution":{"observed_at":"2026-08-06T15:50:54.687549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.672372Z","title":"Rule: Reliable multimodal rag for factuality in medical vision language models","venue":null,"work_id":"ae1ac095-9a0f-4b3c-a160-b6798a0949db","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.458130Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:36f6f42b5138f066c63408a9aeaeafeaeac7a2f499ae78e23b052687aeb88f17","observation_id":"6b28f0b1-c14a-4bd1-af65-fe1ac6c9db2d","resolution":{"observed_at":"2026-08-06T15:50:54.676197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.658394Z","title":"Ramm: Retrieval-augmented biomedical visual question answering with multi-modal pre-training","venue":null,"work_id":"67bb56b8-5f5c-4adc-96d4-162a8a27ba21","year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.461891Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:700cc415ee8c43cc287152f039a29ac6a3bdc6e7b3d2554a57f32a74722a807f","observation_id":"60dfb2fe-7e4f-4ab4-b54e-b52444cd22fe","resolution":{"observed_at":"2026-08-06T15:50:54.664309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.645871Z","title":"A generalist vision–language foundation model for diverse biomedical tasks","venue":null,"work_id":"2d91e3ca-d361-43d7-ba51-96e1b6d86d31","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.465268Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:fb0260f9118769a97a74cc24c7cf512690fecfe8dab04d4a3400ab340d6d7d5f","observation_id":"58fe69e3-9993-41a6-b5dd-69ff91bacd1d","resolution":{"observed_at":"2026-08-06T15:50:54.650767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-06T15:50:54.469168Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.469168Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c278ce980e918e180e87cc740aadfc62dfdc1359ef38f0473f7ff4ccb8d1dc84","observation_id":"e7c6b56e-e8e5-425d-836e-adad4a8b1ab4","resolution":{"observed_at":"2026-08-06T15:50:54.469168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.634384Z","title":"Multimodal representation learning by alternating uni- modal adaptation","venue":null,"work_id":"9361e3af-67cb-462c-ac6e-02b35b2e85d8","year":2024},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.474110Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:5b42ee6cee2fef0c723c664a9e85db63403583922bcdbcfb9b1e5de03fc160b2","observation_id":"e7eee508-72dc-4667-9893-68d86374efbf","resolution":{"observed_at":"2026-08-06T15:50:54.638093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T15:50:54.477871Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.477871Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c475345afe0d54d737a82e362a35a432cb667db4ac822b31088723908533e507","observation_id":"409a3c91-1642-4f8a-a0c8-d3c77c495ad1","resolution":{"observed_at":"2026-08-06T15:50:54.477871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.621924Z","title":null,"venue":null,"work_id":"c374bc8c-2bd4-4f9a-9eed-c2f0a478f020","year":2021},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.482486Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:c1d09f651da07c83b49fa69ce6c495d7d4f7b6452e68a653a912070fbe3231e2","observation_id":"f91b943d-e1e0-46c1-89c2-96937c131f6d","resolution":{"observed_at":"2026-08-06T15:50:54.625452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:50:54.608680Z","title":"Crossclr: Cross-modal contrastive learning for multi-modal video representations","venue":null,"work_id":"11d91252-bd3c-4dbd-9b18-90258f97a99b","year":2021},"citing_paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:50:54.486096Z"},"links":{"citing_paper":"/paper/2508.06496"},"observation_digest":"sha256:7cbc74ac41410a332549d17f31d238fbe4b74bd8a935824b49878b5e06ce1f43","observation_id":"93c184ca-0c8a-4628-bf3f-73fa882a2742","resolution":{"observed_at":"2026-08-06T15:50:54.612976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.06496","last_updated":"2025-07-20T06:44:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T23:05:43.109966Z","submitted_at":"2025-07-20T06:44:12Z","title":"Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2508.06496."}