{"as_of":"2026-08-23T13:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14570961b1541660948b33ed2db279a9173b9cd1edc1a187e66025171e453bd8","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:58:00.232209Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.03380/citation-record","integrity":"/paper/2505.03380/integrity","json":"/paper/2505.03380/citation-record.json","paper":"/paper/2505.03380"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.041667Z","title":"A visual–language foundation model for pathology image analysis using medical twitter,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.041667Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:6e51776ef1c8eb2be978347e8e5be046cd6b23d8478d54fdeb449198eae5f218","observation_id":"7538bc30-7d08-4e9f-80ba-3968a7e780b2","resolution":{"observed_at":"2026-08-15T23:58:00.041667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.692156Z","title":"A visual-language foundation model for computational pathology,","venue":null,"work_id":"de8f381c-5864-426b-a52c-aeade9bb0a15","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.052323Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:08868639f44e3384f0a557ca10a44464f0a0950222a7d85e6be34ab3529b2091","observation_id":"4f2ac6b0-a900-4acb-afb1-7860f73a2221","resolution":{"observed_at":"2026-08-15T23:58:00.696070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.682062Z","title":"Vision–language foundation model for echocardiogram interpretation,","venue":null,"work_id":"bd9a17ad-7e77-4263-be81-2054d44d4040","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.060156Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:574db7e7f3694bb8c0931544611d3a8aeaa71e3491dce423576f9f693d3c7645","observation_id":"238685df-8551-4295-8187-354c4872281b","resolution":{"observed_at":"2026-08-15T23:58:00.685533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.670658Z","title":"A foundation model of transcription across human cell types,","venue":null,"work_id":"75f963ae-66d7-4bd7-bd5c-4fa9df0b2953","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.064403Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:952702b9e01e369e9787670f09db1571ed079544bd81e7914d123a0e9e07e712","observation_id":"9171273b-b9e4-4506-806c-a84c52365241","resolution":{"observed_at":"2026-08-15T23:58:00.674738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.660076Z","title":"Accurate predictions on small data with a tabular foundation model,","venue":null,"work_id":"b6c0432c-1633-4916-b4b7-035d99134fc4","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.069829Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:05f00094461079969e996c8b9a26ddf656fdb121836e41f45c239923f3c8ce47","observation_id":"d5fffda6-8b39-44c0-adce-ff85c043cbea","resolution":{"observed_at":"2026-08-15T23:58:00.663774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.650339Z","title":"A vision–language foundation model for precision oncology,","venue":null,"work_id":"d26148df-2866-461e-82a4-9e56676ca240","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.074077Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:0715f281f5383ae9eeb0953ef9fbb8884cc1b6e8bbea06c6f4e0e3c8da4b1c81","observation_id":"46f01f17-dd8b-4cd0-98f2-9de03acd5931","resolution":{"observed_at":"2026-08-15T23:58:00.653696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.640514Z","title":"A foundation model for joint segmentation, detection and recognition of biomedical objects across nine modalities,","venue":null,"work_id":"6d340ea4-ed8e-49be-852d-ae014ad8a9aa","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.079635Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:39205a9f7e04a6675d2108f0a86249e148cad4b0d5fe27483deddf82f7d67c7c","observation_id":"6e30193c-3c6a-4859-bdae-14f8125356f1","resolution":{"observed_at":"2026-08-15T23:58:00.643920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.630149Z","title":"A vision–language foundation model for the generation of realistic chest x-ray images,","venue":null,"work_id":"fd4cb9aa-6b67-4301-8e09-69fab447373b","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.084339Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:7bc4a2946a7aadfbf333aaf0deb25f12ca3e1ab31f6a5216cb32085f1196232d","observation_id":"49b56e22-abc6-4c2a-8207-7381c655e322","resolution":{"observed_at":"2026-08-15T23:58:00.633639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.619261Z","title":"A foundation model for enhancing magnetic resonance images and downstream segmentation, registration and diagnostic tasks,","venue":null,"work_id":"73ec0190-1d70-4f07-abea-c75244c654cd","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.088892Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:6cf17bbf7e1bbda990c283eea7ac098235184681ba98a010bef221afbb9d4f94","observation_id":"839dddd0-b727-4656-9765-ebbed76f4df3","resolution":{"observed_at":"2026-08-15T23:58:00.623569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.608519Z","title":"A generalist vision–language foundation model for diverse biomedical tasks,","venue":null,"work_id":"c2692a23-f0d2-4a72-a0ac-4fb503a6a696","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.093821Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:26dc4f72d64b9476060df2341064ea62a309b4127d1b323c3e35c235e64f685e","observation_id":"b6856eed-bd63-4f38-a1d2-7c96ab0520e8","resolution":{"observed_at":"2026-08-15T23:58:00.612074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.596996Z","title":"scgpt: toward building a foundation model for single-cell multi-omics using generative ai,","venue":null,"work_id":"a2c38d98-601d-49f4-b778-5f0cabae6170","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.097658Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:50d75f9fa193329cba24cd482daa5719668ef96e4f94ebf59cba87212b338c42","observation_id":"8aee751d-ae0c-472b-be80-e9997325d0eb","resolution":{"observed_at":"2026-08-15T23:58:00.600939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.584772Z","title":"The multimodality cell segmentation challenge: toward universal solutions,","venue":null,"work_id":"8c9eb4f6-8b71-4adb-9a29-5e349936b994","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.103169Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:f22b6a5c411ddc5b002b8caf0270d746d6f20c998d5b7fecb9a9f46f20bf6087","observation_id":"5d61c533-fee2-4447-be43-1170042c4ff6","resolution":{"observed_at":"2026-08-15T23:58:00.589075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.572626Z","title":"Towards foundation models of biological image segmentation,","venue":null,"work_id":"4e1d3c7b-fef7-420a-a0d3-b1bb8de1c2bb","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.108498Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:0b5bd04fb875c749a9a8aecacd61b4d98593a87f371e7da62fddbc01b6a47f30","observation_id":"5de496f6-e599-420b-b70d-652b96b586f1","resolution":{"observed_at":"2026-08-15T23:58:00.576381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.560755Z","title":"Foundation model for cancer imaging biomarkers,","venue":null,"work_id":"859b13b9-9671-43e1-bcf9-40777474bbe6","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.114183Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:361d641cfeb2889020b2b43c9ca78cfb355602d3f86530b454963c406b4ace80","observation_id":"d234aac2-fa31-4a63-9dc8-49b67cee56da","resolution":{"observed_at":"2026-08-15T23:58:00.565005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.549619Z","title":"Exploring scalable medical image encoders beyond text supervision,","venue":null,"work_id":"5c9db3fe-d9e6-4d3d-a49b-15ee9a92e479","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.118651Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:c1ccc3d5406c5e17b4ee7884e40aa91e10b198baf4d6321c2d024bd5f4bf2537","observation_id":"2d555979-a161-4eec-9365-80f28a8245dd","resolution":{"observed_at":"2026-08-15T23:58:00.553047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.539423Z","title":"U-net: Convolutional networks for biomedical image seg- mentation,","venue":null,"work_id":"c5d3c546-1141-4a96-b0d1-6056efe745bc","year":2015},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.122675Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:e53c65acc41fc3f74100b0827723f3141b248ab231710002aaa689d8a939616b","observation_id":"e87d85ca-29b1-424d-b9fe-9305c9ec1f61","resolution":{"observed_at":"2026-08-15T23:58:00.542985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.528826Z","title":"H-denseunet: hybrid densely connected unet for liver and tumor segmentation from ct volumes,","venue":null,"work_id":"dd911b3a-dcd6-4eed-af4e-1b12024caf89","year":2018},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.126987Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:e9c35aefda8a31f834952dd2557ac94b8c147355c99d039deedb9e77311608cc","observation_id":"1ce03dd8-4aa8-48d4-8fcc-4d787044bbee","resolution":{"observed_at":"2026-08-15T23:58:00.532602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.131529Z","title":"nnu-net: a self-configuring method for deep learning-based biomedical image segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.131529Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:5f7c56282972659218dd0119908865dcbb36d26f9b010b8af140963fba27a9d1","observation_id":"f3ebc55d-512f-498f-b488-7b4cf02e8907","resolution":{"observed_at":"2026-08-15T23:58:00.131529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.511245Z","title":"Swin-unet: Unet-like pure transformer for medical image segmentation,","venue":null,"work_id":"59cfbb8e-5cd9-4213-bf57-3bdb47165102","year":2022},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.138982Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:30f97f775f108df016cba700bf7b32332eaed8f64c996190b19f2a6028b1de47","observation_id":"57ddcc61-5436-40b9-9f27-eed0678fc0eb","resolution":{"observed_at":"2026-08-15T23:58:00.514896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.500949Z","title":"Uctransnet: rethinking the skip connections in u-net from a channel-wise perspective with transformer,","venue":null,"work_id":"57253775-648d-408b-b5f0-02a146d76119","year":2022},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.143987Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:8cbd23333e0460ecb93dcacf41f714175839ab49ffb59d378a000ec48cdd6002","observation_id":"2b8532e7-207c-40ed-b2a1-05be6b1b9ef6","resolution":{"observed_at":"2026-08-15T23:58:00.504587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.490646Z","title":"Towards generic semi-supervised framework for volumetric medical image segmen- tation,","venue":null,"work_id":"86dfa91a-395a-4209-b58b-f61d8bd94f1d","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.149428Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:e314e825c3617eb83d3074edcdfc0186c38a3ecbf9db230b4d5838adaa048fcf","observation_id":"c2d1329e-413a-466d-8e0c-55c48f5f54da","resolution":{"observed_at":"2026-08-15T23:58:00.494280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.480088Z","title":"Dhc: Dual-debiased heterogeneous co-training framework for class-imbalanced semi-supervised medical image segmentation,","venue":null,"work_id":"d70f1d3d-1dcd-470a-8074-923d740c2eae","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.153844Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:04dc7731ed3e2c7bb6d98f5f432004d400c4b044351b550cc57a187f2db937c5","observation_id":"d04d2819-4746-42f8-b772-2e8dc2c12af0","resolution":{"observed_at":"2026-08-15T23:58:00.483713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.468039Z","title":"Scs: cell segmentation for high-resolution spatial transcriptomics,","venue":null,"work_id":"88c1c0ea-0ac6-4a4b-8b40-2603b52dd3a6","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.157774Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:fb3e7e55c3676cdcca934a35c3193145d16ee40d012c44171e5ef388cc69def5","observation_id":"468b6bfe-9e36-4bfe-b996-7aa47e585529","resolution":{"observed_at":"2026-08-15T23:58:00.472296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.456388Z","title":"Omnipose: a high-precision morphology-independent solution for bacterial cell segmenta- tion,","venue":null,"work_id":"4f961c7a-f761-4886-9a2e-9c3571ca2d45","year":2022},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.161910Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:d222ce991175d4470f660a096eee048a85addf78cd432bf02bec6d65d3a9fe0c","observation_id":"646c85bb-98ae-4106-9519-ad97f77ab248","resolution":{"observed_at":"2026-08-15T23:58:00.459947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.444498Z","title":"Cellotype: a unified model for segmentation and classification of tissue images,","venue":null,"work_id":"f338107d-3806-47e4-a5c5-cf04974b5b2a","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.166586Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:bc790f0769c3332e4e196bd06427ca47ae8c40abebd13db1b4f2cfffde74baf0","observation_id":"60c70de1-1c20-4e15-9082-efdf8702844f","resolution":{"observed_at":"2026-08-15T23:58:00.448886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.433347Z","title":"Uncertainty-guided dual-views for semi- supervised volumetric medical image segmentation,","venue":null,"work_id":"edc317a0-9dae-4d03-83a9-b2250e53b4f2","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.171438Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:8953b67431c4fe29cc980ae9f3aa036b94bb47a19ab2b5c0498a518a0f4352e4","observation_id":"62986287-e868-4ac7-a080-38f7b0eb1e75","resolution":{"observed_at":"2026-08-15T23:58:00.437370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.421961Z","title":"Physics-based machine learning for subcellular segmentation in living cells,","venue":null,"work_id":"02a68fa2-7f1c-415a-95b9-d47e303eff7e","year":2021},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.175561Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:e09d650245b5b2033d9ab91e5dac7b01cdb3e401d24fdc23fc4dab4b2b4293a7","observation_id":"cf0a9af2-2de9-4cb8-aedc-0aeea4a337e7","resolution":{"observed_at":"2026-08-15T23:58:00.425815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.410583Z","title":"Biomedparse: a biomedical foundation model for image parsing of everything everywhere all at once,","venue":null,"work_id":"260746d5-bbd0-4cb6-803b-c749e693bb0b","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.179789Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:75dad1773b5f76792daccdaf0d3f11242d703030cf178ccee9c0661fab8030ba","observation_id":"292cc45a-eb7f-4a33-8ed5-f9c97fa89c50","resolution":{"observed_at":"2026-08-15T23:58:00.414315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.184043Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.184043Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:6a3198c366ba4c949c1afd661fa9843f3d4d38d6e3071406d1d3cc44331fe6d3","observation_id":"2589cb16-b302-42fd-b1a1-438b04864793","resolution":{"observed_at":"2026-08-15T23:58:00.184043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.188129Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.188129Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:d7b356861f0df4981f1e094374e610f9aa2a2a28ece176495996913b6d919eb3","observation_id":"2cfe0de2-bc21-4f09-92ca-388011d7b438","resolution":{"observed_at":"2026-08-15T23:58:00.188129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.386833Z","title":"Segment anything,","venue":null,"work_id":"0fa62d85-8320-4735-8e06-08173d7329fd","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.191906Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:843d4c7155693c4090b16c5dc96c9bd38c27d4430c281fb4ce4b9543dbeb28a4","observation_id":"6318abe0-2c23-4f0a-b468-1eee073107a1","resolution":{"observed_at":"2026-08-15T23:58:00.390320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16184","last_updated":"2023-08-30T17:59:02Z","snapshot_observed_at":"2026-08-16T15:04:32.317325Z","submitted_at":"2023-08-30T17:59:02Z","title":"SAM-Med2D","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16184","snapshot_observed_at":"2026-08-15T23:58:00.195849Z","title":"Sam-med2d,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.195849Z"},"links":{"cited_paper":"/paper/2308.16184","citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:caf81f424d980b729288a52a41d8ad54531e3fff3116c7c5e8a44ce9bb0ffc82","observation_id":"999dcd30-ee52-4f26-bae5-49bba90441eb","resolution":{"observed_at":"2026-08-15T23:58:00.195849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.375528Z","title":"Llava- med: Training a large language-and-vision assistant for biomedicine in one day,","venue":null,"work_id":"0ad86f0f-e5f7-4316-93e1-367ba06db3dd","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.200243Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:a8b91cd23ce1d285b431d088aeed8d50864f294c47c85202fadff4ec7778c0e2","observation_id":"ff69f343-93e7-40b6-babd-878b2c9b7270","resolution":{"observed_at":"2026-08-15T23:58:00.379466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.364388Z","title":"Interpretable bilingual multimodal large language model for diverse biomedical tasks,","venue":null,"work_id":"e3d51cb8-9b4c-4af5-bd5f-f3318a3c7d21","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.204025Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:ab2ac74545cf980080a2b8c68bd87b7d48021951539da3f52ea849ac53c41c1a","observation_id":"0c3643de-3236-403d-9ba8-3a5ccbb7d617","resolution":{"observed_at":"2026-08-15T23:58:00.368150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.351636Z","title":"Medical phrase grounding with region-phrase context contrastive alignment,","venue":null,"work_id":"29233855-3eb3-4fbd-882d-0ff464497a02","year":2023},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.208027Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:e18920c8430f2e5a429cba5f4a362c9f2672cbf529c125d8a1aebe2aeb62b3c9","observation_id":"e8c43788-5d74-44a9-8cbd-25c5ce33a8d6","resolution":{"observed_at":"2026-08-15T23:58:00.356808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.339728Z","title":"Segment anything in medical images,","venue":null,"work_id":"9a909c25-77fe-4fcd-a18f-83e65b1b0faa","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.211877Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:eac49227f854dc8e272fe008d8e5a5bd8bd2399b05adbc3c12b642aef5a53732","observation_id":"0786f228-fe84-47b5-954d-b24f970597bb","resolution":{"observed_at":"2026-08-15T23:58:00.343762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.327201Z","title":"The medical segmentation decathlon,","venue":null,"work_id":"1057675e-4d17-4330-b6cf-4c8182fad13e","year":2022},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.219016Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:584deee36380dac57e9d4a74244c67bc59a7ec7663a66caff599419b1eeb7337","observation_id":"8f5a210b-eee8-464d-ac94-823fcaba9145","resolution":{"observed_at":"2026-08-15T23:58:00.331037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.314884Z","title":"Multimodal generative ai for medical image interpretation,","venue":null,"work_id":"3b5848f9-4c5a-4706-95a4-8b43395690a0","year":2025},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.224480Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:f6195e8627d33735e2267d0bc97f9466b5a042d832c14600c2d445435cc9a09b","observation_id":"e4220163-3776-425b-a205-9870fdc2d844","resolution":{"observed_at":"2026-08-15T23:58:00.318765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.301914Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"e9ae20ba-2532-4ccf-b70d-6f5ca448d668","year":2021},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.228483Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:9262435fc7fe6683367a016c600d7ab5cd861778c7e74f8ad1f0f31c7755e11e","observation_id":"0ed8ea1b-953a-42a7-8dc3-03c36bcde2b4","resolution":{"observed_at":"2026-08-15T23:58:00.306332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:58:00.286614Z","title":"Glamm: Pixel grounding large multimodal model,","venue":null,"work_id":"4f76a7fe-dc6e-4af2-9e72-6ed10d6f85ab","year":2024},"citing_paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:58:00.232209Z"},"links":{"citing_paper":"/paper/2505.03380"},"observation_digest":"sha256:a67a908919655b6b22e1bd0a7849d21cef73fcceaf631474071fc6d4ae398576","observation_id":"0c7ce5c8-4674-44f9-8f28-0561ba5abe8f","resolution":{"observed_at":"2026-08-15T23:58:00.292704Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.03380","last_updated":"2025-05-06T10:00:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T14:39:26.785281Z","submitted_at":"2025-05-06T10:00:08Z","title":"Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2505.03380."}