{"as_of":"2026-08-21T07:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea41d121be678c5b8416762df07c567cda54966b1db0345576c7d1324a031347","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:03:03.084385Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T01:46:14.609742Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-08-10T14:00:26.796615Z","title":"arXiv preprint arXiv:2409.06644 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15798","last_updated":"2025-01-27T05:49:06Z","snapshot_observed_at":"2026-08-21T02:29:56.149007Z","submitted_at":"2025-01-27T05:49:06Z","title":"MM-Retinal V2: Transfer an Elite Knowledge Spark into Fundus Vision-Language Pretraining","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:00:26.796615Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2501.15798"},"observation_digest":"sha256:c298260b9afd178b760890ee7954ee4c04e553eafaa5e91bd3144ea4f096d06a","observation_id":"214e5da1-de5b-4013-bde1-098723016a5b","resolution":{"observed_at":"2026-08-10T14:00:26.796615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-08-16T00:03:03.084385Z","title":"Eyeclip: A visual-language foundation model for multi-modal ophthalmic image analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03153","last_updated":"2025-05-06T03:59:25Z","snapshot_observed_at":"2026-08-19T10:21:22.184798Z","submitted_at":"2025-05-06T03:59:25Z","title":"Robust Fairness Vision-Language Learning for Medical Image Analysis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:03:03.084385Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2505.03153"},"observation_digest":"sha256:7b5d9bb4405ad2638ea47fa669b794e57589281da536a0f009fa9087169c427d","observation_id":"13942d36-f14a-4ee1-8539-ed029054a902","resolution":{"observed_at":"2026-08-16T00:03:03.084385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-08-15T23:00:55.462510Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05768","last_updated":"2025-05-09T04:12:05Z","snapshot_observed_at":"2026-08-20T01:29:11.805375Z","submitted_at":"2025-05-09T04:12:05Z","title":"Predicting Diabetic Macular Edema Treatment Responses Using OCT: Dataset and Methods of APTOS Competition","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:00:55.462510Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2505.05768"},"observation_digest":"sha256:26f3255fd301eaa262ba0fd958fe2600189f0aed35cfe09356569b87663ea996","observation_id":"571e1002-9e7e-4923-a4c5-f7bd211ab287","resolution":{"observed_at":"2026-08-15T23:00:55.462510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-08-06T14:51:09.819811Z","title":"Eyeclip: A visual-language founda- tion model for multi-modal ophthalmic image analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17539","last_updated":"2025-07-23T14:19:30Z","snapshot_observed_at":"2026-08-15T10:28:53.898287Z","submitted_at":"2025-07-23T14:19:30Z","title":"Constructing Ophthalmic MLLM for Positioning-diagnosis Collaboration Through Clinical Cognitive Chain Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:09.819811Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2507.17539"},"observation_digest":"sha256:d6c3fd25e08c7e6a0851da43c9af58e507ec06fe26608aa7873ae8fcfe534d20","observation_id":"f95efed6-0b60-4769-9314-ac376656c591","resolution":{"observed_at":"2026-08-06T14:51:09.819811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":"2409.06644","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eyeclip: A visual-language foundation model for multi-modal ophthalmic image analysis","venue":null,"work_id":"d7547f45-545a-4859-be5a-012e4a014b22","year":2024},"citing_paper":{"arxiv_id":"2605.02589","last_updated":"2026-05-04T13:37:13Z","snapshot_observed_at":"2026-08-17T13:41:51.090879Z","submitted_at":"2026-05-04T13:37:13Z","title":"Representation learning from OCT images","version":1},"reference_index":153,"source":"pdf_text","source_observed_at":"2026-05-08T18:32:13.800433Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2605.02589"},"observation_digest":"sha256:5bf8bfc3a532ffac4590048ceabca002d22ca5dc2cb28cf59b6a4bf0cf1cc639","observation_id":"00c1cdca-807e-4f26-b060-efbf447108ee","resolution":{"observed_at":"2026-05-09T06:20:43.039495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":"2409.06644","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eyeclip: A visual-language foundation model for multi-modal ophthalmic image analysis","venue":null,"work_id":"d7547f45-545a-4859-be5a-012e4a014b22","year":2024},"citing_paper":{"arxiv_id":"2605.08493","last_updated":"2026-05-08T21:14:56Z","snapshot_observed_at":"2026-08-17T14:45:54.581068Z","submitted_at":"2026-05-08T21:14:56Z","title":"CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T01:39:11.365982Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2605.08493"},"observation_digest":"sha256:1f028af6d409464bb84c2f1104029f9820b1ea863fc4bb36e397d6df962c00bf","observation_id":"a29175c0-9f3a-4457-8888-9a03ee7e14fb","resolution":{"observed_at":"2026-05-12T01:46:14.611739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06644","snapshot_observed_at":"2026-07-31T23:27:20.773067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23972","last_updated":"2026-07-27T03:46:11Z","snapshot_observed_at":"2026-08-19T18:19:22.560135Z","submitted_at":"2026-07-27T03:46:11Z","title":"Color Fundus Photography Analysis: Co-evolution of Data, Preprocessing, and Modeling toward Multimodal AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T23:27:20.773067Z"},"links":{"cited_paper":"/paper/2409.06644","citing_paper":"/paper/2607.23972"},"observation_digest":"sha256:528f12e712b368359c4a3113c7ab0917e1e7586aa10f3abd7bcfa4d2aa1d1602","observation_id":"b0d1a110-c1bc-4c6c-acb1-20545228da5c","resolution":{"observed_at":"2026-07-31T23:27:20.773067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.06644/citation-record","integrity":"/paper/2409.06644/integrity","json":"/paper/2409.06644/citation-record.json","paper":"/paper/2409.06644"},"outbound":[],"paper":{"arxiv_id":"2409.06644","last_updated":"2024-09-11T17:00:09Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:19:41.688738Z","submitted_at":"2024-09-10T17:00:19Z","title":"EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2409.06644."}