{"as_of":"2026-08-08T07:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d8defd543eec123a469f74fe64a93a3f227d0110e4e25cf0b51b50183e76cab9","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:36:12.724334Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01902/citation-record","integrity":"/paper/2506.01902/integrity","json":"/paper/2506.01902/citation-record.json","paper":"/paper/2506.01902"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:15.257999Z","title":"Deep learning in medical image analysis: A third eye for doctors,","venue":null,"work_id":"16b99c1b-ec28-41b4-8509-3feb408683dd","year":2019},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:10.829997Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:d98c1ff841c78fd6eb4cbeaa8b0474a8d33fbf0bbca338b19c58c8aa20e7cfae","observation_id":"633b41cb-0744-44e5-8de2-3f7b3138447b","resolution":{"observed_at":"2026-08-07T11:36:15.334429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:10.926927Z","title":"Zero-shot learning—a comprehensive evaluation of the good, the bad and the ugly,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:10.926927Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:5305802a2e752319d90a01436f667a24c824a068822a37e82d8ccff8e897f9eb","observation_id":"9d55cf2f-cb9d-4278-9994-242b2ea03d3a","resolution":{"observed_at":"2026-08-07T11:36:10.926927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:15.062784Z","title":"Learning transferable visual models from natural language super- vision,","venue":null,"work_id":"faefad16-2a65-41e5-be14-f22503b64087","year":2021},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.037765Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:46ae68fb364a85f754f755962769b13ec2e5678bfbc4195f946e5b38148dcc3e","observation_id":"23eae31c-6844-4a6e-b694-2791d5a5904e","resolution":{"observed_at":"2026-08-07T11:36:15.150660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.886036Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision,","venue":null,"work_id":"0ca3ff9a-7696-41dc-9ebb-32f16fbaf1c9","year":2021},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.147365Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:26f33063e4e9f0f2434d8a6633865aa3fe1c072af8ecc922abf8a728c3086e3f","observation_id":"3f1463d5-58d9-4fe9-843b-83ceea490472","resolution":{"observed_at":"2026-08-07T11:36:14.990715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:11.257865Z","title":"Making the Most of Text Semantics to Improve Biomedical Vision–Language Processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.257865Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:990123955b25a22b2d2ad1750f27042f3e362be97aa0472d1d625fcc2662c4d7","observation_id":"4adabc46-6f02-414f-81ed-c3081dcb8229","resolution":{"observed_at":"2026-08-07T11:36:11.257865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.742361Z","title":"When and why vision-language models behave like bags-of-words, and what to do about it?","venue":null,"work_id":"9d4cac35-55fa-4466-8a11-4592453a7765","year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.369209Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:399cfe2e03f24e0a59a4828c1d0ed0615997f8ebf56ccab442797e44070cef9b","observation_id":"ebf3608c-470c-4af6-b008-8ffeaf72f98e","resolution":{"observed_at":"2026-08-07T11:36:14.805910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06752","last_updated":"2018-08-27T16:06:44Z","snapshot_observed_at":"2026-07-06T06:56:34.657007Z","submitted_at":"2018-08-21T04:00:23Z","title":"Lessons from Natural Language Inference in the Clinical Domain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.06752","snapshot_observed_at":"2026-08-07T11:36:11.452383Z","title":"Lessons from natural lan- guage inference in the clinical domain,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.452383Z"},"links":{"cited_paper":"/paper/1808.06752","citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:832ee1c8595a2d4fa6356d248058367c05b93962d95bc72d3fe6068a0493987f","observation_id":"3a2fe4b2-438d-4525-b328-e9e470a3d137","resolution":{"observed_at":"2026-08-07T11:36:11.452383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.589926Z","title":"Improving factual completeness and con- sistency of image-to-text radiology report generation,","venue":null,"work_id":"1116a79f-d021-49a0-b0ec-c7f08f3f184d","year":null},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.552685Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:b19f31e7c57ce6e201e5717961d68105e40aa205bb6d527e63bad09bb891f9f3","observation_id":"3228846b-5eb7-4284-a517-7ce2fe87e845","resolution":{"observed_at":"2026-08-07T11:36:14.663254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.399357Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and ex- pert comparison,","venue":null,"work_id":"e1630b0e-aed4-48ba-9656-5acd958357ef","year":2019},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.786585Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:d69b03a180a2ae032bd888399464157bab2372a58553439e443d255f494147da","observation_id":"b90f7903-7ad9-4b22-a44b-9bc28b5b2175","resolution":{"observed_at":"2026-08-07T11:36:14.481434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.220409Z","title":"Contrastive learning of medical visual representations from paired images and text,","venue":null,"work_id":"b19449bb-6025-4e22-9bcb-d074a8a5dbe2","year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.885502Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:9b4b5117d9582cf3f13f23c6f93b3c8fdb4ca6e3e667eb9e26ce46fa8ebde47d","observation_id":"e64449a7-797f-4298-991b-da2c3db4d5a4","resolution":{"observed_at":"2026-08-07T11:36:14.317898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:14.063665Z","title":"Joint learning of localized representations from medical im- ages and reports,","venue":null,"work_id":"6affc80b-b5ee-433c-be13-4371c7c56500","year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.963517Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:07a96e8eba211f571c720aff4ff1fa972be330d2c94e96a3294b48200d62f22e","observation_id":"4285469d-accf-4316-a9f5-f740ad6f4c00","resolution":{"observed_at":"2026-08-07T11:36:14.141935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10163","last_updated":"2022-10-18T21:06:29Z","snapshot_observed_at":"2026-08-07T02:27:07.862492Z","submitted_at":"2022-10-18T21:06:29Z","title":"MedCLIP: Contrastive Learning from Unpaired Medical Images and Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10163","snapshot_observed_at":"2026-08-07T11:36:12.053292Z","title":"Medclip: Contrastive learning from unpaired medical images and text,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.053292Z"},"links":{"cited_paper":"/paper/2210.10163","citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:7e258e716e30480b140b034d5b8d8814d73ec40f065a7d41093d2965d10a086c","observation_id":"bb87e176-0ef2-41f6-97f3-7a66dfbe47fc","resolution":{"observed_at":"2026-08-07T11:36:12.053292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:13.882986Z","title":"Expert-level detection of patholo- gies from unannotated chest x-ray images via self- supervised learning,","venue":null,"work_id":"55450f99-e796-41d2-a304-d4d9a2730935","year":2022},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.126466Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:72806e842dece5f888417274efe8570b10278c60e14ee3c1c55cc870c36e7e88","observation_id":"e5159f0c-b5fa-4e4a-877c-c9917cdf326b","resolution":{"observed_at":"2026-08-07T11:36:13.956412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:13.708983Z","title":"Pubmed data download,","venue":null,"work_id":"bfd46856-5f40-4a87-a2e3-495d304537a4","year":null},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.171617Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:ad80d884d34e0f41c53371bffd2a227f8592b82fb26b9ee29002fefe24abbaa0","observation_id":"90938677-ade9-4073-b59f-d009f93e7bc3","resolution":{"observed_at":"2026-08-07T11:36:13.777040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:12.263639Z","title":"MIMIC-III, a freely accessible critical care database,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.263639Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:0a71e2c12d97efc595fc99bef0e228f09ac9914e455392607b0a74b00f6ef88d","observation_id":"78c2f522-1df3-440c-b82e-9f582de5a44e","resolution":{"observed_at":"2026-08-07T11:36:12.263639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:13.543789Z","title":"Gloria: A multimodal global-local representation learning framework for label-efficient medical image recognition,","venue":null,"work_id":"4e2d1bbd-8b3c-4b5d-b0bc-8f9c24365b9b","year":2021},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.369487Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:d94235a84c979c8d82de9a19a69b4763c231e23c351f9f62e815fd53681166a2","observation_id":"5dfa1b2d-c567-4320-a70f-0c99040516cd","resolution":{"observed_at":"2026-08-07T11:36:13.624497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:13.285774Z","title":"Spacy 2: Natural lan- guage understanding with bloom embeddings, convolu- tional neural networks and incremental parsing. neural machine translation,","venue":null,"work_id":"7f99bde7-d30b-47cb-8ffe-536aa022badf","year":2017},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.437052Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:2cff6f02714da15f758d29e45799714a18985f7caa077a7eaa79a8609dca29ad","observation_id":"5a6286b7-0585-4073-b95b-a4973f05ef7c","resolution":{"observed_at":"2026-08-07T11:36:13.436265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:13.086440Z","title":"What context features can transformer language models use?","venue":null,"work_id":"2ce5d7a2-6d09-476f-8714-310a72d037bd","year":2021},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.561961Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:cdc1f82ddb34e98943391c68937b177a94d743316ca27dcdb9bee3c76b0931fb","observation_id":"a2c5e2d7-7b63-4fdb-8904-ec6b09a0ca2f","resolution":{"observed_at":"2026-08-07T11:36:13.180575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5626/jcse.2012.6.2.168","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:36:12.843176Z","title":"Design and development of a multimodal biomedical information retrieval system,","venue":null,"work_id":"ea65258b-c468-46ac-b1fc-70db956b6d54","year":2012},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.656437Z"},"links":{"citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:2b694e8c8cd7fccc981de48d66cf2347853db75b54982047a98737b010ed263a","observation_id":"8ed3cef4-4c0f-4adc-81be-85dacf0c6b0f","resolution":{"observed_at":"2026-08-07T11:36:12.952389Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-04T02:05:40.539691Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-07T11:36:12.724334Z","title":"An overview of gradient descent optimiza- tion algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:12.724334Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:72940931eaab315ab9f046ceebaa4b504d7314bc72c6ee40f7892634fe149237","observation_id":"c26caedf-6e7e-453b-829f-8bb8686e4f5e","resolution":{"observed_at":"2026-08-07T11:36:12.724334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10042","last_updated":"2021-04-12T20:41:48Z","snapshot_observed_at":"2026-08-03T14:57:07.650557Z","submitted_at":"2020-10-20T05:42:47Z","title":"Improving Factual Completeness and Consistency of Image-to-Text Radiology Report Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10042","snapshot_observed_at":"2026-08-07T11:36:11.685118Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:11.685118Z"},"links":{"cited_paper":"/paper/2010.10042","citing_paper":"/paper/2506.01902"},"observation_digest":"sha256:e1c36fc69c4405982a5f22a5fc7d71cc77a196d7d30bedcd0cbdeedadbe0f169","observation_id":"fec5e85a-9246-4461-aedc-c8233b3bac18","resolution":{"observed_at":"2026-08-07T11:36:11.685118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01902","last_updated":"2025-06-02T17:23:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:39:41.995841Z","submitted_at":"2025-06-02T17:23:25Z","title":"Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2506.01902."}