{"as_of":"2026-08-08T11:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15da2656f7ed58de057468761c7357259fc7bec0d11ddb9458f455ead15263a1","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T08:06:08.025649Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:19:39.347401Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10953","snapshot_observed_at":"2026-08-01T03:19:39.347401Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25164","last_updated":"2026-07-28T00:25:05Z","snapshot_observed_at":"2026-08-07T18:16:41.987905Z","submitted_at":"2026-07-28T00:25:05Z","title":"OrganLens: Organ-Specific Representation Learning for CT Foundation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T03:19:39.347401Z"},"links":{"cited_paper":"/paper/2607.10953","citing_paper":"/paper/2607.25164"},"observation_digest":"sha256:ca5af439b752dbeb085961bfd1f0acad4e0c52114236e0053a63eab14903d2dc","observation_id":"64a2a705-fb2f-4170-8573-dccca25557d8","resolution":{"observed_at":"2026-08-01T03:19:39.347401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.10953/citation-record","integrity":"/paper/2607.10953/integrity","json":"/paper/2607.10953/citation-record.json","paper":"/paper/2607.10953"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Developing generalist foundation models from a multimodal dataset for 3d computed tomography,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:4c0e9bcf6f66519a37d2765f1742b14fb70f302d33f4070c162c868d35759d5b","observation_id":"a65e3056-7772-4d37-b6aa-074b8ff4e05d","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Merlin: A vision language foundation model for 3d computed tomography,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:9277fae6b377f801014ca6f43f65458d50e8075b38640132ba128bd584793b67","observation_id":"c461f93a-a085-4a86-a4ad-7a3cb034a945","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Gloria: A multimodal global-local representation learning framework for label- efficient medical image recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:133729359cccd4595700742d99321275c12efa01fff52cdca8a92ccf036c9d73","observation_id":"5a8d7ab7-b4bc-42de-8648-d4c418449175","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Im- proving medical vision-language contrastive pretraining with semantics- aware triage,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:1b53c4d0e079da97f062425e3467cd6d6fea9129fb0ffd0c56d852198ea559cb","observation_id":"57c10ef6-df84-4c19-88e5-d028bd0c7072","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Ecamp: entity-centered context-aware medical vision language pre- training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:f8c365ef9a35a0d5d408ea7f85ec9a977d809dc698e75c5b2c7be8b4b16aeaff","observation_id":"1edc0719-93af-4bbe-b1e1-4c56230814cd","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Large-scale and fine-grained vision-language pre-training for enhanced ct image understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:baf12a6ffb2912141dec6ccf1009dc7aa9fe209c0d6cb10a9ae5545aaba08db2","observation_id":"1d3840f5-ee05-4836-a021-ff7e615b35d3","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05876","last_updated":"2024-12-08T09:45:59Z","snapshot_observed_at":"2026-07-06T20:03:25.000927Z","submitted_at":"2024-12-08T09:45:59Z","title":"MG-3D: Multi-Grained Knowledge-Enhanced 3D Medical Vision-Language Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05876","snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Mg-3d: Multi-grained knowledge-enhanced 3d medical vision-language pre-training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"cited_paper":"/paper/2412.05876","citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:67b90a84a38bd82e23c323a6855b7388562342f809cbb67d2d096ababeb3c6e6","observation_id":"a0470f05-645d-47b9-b960-0c34b9e1b2ee","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Ct-glip: 3d grounded language-image pretraining with ct scans and radi- ology reports for full-body scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:579f6e9e6217622df91459b763b05738b269d61fcadf09574bd6b8ec9105de67","observation_id":"a1ffae66-952a-4075-ab12-3c05eafd025d","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Radgraph-xl: A large-scale expert-annotated dataset for entity and re- lation extraction from radiology reports,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:67c564f798bcbd5559b8b1f58b8fa7ed229becab62506050e49957b01fa8b9a5","observation_id":"a1c53780-8288-4311-b222-4fea5dbeb249","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:799aeee8cd9fabe4efaf0ec349edc0db7c65c81dac79495b5e8d62488e84a305","observation_id":"61a3a22a-814a-4a2a-8642-aafb11cb5e1f","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:0e5ca1af604b4c29fda7c6ecadd6aa37938ec4117d2acf6b79985f2f37b6eb1b","observation_id":"f441c554-d308-4cab-acbc-1c9246d0685a","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Align before fuse: Vision and language representation learning with momentum distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:7141683f62c296960bd24fbb58328631ae2abf756870a15c68b5353abac40646","observation_id":"fb92b930-9116-43a3-a6ed-4ff65e79fe21","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Chestx-ray: Hospital-scale chest x-ray database and benchmarks on weakly-supervised classification and localization of common thorax diseases,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:d37504a97010b7d0ea8eca8fa9b4fac69bafcf0f1db18c6730468458a0ef759a","observation_id":"563ec6ae-49a6-4449-9833-0f2924f60a46","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:c4d13e4c83e02368066ebc1af55dd7ccb564493ced55c427561b2d08277c7c21","observation_id":"bcaf0e72-3cda-4aba-a9bb-335cb81b93ed","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Mimic-cxr, a de- identified publicly available database of chest radiographs with free-text reports,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:b02b03383e8877bd504a48b69e012eeb65b85185df17d4ec791d8093b7a6a5da","observation_id":"7f0039a6-c1a4-4a27-8728-6767683228fb","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Preparing a collection of radiology examinations for distribution and retrieval,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:3331c6878d1d473974060834d2a54a39b15168ed70accd466ff929c00f6bfce8","observation_id":"ab8529fe-2ba5-4c68-b43c-05d2c285226d","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Medclip: Contrastive learning from unpaired medical images and text,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:27869e7e8a55e2645dd0276fe4a96ecce6f2720580b8873a929b0081dc5582ea","observation_id":"77179951-1e43-4444-ad7c-3dc417f663f7","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Bootstrapping chest ct image understanding by distilling knowledge from x-ray expert models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:58d5682e2d131cd6d1380a6c7fc8305eea8c351c3a75d88f411aedf11106c30a","observation_id":"51e05f41-fb42-4ffa-bd15-4140398e762f","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Bridged semantic alignment for zero-shot 3d medical image diagnosis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:ef375e85cc7230ebb3ca83e2feaf1482753857e765d78d680ebb426fb0e956a8","observation_id":"d72810f5-d91a-4647-9d67-b1d63c492a9e","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Joint learning of localized representations from medical images and reports,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:7341c18d54db70e14d8331de3600f7d1d93926f9600d56f0f4528e1e091e1bae","observation_id":"ae87f019-574e-4c84-9996-353943e21ce2","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Making the most of text semantics to improve biomedical vision– language processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:9f0b0dc86e85a83d568cb104e7e895d69546fd6b736a770cfa80befc01e5967e","observation_id":"008ecc4f-6fb3-4fd8-b328-3bf69bdd8e8d","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Bcnet: Bronchus classification via structure guided represen- tation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:16d2303078f97ec0773c7dea18b08a81f14c05d41912aa09ea38ffc14a9f5d89","observation_id":"68c12639-d3f7-4d9b-a0c2-58382eea1417","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Boundary as the bridge: Towards heterogeneous partially-labeled medical image segmentation and landmark detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:7df89663407b02c572e025cf1eae3fdd68b4972a6e3619d9fea7296028634567","observation_id":"c3f70d21-a496-4dfb-9bdd-f27f25110df0","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Learning spatio-temporal features with 3d residual networks for action recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:a925cf04ac6a0f0923b1abaaae49726a065d29f90043cffa46d1c61a89ec529d","observation_id":"4f276a67-8fed-4325-9d77-099ef5d2705a","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Machine-learning-based multiple abnormality pre- diction with large-scale chest computed tomography volumes,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:350c609b8c11a98dd27bdcdd7b524c5aac2ceb53504701956b85da164109639a","observation_id":"8bdc3d90-de79-4dd6-914c-f377c96278c9","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Compre- hensive language-image pre-training for 3d medical image understand- ing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:ded0df8d94f6a4aab4cea881df0f9ac117ba677d0c171adcbe08a597e603ebf1","observation_id":"8439d96e-8db0-4b6e-a53d-605bac755481","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Totalsegmentator: robust segmentation of 104 anatomic structures in ct images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:15a386ed0785ecac745c85e6b9c20c65c732e8da6e351ee943e55584b68b5db6","observation_id":"79332050-203d-4fe0-b84d-ce9b8e9a1dac","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-14T08:06:08.025649Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T08:06:08.025649Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.10953"},"observation_digest":"sha256:15cdc557349c5976a7a3ba7d59f42d8afe973ced95527f9288ca05f508f64f98","observation_id":"63541012-c3da-42c3-b9a4-4983a6579ce7","resolution":{"observed_at":"2026-07-14T08:06:08.025649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10953","last_updated":"2026-07-12T23:09:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T16:03:48.975929Z","submitted_at":"2026-07-12T23:09:23Z","title":"Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2607.10953."}