{"as_of":"2026-08-22T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:787ff9d1c987b11e54907a0e3436fa40782e284c52bb1387ff6f825dbae6b9ec","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:29:00.642324Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.12890/citation-record","integrity":"/paper/2505.12890/integrity","json":"/paper/2505.12890/citation-record.json","paper":"/paper/2505.12890"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:01.064857Z","title":"Carts: Causality-driven robot tool segmentation from vision and kinematics data","venue":null,"work_id":"f4fb1148-0efa-43a4-b420-3a9d65d74240","year":2022},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.512433Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:13160a1f33e0ac7ddd0bdcca3f14f48c8fefc83c9a24cb2d433019455d2b130f","observation_id":"0173b5f9-5e24-4af2-9516-2daef71eb606","resolution":{"observed_at":"2026-08-15T20:29:01.069402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:01.051502Z","title":"Clap learning audio concepts from natural language supervision","venue":null,"work_id":"d91771aa-5ad7-4e6c-b624-1d1461ec4144","year":2023},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.517509Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:aeaa4c7cef1bc034ed82d4dc401c958762ff05432b0a10105cf451f948cc3680","observation_id":"a37e8038-51b2-4a23-b961-98b5716a3cbb","resolution":{"observed_at":"2026-08-15T20:29:01.055699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:01.037813Z","title":"Egosurgery-phase: a dataset of surgical phase recognition from egocentric open surgery videos","venue":null,"work_id":"e74455f5-bcad-4aa0-8572-e03f4da00293","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.522015Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:ac9b648c00e9cdb4867e56e50335ba1127e5ec0cbbac7d72a0bb6df71d58aeda","observation_id":"a3609622-22b1-4b8c-a188-4092c1f6c0d1","resolution":{"observed_at":"2026-08-15T20:29:01.042508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:01.024259Z","title":"Tri-modal confluence with temporal dynamics for scene graph generation in operating rooms","venue":null,"work_id":"45fc6c80-f831-4213-a180-51dd4f12f16f","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.526650Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:58d45d53dcf886f957542d2c6953054798957a023d5eee0d2cc5d2baa5e60b3c","observation_id":"0cadd867-52d9-494d-93a2-598cdd911310","resolution":{"observed_at":"2026-08-15T20:29:01.028750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:01.009212Z","title":"Pitvqa: Image-grounded text embedding llm for visual question answering in pituitary surgery","venue":null,"work_id":"e878bc41-fa9e-4b6b-8c09-416496e12459","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.531556Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:1ad576f8afdf23a36ed482c83f4dc778db797203bf0935e0e2271c8edcb24fb2","observation_id":"788dbee7-3314-4727-a0e6-0ab6d27415d5","resolution":{"observed_at":"2026-08-15T20:29:01.014405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T20:29:00.536247Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.536247Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:72c1a3a165388f4c9b518b4b47f319a9a751f415c55b1f1c3dcd1a4855cd6e70","observation_id":"e927c7d3-5224-46a6-92fb-a1d91d99d33a","resolution":{"observed_at":"2026-08-15T20:29:00.536247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T20:29:00.541427Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.541427Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:f0e76c28ba6666f82301b83e92bd5e93ab505f2a91fe9cfbc4784f57945ba559","observation_id":"d9466fc0-cb9a-449e-8fa0-4ee1514496c5","resolution":{"observed_at":"2026-08-15T20:29:00.541427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.993395Z","title":"Multi-task recurrent convolutional network with correlation loss for surgical video analysis","venue":null,"work_id":"fc9451b1-ad5c-4e96-97d5-2642f4d00d77","year":2020},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.546060Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:8c867891330eb032f7ff8f813cbabe836b9c26b9d4feb6b3081a3b4ec5ad0029","observation_id":"0e88cc8d-877b-4606-8408-58ea24a75fc8","resolution":{"observed_at":"2026-08-15T20:29:00.998539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.979468Z","title":"Work-system interventions in robotic- assisted surgery: a systematic review exploring the gap between challenges and solutions","venue":null,"work_id":"a5efc8fa-578f-46e3-b75b-0b8ab5c240d1","year":1976},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.550199Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:83857e9a8befac00a7bbbda36dc6baad49673174c29ef60c29377282b1135b64","observation_id":"24d2bb31-9ff9-4706-88b4-a6a79ae4930d","resolution":{"observed_at":"2026-08-15T20:29:00.984053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.965384Z","title":"Surgical process modelling: a review","venue":null,"work_id":"d8e27b74-6d6c-4cca-948c-3d4247221cf9","year":2014},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.554371Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:15911667ea34232e17b60b33774d6ee515969200201425282af42911834e6952","observation_id":"b159b259-e4a5-43e0-9ccf-caca0cd16533","resolution":{"observed_at":"2026-08-15T20:29:00.969942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07981","last_updated":"2024-08-15T07:00:20Z","snapshot_observed_at":"2026-08-16T13:26:19.822980Z","submitted_at":"2024-08-15T07:00:20Z","title":"LLaVA-Surg: Towards Multimodal Surgical Assistant via Structured Surgical Video Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07981","snapshot_observed_at":"2026-08-15T20:29:00.558814Z","title":"Llava-surg: towards multimodal surgical as- sistant via structured surgical video learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.558814Z"},"links":{"cited_paper":"/paper/2408.07981","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:dfd39c6b9e9c6641ee938c8bef5021133f5e9aa93f9f1d463f15485cf83e2eb3","observation_id":"31a8f618-4c14-40e7-ad06-ce019d665986","resolution":{"observed_at":"2026-08-15T20:29:00.558814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.951077Z","title":"A multimodal generative ai copilot for human pathology","venue":null,"work_id":"c4e3d20e-2bb1-428f-b25f-fbb19621edb8","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.563334Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:cf63e0662170c0d03b079ccf50c28ce0c9368bb5dc971b5787f792c682f48156","observation_id":"903312c5-6e85-4d97-9a16-f7cc254745cb","resolution":{"observed_at":"2026-08-15T20:29:00.955675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.936922Z","title":"Surgical data science for next- generation interventions","venue":null,"work_id":"573619cf-bd48-444d-8c44-7aa67747361e","year":2017},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.567573Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:0b661991204fe1a7103604a82ccc489b521ef789fd7cae2a02a66206ef8e43c1","observation_id":"27ebca2c-b31f-4371-9bfa-3d19d34f39ed","resolution":{"observed_at":"2026-08-15T20:29:00.941642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.572047Z","title":"Rendezvous: Attention mechanisms for the recognition of surgical action triplets in endoscopic videos","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.572047Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:7286e3377513dbb2674ad880d73913e15e4771958a1cba7e6f968c382750456f","observation_id":"44d98bab-2552-43cd-b2f1-a301edfc35c9","resolution":{"observed_at":"2026-08-15T20:29:00.572047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.912404Z","title":"Labrad-or: Lightweight memory scene graphs for accurate bimodal reasoning in dynamic operating rooms","venue":null,"work_id":"0f8a9cc3-879d-41ad-bf07-7f9859cd65e1","year":2023},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.576722Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:49b283773a9849a9e6b0c76abd3d0b41f3724509cd6ec5652d52537a50995b5b","observation_id":"7b2284f5-61b6-447d-8e92-cef7b5b15c0f","resolution":{"observed_at":"2026-08-15T20:29:00.917403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.897333Z","title":"4d-or: Semantic scene graphs for or domain modeling","venue":null,"work_id":"d4c8fd36-0236-49d8-958b-04a26ef2fdfc","year":2022},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.581172Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:969562bd88c0786c02280a0a430513be405665f281fdaf930e8e9d5f7441776f","observation_id":"1bcb73b1-09bf-41c1-86a7-fd9ac1b5ab1f","resolution":{"observed_at":"2026-08-15T20:29:00.901809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.883311Z","title":"Mm-or: A large multimodal operating room dataset for semantic understanding of high-intensity surgical environments","venue":null,"work_id":"5ecb58ad-376d-4d3f-b955-eacd1e74ea23","year":2025},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.585281Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:780271986fc42e8cad207cae8a4ca64ccb65aec9110f15dca9528cf7075766a5","observation_id":"bbfa0bbf-da4c-4da2-ac7a-cc61212ce680","resolution":{"observed_at":"2026-08-15T20:29:00.888026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.869628Z","title":"Oracle: Large vision-language models for knowledge-guided holistic or domain modeling","venue":null,"work_id":"223a0850-013a-4e5e-9a99-ef4fa665e4d6","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.589554Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:85654a1e54a3190816ebc4aa8f7eb2d9651602128f513f95cf31314b3b534728","observation_id":"aeb61167-75a0-407a-8b01-cbb5534eb062","resolution":{"observed_at":"2026-08-15T20:29:00.874112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.855672Z","title":"S 2 former-or: Single-stage bi-modal transformer for scene graph generation in or","venue":null,"work_id":"0002f68e-7b93-4b83-9bd9-f219cf5a78d6","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.593986Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:13e6ed0685c63b96ba98097c2b5bb4498d41a62b64ebb255b8f7b4093dbcf171","observation_id":"9ce4abd2-496f-4888-8257-3b68dae8ed65","resolution":{"observed_at":"2026-08-15T20:29:00.860234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18681","last_updated":"2025-05-07T07:22:02Z","snapshot_observed_at":"2026-08-21T18:00:08.891096Z","submitted_at":"2023-11-30T16:28:40Z","title":"RaDialog: A Large Vision-Language Model for Radiology Report Generation and Conversational Assistance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18681","snapshot_observed_at":"2026-08-15T20:29:00.598147Z","title":"Radialog: A large vision-language model for radiology report generation and conversational assistance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.598147Z"},"links":{"cited_paper":"/paper/2311.18681","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:2469e2875f156b9d729a1ad7d60197b747b88b5db07d2e91275d6dc62b02822b","observation_id":"9c3ddbcc-2bf1-4de0-afe6-92878f3abbfc","resolution":{"observed_at":"2026-08-15T20:29:00.598147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.840901Z","title":"Development, deployment and scal- ing of operating room-ready artificial intelligence for real-time surgical decision support","venue":null,"work_id":"17baa1a8-ea4c-4082-9921-469356085ee0","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.602735Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:cec0ad60925354db1d07a1bb6150923a4ab13931ac409c21d43a077bf19c2d48","observation_id":"afcbaf2a-cc54-4f25-8412-ffbc4bba8420","resolution":{"observed_at":"2026-08-15T20:29:00.845304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.607108Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.607108Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:1405422348974709fa6e340f21ee92d5a59451b337832abd5e998c65ffe8ef12","observation_id":"cebbf161-b1ed-42c0-94d3-a1544dcc66a0","resolution":{"observed_at":"2026-08-15T20:29:00.607108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.817799Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"3471a54b-8d31-4c6b-bf53-731734101415","year":2023},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.611214Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:ba88354a6a23899ca8bce7a044c2b99b2dc06223bb6628e9b7123c4ff5956c37","observation_id":"3222cdad-ff65-4017-9ce3-485276a9aeb8","resolution":{"observed_at":"2026-08-15T20:29:00.822892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.803126Z","title":"Mvor: A multi-view rgb-d operating room dataset for 2d and 3d human pose estimation","venue":null,"work_id":"c1cd3c65-c940-4d94-9c4e-5683f8b2ef07","year":2018},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.615577Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:df96896ecd396f52da2ad508922fcbe2f5e57f4038f517be4a87de0b9b7b74eb","observation_id":"a45f6d8d-49e8-4896-8186-24aa53a3a347","resolution":{"observed_at":"2026-08-15T20:29:00.808095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.619831Z","title":"Endonet: a deep architecture for recognition tasks on laparoscopic videos","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.619831Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:28e64c06339052b6c6916dcbc9f64e4668099dd207a410b62a610d3f53179dd9","observation_id":"e8b01447-926d-4bae-b2f3-6caec03aaf53","resolution":{"observed_at":"2026-08-15T20:29:00.619831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T20:29:00.624457Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.624457Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:3de630682d42ba504f02808e20748ae655487e0491bef6f1553dfe5575ed6b4f","observation_id":"6ac954c3-fd2f-4cef-be6c-2d4fc9dac648","resolution":{"observed_at":"2026-08-15T20:29:00.624457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02463","last_updated":"2023-11-16T12:38:46Z","snapshot_observed_at":"2026-08-16T15:10:43.905696Z","submitted_at":"2023-08-04T17:00:38Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02463","snapshot_observed_at":"2026-08-15T20:29:00.629104Z","title":"Towards generalist foundation model for radiology by leveraging web-scale 2d&3d medical data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.629104Z"},"links":{"cited_paper":"/paper/2308.02463","citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:a036ee69679bcb36f00dc53965d4ade5a3860414dca73cac9270f2978105e924","observation_id":"742f87ec-099d-4281-bfc8-039e0460e772","resolution":{"observed_at":"2026-08-15T20:29:00.629104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.633723Z","title":"Point transformer v3: Simpler faster stronger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.633723Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:e87fa96c0dbef1647a27fc63b4ea1653977047989ef912bfa9b667daabd5d7e8","observation_id":"d3a724ca-2cea-4e65-9c90-750b70359ebc","resolution":{"observed_at":"2026-08-15T20:29:00.633723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.772374Z","title":"Teleor: Real-time telemedicine system for full-scene operating room","venue":null,"work_id":"7c5d2a4b-83b9-480b-a8a5-aa1a38ac5f86","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.637835Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:418548b3d20d80819346409379ebbc1bbf2c0460d678ec5e5e0d689991577d28","observation_id":"004ebcdd-fd80-4737-b685-abd9ce3a5d41","resolution":{"observed_at":"2026-08-15T20:29:00.776770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:00.756691Z","title":"Advancing surgical vqa with scene graph knowledge","venue":null,"work_id":"1d9f0bc9-9e00-4342-b055-85e7b7024829","year":2024},"citing_paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:29:00.642324Z"},"links":{"citing_paper":"/paper/2505.12890"},"observation_digest":"sha256:4e1367172d611191e948c3d59ea621d2c3bc4979e6462114d962c166a2b64c17","observation_id":"679dbffe-7801-4f73-9323-5901d5ebf416","resolution":{"observed_at":"2026-08-15T20:29:00.762902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.12890","last_updated":"2025-07-04T12:31:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T08:22:45.028390Z","submitted_at":"2025-05-19T09:20:29Z","title":"Specialized Foundation Models for Intelligent Operating Rooms"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.12890."}