{"as_of":"2026-08-07T16:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fe23365cc6072ce047907996d10fc7865f993d877a85cf2df54fdb865f88e0e","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:54:39.775138Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.04317/citation-record","integrity":"/paper/2507.04317/integrity","json":"/paper/2507.04317/citation-record.json","paper":"/paper/2507.04317"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:36.418592Z","title":"The Rise of Minimally Invasive Surgery: 16 Year Analysis of the Progres- sive Replacement of Open Surgery with Laparoscopy","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.418592Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b0e8b80d69a897c08f2abe1467558d08f38697902028a1215d51957043974d06","observation_id":"2117ba29-dd76-46d0-82d0-6a17c09db356","resolution":{"observed_at":"2026-08-06T19:54:36.418592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.043933Z","title":"Minimally Invasive Versus Open Lumbar Fusion: A Comparison of Blood Loss, Surgical Complications, and Hospital Course","venue":null,"work_id":"66500799-e9ff-4c60-9bea-36d3ca38512e","year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.509950Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:62c852df7f92c64f71cecb1c9efb52e409a5b1837f927a7a52ccd4c48c4b5649","observation_id":"e840957b-2bbc-40dd-b3ee-f36ba8c2f330","resolution":{"observed_at":"2026-08-06T19:54:42.047071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.7917","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.661137Z","title":"Minimally invasive spine surgery decreases postoperative pain and inflammation for patients with lumbar spinal stenosis","venue":null,"work_id":"67152303-7e84-488b-ab57-887b6f81c062","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.621300Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:4a0137d19d14004ebac8caa55750271020c11be74bdfecc57ce3363787fc1968","observation_id":"1e707feb-d3bc-4f31-ba03-45f5c30d3b5d","resolution":{"observed_at":"2026-08-06T19:54:41.703990Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4240/wjgs.v16.i8.2484","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:40.481028Z","title":"Impact of minimally invasive surgery on immune function and stress response in gastric cancer patients,","venue":null,"work_id":"143a9a8d-dfd7-4d00-b7b3-46cdf6f4e817","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.695558Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:741a8d0a1d9351648979b7b2799130ae8109a01b8d0670fa94271a36c1a5971c","observation_id":"abf04d50-8f7c-44c1-9f9c-ee3633988201","resolution":{"observed_at":"2026-08-06T19:54:40.521398Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.034461Z","title":"Does Minimally Invasive Mitral Valve Repair Mean Less Postoperative Pain? The Annals of Thoracic Surgery","venue":null,"work_id":"b3ec4f51-a774-400a-87ca-b46bc1253311","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.776684Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:39b36e09cfcb73e3af91d0f75a5919e864c6f87a6d449ceef8e84c33f91ff27e","observation_id":"cb75ee7a-963d-49b0-9713-9573bee20b8b","resolution":{"observed_at":"2026-08-06T19:54:42.038038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/ags3.12513","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:40.002214Z","title":"Artificial intelligence- based computer vision in surgery: Recent advances and future perspectives","venue":null,"work_id":"845679f5-0093-418d-8995-b305100734bd","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.912310Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:414ebf17a190dee4e546a868d425a02b52d984a404e48621060e3b8a6df2d03a","observation_id":"d9179218-0874-4549-82ec-eb3ce6fa54d7","resolution":{"observed_at":"2026-08-06T19:54:40.050597Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.024599Z","title":"Digital tools and innovative healthcare solutions: Serious games and gamification in surgical training and patient care,","venue":null,"work_id":"480189b5-9e50-40c7-8f01-f266d7278d55","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.008340Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:719b3f02a9b516d3b63c4ac07963c36c235ee99876150de9a7b08b6da2f9c3d2","observation_id":"25af26d1-712d-4713-a02f-d9949f90754c","resolution":{"observed_at":"2026-08-06T19:54:42.028193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.105444Z","title":"Computer Vi- sion in the Operating Room: Opportunities and Caveats,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.105444Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:4908142e99dff03ead43adc88c3b20efcac5721aea6987b951788685d0f77b01","observation_id":"44b2a0fd-c657-46e0-a8f5-ec408c927e32","resolution":{"observed_at":"2026-08-06T19:54:37.105444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.014953Z","title":"Novel applications of deep learning in surgical training,","venue":null,"work_id":"91de5f84-8e58-42b1-baa7-fe61e351f97b","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.214496Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ee5febbcd2c3c55284e6559d0581a33c1dea49739931310e3ae218ed2332dac1","observation_id":"0077143e-e4ba-4a2c-98a6-5254897f68c5","resolution":{"observed_at":"2026-08-06T19:54:42.018836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1117/12.2512994","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:39.836298Z","title":"Segmentation of surgical instruments in laparoscopic videos: training dataset generation and deep-learning- based framework","venue":null,"work_id":"4855837f-5526-405c-99a8-299f57b64da5","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.311029Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:cf02759fb930a8e60b6734d855b9b61b5a38970cbaf98846fe28b8d73135fd42","observation_id":"3c2da3fb-b184-4fd9-b2f4-82a52808428e","resolution":{"observed_at":"2026-08-06T19:54:39.932588Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.6262","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.266097Z","title":"Analyzing Surgical Technique in Diverse Open Surgical Videos With Multitask Machine Learning","venue":null,"work_id":"b3edc1dd-5ead-434d-b909-bbd60095a66e","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.361710Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:a046777f1d52470de9ba76176b7d094def31bdfc9551bf709c94a339595ae6ef","observation_id":"390df135-3634-4202-92a0-9bc6a6caa469","resolution":{"observed_at":"2026-08-06T19:54:41.373039Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.458766Z","title":"Deep learning for surgical instrument recognition and segmentation in robotic- assisted surgeries: a systematic review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.458766Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:c2ea1e3d03cf80a1793b32b3be1fed0f07021a62ec18013622ad96f4e34cb20f","observation_id":"8f1658a4-c4dd-4fd5-aff4-6cee07a33272","resolution":{"observed_at":"2026-08-06T19:54:37.458766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00681","last_updated":"2021-05-05T02:09:53Z","snapshot_observed_at":"2026-08-04T12:33:49.991895Z","submitted_at":"2021-05-03T08:33:53Z","title":"S3Net: A Single Stream Structure for Depth Guided Image Relighting","version":2},"cited_work":{"arxiv_id":"2105.00681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.00681","snapshot_observed_at":"2026-08-06T19:54:40.985344Z","title":"S3Net: A Single Stream Structure for Depth Guided Image Relighting","venue":"cs.CV","work_id":"7977ec04-2f0c-40bd-af52-7ade75c1b141","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.554130Z"},"links":{"cited_paper":"/paper/2105.00681","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:3b42f9a5f8c1dbc7f2307baaaab2deacfbabd7b350f7b868260154acbe32c14a","observation_id":"35aea0e0-ff84-4499-a0b7-e2eca6c05464","resolution":{"observed_at":"2026-08-06T19:54:41.059211Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.614443Z","title":"MATIS: Masked-Attention Transformers for Surgical Instrument Segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.614443Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ba4c1fbac9b250b6c332f87201da24d211a57df7d0341dfea01753278bf9c1ca","observation_id":"99a1ef7c-0936-4140-9bc3-db122fee9307","resolution":{"observed_at":"2026-08-06T19:54:37.614443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-06T19:54:37.724288Z","title":"U-Net: Convolutional Net- works for Biomedical Image Segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.724288Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:f77c83077c61be8d1f47000eb19cd51c7052cdb5f17597995b77d2b58a9af587","observation_id":"7bce4d50-ca52-4ea8-bba0-cd240d8adb59","resolution":{"observed_at":"2026-08-06T19:54:37.724288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-07-06T15:12:37.953383Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T19:54:37.801314Z","title":"Segment Anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.801314Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:a2dad8389ed8b94da9f6e4dbbe18c4c7c02050a02294710d8185fdd9438bd6dc","observation_id":"90ea689a-faf3-4615-a24b-d5a35a4b2819","resolution":{"observed_at":"2026-08-06T19:54:37.801314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11968","last_updated":"2023-04-28T03:21:27Z","snapshot_observed_at":"2026-08-07T01:13:26.264814Z","submitted_at":"2023-04-24T10:04:06Z","title":"Track Anything: Segment Anything Meets Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11968","snapshot_observed_at":"2026-08-06T19:54:37.920077Z","title":"Track Anything: Segment Anything Meets Videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.920077Z"},"links":{"cited_paper":"/paper/2304.11968","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ab483ed5c8d906c20b22507bee8459088fb4d1507b660df70a817974d24ad651","observation_id":"68a3a034-4946-4916-8007-372c479b0fe2","resolution":{"observed_at":"2026-08-06T19:54:37.920077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03048","last_updated":"2023-10-04T01:15:21Z","snapshot_observed_at":"2026-08-06T10:14:06.161139Z","submitted_at":"2023-05-04T17:59:36Z","title":"Personalize Segment Anything Model with One Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03048","snapshot_observed_at":"2026-08-06T19:54:37.985039Z","title":"Personalize Segment Anything Model with One Shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.985039Z"},"links":{"cited_paper":"/paper/2305.03048","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:8ff951db567780e8a81e21ecbdec269300e2678bddd6672b6072a6e6493342b6","observation_id":"8c1a4ef5-9eec-4c0d-9f44-d0b04046bd4a","resolution":{"observed_at":"2026-08-06T19:54:37.985039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08746","last_updated":"2023-12-21T11:56:08Z","snapshot_observed_at":"2026-07-06T16:07:06.809394Z","submitted_at":"2023-08-17T02:51:01Z","title":"SurgicalSAM: Efficient Class Promptable Surgical Instrument Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08746","snapshot_observed_at":"2026-08-06T19:54:38.058935Z","title":"Sur- gicalSAM: Efficient Class Promptable Surgical Instrument Segmen- tation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.058935Z"},"links":{"cited_paper":"/paper/2308.08746","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:972a5d9d56f365181738061c6257a1b3089634ecf376f4cdcc4e2eb3d87f716b","observation_id":"47166685-3f7f-4e81-b84a-36d59a0de644","resolution":{"observed_at":"2026-08-06T19:54:38.058935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00499","last_updated":"2024-07-09T05:59:35Z","snapshot_observed_at":"2026-07-06T15:36:26.422696Z","submitted_at":"2023-06-01T09:49:11Z","title":"DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation","version":2},"cited_work":{"arxiv_id":"2306.00499","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.00499","snapshot_observed_at":"2026-08-06T19:54:40.678248Z","title":"DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation","venue":"eess.IV","work_id":"6768613d-a25f-4d41-a557-54f0f7fac46e","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.119846Z"},"links":{"cited_paper":"/paper/2306.00499","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b89182bf12ea891c3004fddf5c1b957fa92bcf1369919e575394fbf54d077423","observation_id":"8b2d5209-9f4b-4426-a4b5-b39643efa823","resolution":{"observed_at":"2026-08-06T19:54:40.737497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.004947Z","title":"Segmentation of Brain Tumor in MRI Scans Using Deep Learning,","venue":null,"work_id":"4b7f39f9-26ca-45f3-91f7-852c2068da9b","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.176682Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b9f263475760aecf48a7fc762d6f4410dd0cb0811b51432433f58e9be38ec2d2","observation_id":"6ca32da9-a389-4dc0-ada0-f386306c3a1c","resolution":{"observed_at":"2026-08-06T19:54:42.009253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.995867Z","title":"Object Segmentation for Robotic Grasping in Cluttered Environments,","venue":null,"work_id":"e009132c-990b-46db-9bdd-866017a65819","year":2020},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.222626Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ebceb9c4bf900cc686d43119a2b544a654aee2410c503d61409ecce6ba0d05a6","observation_id":"dfad9add-cf04-4e0a-af08-ce02c1967b2a","resolution":{"observed_at":"2026-08-06T19:54:41.999178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.986234Z","title":null,"venue":null,"work_id":"b4b81409-d3f0-482e-b622-fd7b13a718ac","year":1989},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.298859Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:9fed5107e4606cf64ee5c717ea43ab0a3c8776d5e26e415f077a6efae66bdb63","observation_id":"7ffc26f5-106a-482c-b3ff-ab7ede30b769","resolution":{"observed_at":"2026-08-06T19:54:41.990053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.975657Z","title":"U-Net: Convolutional Net- works for Biomedical Image Segmentation,","venue":null,"work_id":"33e5da71-ca32-4771-9c68-00d0b8ca60d8","year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.367241Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:cc140ecfc8a2474936bdf8f84b2cc0445c3f45c98bd8e92d44f1db69373239fa","observation_id":"adef43a9-599e-418d-ab4c-3df53f4e30c7","resolution":{"observed_at":"2026-08-06T19:54:41.979282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.965753Z","title":"Dermatologist-level Classification of Skin Cancer with Deep Neural Networks,","venue":null,"work_id":"19527a1f-6048-46bf-8969-197090d92305","year":2017},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.422482Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:c3dbf4ee454a8870ff522df4d21ae054d3d52538f6a98cab598a4dafda99c444","observation_id":"cd236959-7812-4941-a8a6-645aea318a2f","resolution":{"observed_at":"2026-08-06T19:54:41.969121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.955460Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":"3d580f83-3ff7-40e6-befa-77879d1bc0b3","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.504328Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:d32b0749d5b9103aa468bdf0c6dcce6b98e8d842300f5a0588d7977964c767d2","observation_id":"75542f48-5d49-4c9e-8448-a8a09cd935a5","resolution":{"observed_at":"2026-08-06T19:54:41.958834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.945802Z","title":"UNETR: Transformers for 3D Medical Image Segmentation,","venue":null,"work_id":"ad89be04-b891-48a1-acea-6f554b8dedee","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.554434Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:6015715f301e576837d6f4966e32958ea109523bb2e34b372105f55a0649ce48","observation_id":"0249064e-633a-4538-b228-f5458cc3ea1f","resolution":{"observed_at":"2026-08-06T19:54:41.949426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.936731Z","title":"Segmenter: Transformer for Semantic Segmentation,","venue":null,"work_id":"50c790fb-afcd-45bd-8477-d4e9f9e84b5a","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.642902Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:788bec8db239185c0a292a9f39a18fc18ee8830d88c3d1d70d51c609f7924ea5","observation_id":"5b6fb987-135f-4aae-8a98-215a47502110","resolution":{"observed_at":"2026-08-06T19:54:41.940035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.927223Z","title":"SETR: Vision Transformers for Semantic Segmenta- tion,","venue":null,"work_id":"38f52139-cd83-48a0-bdbf-9fdfb509441b","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.711349Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:3cc43444edb98758adbba2d2bca1490778766bc12a7e4e87fe2fdf6a94a938a4","observation_id":"9aabc543-ad8c-4e53-ac0d-295c36843cf0","resolution":{"observed_at":"2026-08-06T19:54:41.931108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04306","last_updated":"2021-02-08T16:10:50Z","snapshot_observed_at":"2026-07-06T10:39:29.945712Z","submitted_at":"2021-02-08T16:10:50Z","title":"TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04306","snapshot_observed_at":"2026-08-06T19:54:38.788847Z","title":"TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.788847Z"},"links":{"cited_paper":"/paper/2102.04306","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:87f86ca430929fa1af963d44af5f7e3261ea40f00990436c724968d051adf05f","observation_id":"7987409b-511c-49b8-aecc-825abd67b3e6","resolution":{"observed_at":"2026-08-06T19:54:38.788847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.918147Z","title":"Prostate Segmentation Using Hybrid Transformer-CNN Models,","venue":null,"work_id":"d7fd08e7-9a79-4524-b120-ac2bc4a75506","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.860587Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:06fc4aa439edb75941f02c6ee643266807fadc73918f95b660d6952c0f64dfeb","observation_id":"e28d11a5-1c1c-47ef-a1c7-cc8832845087","resolution":{"observed_at":"2026-08-06T19:54:41.921510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.908326Z","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers,","venue":null,"work_id":"39878cdf-5108-42f5-9c61-68d5f59bbb93","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.933296Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:59852f4678d8544d24ca50408600532e57c113f440ffac5e49273588c23081a9","observation_id":"a22052e9-ca01-4c1c-ac99-554585ccbf2a","resolution":{"observed_at":"2026-08-06T19:54:41.911912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.898821Z","title":"Learning Transferable Visual Models From Natural Language Supervision,","venue":null,"work_id":"48ada8bd-10c9-4a64-bc99-fd610d76d198","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.973501Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:f49873d37ff573c90295fac1afe864c794bdccd0717d8e3255c5bb54b403aa85","observation_id":"a3ea7f50-0ca6-4116-ad0c-b6be99fe7bcb","resolution":{"observed_at":"2026-08-06T19:54:41.902071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.889813Z","title":"Zero-Shot Medical Image Segmentation Using CLIP,","venue":null,"work_id":"bce65951-ddf9-40de-b97b-eba40c4bb75a","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.055174Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:7d019333141fb4043aeddd56c94236d1f5f8911eee5fc84c66b64e5dfb579a8e","observation_id":"d2e2828d-c010-48b9-8b01-ecc11a1d32ab","resolution":{"observed_at":"2026-08-06T19:54:41.892960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-02T08:01:43.194717Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-06T19:54:39.134498Z","title":"BLIP: Bootstrapped Language-Image Pre-training for Uni- fied Vision-Language Understanding and Generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.134498Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:85f270f078d9269b92242b2b6b95b05f329820815083cb3d464f443038f3afcd","observation_id":"82005ae4-b23d-42ac-82a1-731b1d9e7fdf","resolution":{"observed_at":"2026-08-06T19:54:39.134498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.880355Z","title":"Vision-Language Models for Surgical Assistance: A Case Study in Laparoscopic Surgery,","venue":null,"work_id":"dd5be1bb-9eb9-4732-83c9-83880d97ede9","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.187275Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:360cf4d5e68b06bd67dfb0db7d9fdc1f2a5cfc389ddc92661ff3a65dbdf69e93","observation_id":"e729320c-5e81-46c6-826b-12aa82db4804","resolution":{"observed_at":"2026-08-06T19:54:41.883869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-02T19:54:26.138356Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-06T19:54:39.253513Z","title":"A Sim- ple Framework for Contrastive Learning of Visual Representa- tions,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.253513Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:0d6f898d8aef0cef7211cadabec6b79163d5711d448be2fb9969ac983af549eb","observation_id":"e7b64698-c1fa-4a9a-90a6-d5d75302b32b","resolution":{"observed_at":"2026-08-06T19:54:39.253513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.870488Z","title":null,"venue":null,"work_id":"def97390-6126-452d-a364-ce613bc3e219","year":2018},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.290513Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:73c78c3f2616311764c50389beae3465329c75db48f4b5fe04b790fd71dccce4","observation_id":"ff1cb08c-ef96-4deb-93f3-b108fd2d6c7c","resolution":{"observed_at":"2026-08-06T19:54:41.873504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.861497Z","title":"Bengio, J","venue":null,"work_id":"824aab65-3ac7-402f-b998-054964ba8ebc","year":2009},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.293640Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:d05ba1609771471ac606600fd7ac265d54e4c80383e57ae2e6e63071ee999649","observation_id":"33b2d0cc-3a45-4735-bdfa-7134e1ab2c12","resolution":{"observed_at":"2026-08-06T19:54:41.864639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.852281Z","title":null,"venue":null,"work_id":"9d8b49b1-4d1d-4586-b7ab-df9c439c1a71","year":1948},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.296444Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:39b8b114c25f4f975b8ad46016fc90bdb11da6370f8cd49bb3e7fb2347f88882","observation_id":"2401e4fa-5dd6-4921-9085-1544e41ea93f","resolution":{"observed_at":"2026-08-06T19:54:41.855599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.843715Z","title":null,"venue":null,"work_id":"488e85a6-3337-45b8-bfd9-209814886621","year":1948},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.299542Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:350c6ef2a6c6336679ce0514371f99a5c33522ed79b0aa4efa0e324c0720eda9","observation_id":"5d322b65-fc5c-4360-a88b-59fa85212615","resolution":{"observed_at":"2026-08-06T19:54:41.846544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.782189Z","title":null,"venue":null,"work_id":"f6e1fbdc-9d9c-41a9-9d33-c70894f4ba05","year":1945},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.371567Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:bff7974f60f41a488aa1a2637bda51007c80639e30085a6a98b7e13698ce634e","observation_id":"948c36f6-0bf7-4b09-a206-9aaf7fa157f3","resolution":{"observed_at":"2026-08-06T19:54:41.838084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T19:54:39.576293Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.576293Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:d6968f121c41af845959c177ad191e02883a1fadea413f03eabcea60ca1f3eba","observation_id":"5510acdb-cf12-4d28-9857-db19e3aeb287","resolution":{"observed_at":"2026-08-06T19:54:39.576293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06426","last_updated":"2019-02-21T17:01:02Z","snapshot_observed_at":"2026-08-07T15:18:47.460768Z","submitted_at":"2019-02-18T07:08:36Z","title":"2017 Robotic Instrument Segmentation Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06426","snapshot_observed_at":"2026-08-06T19:54:39.650058Z","title":"2017 Robotic Instrument Segmentation Challenge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.650058Z"},"links":{"cited_paper":"/paper/1902.06426","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:98d749738315eb3ccdf13a766c84587d887bb24de85684735e4b497cb5794474","observation_id":"2d750b7f-142f-4b80-ab8d-c9fcc45cab0f","resolution":{"observed_at":"2026-08-06T19:54:39.650058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11190","last_updated":"2020-08-03T01:55:24Z","snapshot_observed_at":"2026-08-05T21:16:20.262505Z","submitted_at":"2020-01-30T06:37:07Z","title":"2018 Robotic Scene Segmentation Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.11190","snapshot_observed_at":"2026-08-06T19:54:39.708182Z","title":"2018 Robotic Scene Segmentation Challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.708182Z"},"links":{"cited_paper":"/paper/2001.11190","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ccf8d0da3a22499b03407e987c21ccae69c87c4ff935821cf55f9d5697f2acfe","observation_id":"7c870053-8de5-4233-98ce-0a35e8877fa6","resolution":{"observed_at":"2026-08-06T19:54:39.708182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05533","last_updated":"2020-07-10T16:20:56Z","snapshot_observed_at":"2026-07-06T09:37:14.924296Z","submitted_at":"2020-07-10T16:20:56Z","title":"ISINet: An Instance-Based Approach for Surgical Instrument Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05533","snapshot_observed_at":"2026-08-06T19:54:39.775138Z","title":"ISINet: An Instance-Based Approach for Surgical Instrument Segmentation,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.775138Z"},"links":{"cited_paper":"/paper/2007.05533","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:cf4a339a0ad3891d9d5ae428970abd1c098cb22846b2f525e011a869a8293935","observation_id":"57f94bbd-4bde-4189-9a01-818d4e014975","resolution":{"observed_at":"2026-08-06T19:54:39.775138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.athoracsur.2022.11.009","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:40.192576Z","title":"Available from: https://www.sciencedirect.com/science/article/pii/S0003497522014308","venue":null,"work_id":"d7a7884c-349a-4b5b-b955-0b20570872fb","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":1178,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.837067Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:85f3e044c85c5fd64be0b9fd020a4031a3baa781fc80b220b8364cf7869299a8","observation_id":"1e1e431b-1c3e-4fd2-9a2c-83023199ec02","resolution":{"observed_at":"2026-08-06T19:54:40.323228Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-07T09:40:27.476162Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":8,"verified_fuzzy":18},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.04317."}