{"as_of":"2026-08-11T19:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c180e5ee1df0a15cec62fcc425fe0d498a52bd0927cf50f3f6934ec5fde72a60","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:58:30.055411Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:21:40.759357Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:21:44.721684Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"cited_work":{"arxiv_id":"2501.09555","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09555","snapshot_observed_at":"2026-08-06T20:21:44.721684Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","venue":"cs.CV","work_id":"c34537a7-eced-4b7f-97c3-d93ba8777f45","year":2025},"citing_paper":{"arxiv_id":"2507.03295","last_updated":"2025-08-11T07:31:41Z","snapshot_observed_at":"2026-08-09T05:20:32.617384Z","submitted_at":"2025-07-04T04:54:47Z","title":"CPKD: Clinical Prior Knowledge-Constrained Diffusion Models for Surgical Phase Recognition in Endoscopic Submucosal Dissection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:21:40.759357Z"},"links":{"cited_paper":"/paper/2501.09555","citing_paper":"/paper/2507.03295"},"observation_digest":"sha256:f1f972a596fd34473e76a50edc3011ec713d8b01cdc0be76180a486f15eccc5c","observation_id":"26345b51-1f17-4046-8379-ddeed7f4d3a3","resolution":{"observed_at":"2026-08-06T20:21:44.820536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.09555/citation-record","integrity":"/paper/2501.09555/integrity","json":"/paper/2501.09555/citation-record.json","paper":"/paper/2501.09555"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.295187Z","title":null,"venue":null,"work_id":"936d917d-e1a6-42b7-b510-46ac0a58fb42","year":2005},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.586616Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:faac16f3fc7549b76ed3bd39d0cad12777e9c7edbc62ebca659ed3432bf00449","observation_id":"43ea087c-64f4-4113-ad3d-894f4d3fe015","resolution":{"observed_at":"2026-08-10T19:58:31.353065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.148374Z","title":null,"venue":null,"work_id":"f0dbd401-b0c8-40dc-b1e3-89f099371bbd","year":2020},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.593947Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:a92cd8e11f0dd2946d34f2eaa3e3eca5266a696eb7974acd6715256d6386c98a","observation_id":"b8aaaa07-3a72-45e2-bf3c-230500716579","resolution":{"observed_at":"2026-08-10T19:58:31.199339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.136054Z","title":null,"venue":null,"work_id":"e20bdf02-de35-4cab-9281-4108f033de9e","year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.601216Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:fa4fa274ef424732c937662f4a222228ef1000fdc764ea03b875db264b452599","observation_id":"6fa50221-dd08-49a9-bb00-1583b5ef32ed","resolution":{"observed_at":"2026-08-10T19:58:31.140077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.122207Z","title":"I can’t believe there’s no im- ages! learning visual tasks using only language supervision, in: Pro- ceedings of the IEEE /CVF International Conference on Computer Vi- sion, pp","venue":null,"work_id":"4aa23376-22ad-48f7-b68d-38d66dcdb45d","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.608083Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:0bb7f020545ac1c9a54d73f5e86c1960f7ea28f39313bee446602d58b1803b5c","observation_id":"a853ea1a-95ba-4cd3-bd33-906fad56707c","resolution":{"observed_at":"2026-08-10T19:58:31.126610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.019710Z","title":"A k-means clustering algorithm","venue":null,"work_id":"62b9b6fc-8b58-4c54-93ca-406c56341b0e","year":1979},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.615929Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:62fe5687e4ad224ee5d6a3081251efdd8b1e97b79a3a246df8d4e1bf4ca64a8e","observation_id":"418a45d2-4161-48c8-8203-beedaefa8e8c","resolution":{"observed_at":"2026-08-10T19:58:31.082359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.005365Z","title":null,"venue":null,"work_id":"c04a34b6-ebed-40ec-8e44-ebbdce4d660e","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.621377Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:e13fa52f1e1ed67c58de10a3b1f07fe01b5bca0bccc3bc2691c818c1c57530d1","observation_id":"a0b99eda-ff0c-46c0-a332-8f39729378e6","resolution":{"observed_at":"2026-08-10T19:58:31.010264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.794557Z","title":"Latent graph representations for critical view of safety assessment","venue":null,"work_id":"d47b6dd1-7a93-4b0c-bf1e-faea88a84abf","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.629723Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:7fd84cacf41638a3694a6d77f61f7d16b1b67f4bc87af16eb4623fe07d97e039","observation_id":"5c524ee1-4658-4400-a9e4-d589fd2efd31","resolution":{"observed_at":"2026-08-10T19:58:30.846622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:29.634023Z","title":"Text-only training for image captioning using noise-injected CLIP, in: Goldberg, Y ., Kozareva, Z., Zhang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.634023Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:5471db46afdabcf6e0ac34f6970cfcb9ea3f9a9c24e56033127b9f816c3b80f8","observation_id":"2e5fd39c-03ab-4f00-9e12-a4e80447c76a","resolution":{"observed_at":"2026-08-10T19:58:29.634023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.781337Z","title":"Rendezvous: Attention mechanisms for the recognition of surgical action triplets in endoscopic videos","venue":null,"work_id":"e3ee6c2f-589f-48b2-92b6-10fb559d9ae5","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.638762Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:8acb044d2ba88b9155a6ab6b37af958ca8aff1f629e0fbed79b427691492a360","observation_id":"6d73ad59-8501-4043-b93b-da954d441220","resolution":{"observed_at":"2026-08-10T19:58:30.785614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.755958Z","title":"Machine and deep learning for workflow recognition during surgery","venue":null,"work_id":"2709c69b-27ca-4c5a-8f5e-d110c3bde111","year":2019},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.687621Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:6e861c8674609b7b800c6e77bac435f3f80b9a9dd0b477f4818dd1a608cf05bc","observation_id":"1965676f-65cc-4e1d-861d-8a14eeab5c6e","resolution":{"observed_at":"2026-08-10T19:58:30.771197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.693558Z","title":"Bleu: a method for automatic evaluation of machine translation, in: Proceedings of the 40th annual meeting of the Association for Computational Linguistics, pp","venue":null,"work_id":"18e908b7-464a-43ab-893f-e85f210f8947","year":2002},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.744728Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:4424a182f4e2278e9499f8b09eb2230b8a806e575b9fe533b73745efe2134da4","observation_id":"392f555d-026f-4d63-ab46-717e82c9a4de","resolution":{"observed_at":"2026-08-10T19:58:30.729598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02413","last_updated":"2017-06-07T23:37:44Z","snapshot_observed_at":"2026-07-06T05:46:01.107746Z","submitted_at":"2017-06-07T23:37:44Z","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02413","snapshot_observed_at":"2026-08-10T19:58:29.793971Z","title":"Pointnet ++: Deep hierar- chical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.793971Z"},"links":{"cited_paper":"/paper/1706.02413","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:459747107668797f2b5387afc37036c0c2d81d1b6794dd8824b1bc935241123b","observation_id":"e2cf401d-bf9f-4012-8792-6b0356b881e3","resolution":{"observed_at":"2026-08-10T19:58:29.793971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.669846Z","title":"Learning transferable visual models from natural language supervision, in: Inter- national conference on machine learning, PMLR","venue":null,"work_id":"a9f4fffa-6a74-4ab7-bc18-91fd36f55cc6","year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.878254Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:9711ca6a2e2855234e1baca3a66ae289b783d3ef3339c62fc07faf304b91e86b","observation_id":"b32e7f4e-248b-41db-9aaf-452cdd0926e2","resolution":{"observed_at":"2026-08-10T19:58:30.674429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.650995Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"353b0ceb-94cd-4fe2-bf4b-6e434b10fcb9","year":2019},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.894306Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:61b6e4b5a77728b2df06d3fb51e837539fed4cc6bed2b1a1fc21d799629b0c7a","observation_id":"74c254b5-b088-4852-b8c6-6c829984cf24","resolution":{"observed_at":"2026-08-10T19:58:30.660063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.517226Z","title":"Ima- genet large scale visual recognition challenge","venue":null,"work_id":"cb49dd36-0a63-42fb-9355-dee6cc0eed33","year":2015},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.964339Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:3321b1117b59fdb858c9916a424abed62386a018826e02fd67fe0622b6f7345e","observation_id":"4c83c0dd-4217-4d19-a01f-f2ba4154141d","resolution":{"observed_at":"2026-08-10T19:58:30.578523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.502430Z","title":"Surgical- vqa: Visual question answering in surgical scenes using transformer, in: MICCAI, pp","venue":null,"work_id":"2dbce859-83db-4bfe-882a-3b6ada0f5e97","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.974247Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:351a863ca3107dca77a01ecf412de8f97821c98f46795024164226cdf0e0f7bc","observation_id":"02577e59-e60e-4716-a404-478873dcb6e5","resolution":{"observed_at":"2026-08-10T19:58:30.507813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.488232Z","title":"Endonet: a deep architecture for recognition tasks on laparoscopic videos","venue":null,"work_id":"d39ca369-01bc-4a96-92a8-d583be130597","year":2016},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.983824Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:f102609bacbbf0e9f193599e4cc30f4166be8975efa52913fb697470cdf530ef","observation_id":"354a920a-9b7b-4a31-8ada-460a1a272f25","resolution":{"observed_at":"2026-08-10T19:58:30.493209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.472494Z","title":"Cider: Consensus-based image description evaluation, in: Proceedings of the IEEE conference on computer vision and pattern recognition, pp","venue":null,"work_id":"3abadff0-002a-409f-b133-1d7006ac9a06","year":2015},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.002057Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:693ac5e5ad5703e8d0f2d484e5369f55a87e99f056add7368bf8d409c456bc18","observation_id":"ccb0c833-738d-4f41-be2f-6b9ce11161c8","resolution":{"observed_at":"2026-08-10T19:58:30.477714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08472","last_updated":"2021-09-17T11:21:34Z","snapshot_observed_at":"2026-07-06T11:48:42.000083Z","submitted_at":"2021-09-17T11:21:34Z","title":"ActionCLIP: A New Paradigm for Video Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08472","snapshot_observed_at":"2026-08-10T19:58:30.021304Z","title":"Actionclip: A new paradigm for video action recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.021304Z"},"links":{"cited_paper":"/paper/2109.08472","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:9c2a4bf60b612015a96f2d3d091ffd76b336835968f3f3a5470984317ec47997","observation_id":"63691d2c-6679-47e0-9330-9d243bc9096f","resolution":{"observed_at":"2026-08-10T19:58:30.021304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.418886Z","title":"Visual-language prompt tuning with knowledge-guided context optimization, in: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition, pp","venue":null,"work_id":"c0a5c2c6-7b25-4883-a942-39fb1ca69320","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.029323Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:c0782f852b3f26f0b102d22893faa0a441ac3d0ac4f840e83ef91c9578c4c5b6","observation_id":"17fb5981-f75b-4346-a199-e060373369e2","resolution":{"observed_at":"2026-08-10T19:58:30.444666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.351089Z","title":"Anticipation for sur- gical workflow through instrument interaction and recognized signals","venue":null,"work_id":"9f072381-e0fb-4f39-bcb2-1bd9d1a08d3f","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.033568Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:fa0d87f7bdfd96abeb7c35e8d37f690ae3561de2174edc547fd7e631d0518404","observation_id":"988509e9-faa8-45f5-82e9-50d5c03521be","resolution":{"observed_at":"2026-08-10T19:58:30.377144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.263458Z","title":"Advancing surgical vqa with scene graph knowledge","venue":null,"work_id":"f85f5fbd-b40e-4d7d-bd5f-d6ae492717da","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.037780Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:410d7a81f9c70b0d52c16c4712f7af7c3f38235be111073a8c7a6faf2c20748b","observation_id":"7f9cb348-5232-45bd-b0a1-1272a58a5e48","resolution":{"observed_at":"2026-08-10T19:58:30.302547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.195718Z","title":null,"venue":null,"work_id":"8c0b6e55-3256-4130-b7c1-a2b7cf2579b1","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.042669Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:d95e885c69ff168ddec92e37fdd5cc2a0ae77d12c64434de617d77a19d369355","observation_id":"70e91694-db7f-421d-960c-bd6c8c9f1a1b","resolution":{"observed_at":"2026-08-10T19:58:30.229130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00263","last_updated":"2025-03-13T15:21:36Z","snapshot_observed_at":"2026-08-07T21:24:04.922825Z","submitted_at":"2024-09-30T22:21:05Z","title":"Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00263","snapshot_observed_at":"2026-08-10T19:58:30.046785Z","title":"Procedure-aware surgical video-language pretraining with hierarchical knowledge aug- mentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.046785Z"},"links":{"cited_paper":"/paper/2410.00263","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:7003913ed7897b7c398d12d0756df35991472a12587bb64c620f7a30fee7e854","observation_id":"e5781e70-2e2d-45da-8ec0-44300e107a4b","resolution":{"observed_at":"2026-08-10T19:58:30.046785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15220","last_updated":"2025-06-16T19:07:50Z","snapshot_observed_at":"2026-07-06T15:59:30.956483Z","submitted_at":"2023-07-27T22:38:12Z","title":"Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15220","snapshot_observed_at":"2026-08-10T19:58:30.051097Z","title":"Learning multi-modal representations by watching hundreds of surgical video lectures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.051097Z"},"links":{"cited_paper":"/paper/2307.15220","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:ea103126dcd706c91c2d809d0052c16610257588e96a9c3cd5a6fbac8cbd1db4","observation_id":"4e77adc0-8dd8-4725-a0f8-b9346ea271ca","resolution":{"observed_at":"2026-08-10T19:58:30.051097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.157304Z","title":"Conditional prompt learn- ing for vision-language models, in: Proceedings of the IEEE /CVF con- ference on computer vision and pattern recognition, pp","venue":null,"work_id":"d566e963-e5ff-430d-9484-8eebf6bc43c7","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.055411Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:06d159ebc7516fad88b1a86756cd12e42f491a40167dc7b3f4b2552973768a2a","observation_id":"94e025d8-1456-4453-8894-67f4ca9e9abc","resolution":{"observed_at":"2026-08-10T19:58:30.164155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.894554Z","title":"MedIA 76, 102306","venue":null,"work_id":"e3f69baa-bb5b-4015-910b-f21521a9eb5f","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.625621Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:3016432484384218ea2781ca85468e5397f5d76e1f614e0739627fd9e3737174","observation_id":"53533d37-a7f8-4f09-b947-26b9992524d3","resolution":{"observed_at":"2026-08-10T19:58:30.945144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2501.09555."}