{"as_of":"2026-08-18T16:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a303732d08bb893434e10eaa701aca41a08f22d1aba3be1e5dd614af00566c75","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T11:39:01.979348Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27122/citation-record","integrity":"/paper/2607.27122/integrity","json":"/paper/2607.27122/citation-record.json","paper":"/paper/2607.27122"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d16-1092","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:41:21.422328Z","title":null,"venue":null,"work_id":"d0e389f8-8dbd-494e-a366-e5506a21fe95","year":2016},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.885452Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:6e84d4af80b4f2db484c2ad91960a972ffde295e00e4ece0f313b809e98ee235","observation_id":"013bc144-bd0a-4b2c-a645-2e6e5bd3f912","resolution":{"observed_at":"2026-07-30T11:41:21.475467Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.889906Z","title":"In: The Fourteenth International Conference on Learning Representations (ICLR) (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.889906Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:89efa67a420f2e420e485021a97fe8609c69d44f347767b9320797becf48d70a","observation_id":"b2bc4ab2-af05-4ff2-a9cc-ad79a2684efb","resolution":{"observed_at":"2026-07-30T11:39:01.889906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.893597Z","title":"In: MICCAI Workshop on Data Engineering in Medical Imaging, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.893597Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:475647288ddbed320957f744ca85cea340bc97de0b13abe772ef9cde6ce1c262","observation_id":"29cf6187-c670-4f9e-b93c-aa0290dcc1e0","resolution":{"observed_at":"2026-07-30T11:39:01.893597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.897342Z","title":"In: Proceedings of the IEEE/CVF Con- ference on Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.897342Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:323f050603bc74ebe751a177edf5e64d8442ba8e19bb3ab9500db34de4775cba","observation_id":"f00068b0-3c79-45a7-8a1f-13214cad7a62","resolution":{"observed_at":"2026-07-30T11:39:01.897342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.901858Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.901858Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:145522b0266f426dbffefadadda2053b56be0cb40a75f2f160015b80254e62d5","observation_id":"ffd8ed0f-949f-430d-8547-ad901a9b3f3d","resolution":{"observed_at":"2026-07-30T11:39:01.901858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.905290Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.905290Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:d14cefca5a37f14419cb13b9066b70702091c70406d7413c0e42b1eecf179142","observation_id":"6c65abf5-c697-4713-831b-52fda506e540","resolution":{"observed_at":"2026-07-30T11:39:01.905290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.909532Z","title":"arXiv:2511.04384 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.909532Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:41df2d43b70ec9420cbc03b15ec0ddd79381b696d5adf05fa3f0ecd57219e4b5","observation_id":"f2e18f2b-9801-45c1-9e28-191e1689b652","resolution":{"observed_at":"2026-07-30T11:39:01.909532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10869","last_updated":"2025-08-14T17:43:46Z","snapshot_observed_at":"2026-08-05T20:15:09.324999Z","submitted_at":"2025-08-14T17:43:46Z","title":"Medico 2025: Visual Question Answering for Gastrointestinal Imaging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10869","snapshot_observed_at":"2026-07-30T11:39:01.913748Z","title":"arXiv:2508.10869 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.913748Z"},"links":{"cited_paper":"/paper/2508.10869","citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:25e1d0cbf7611d2044659b874afe3386ab685f1de283c81904fdf5851fc0f47d","observation_id":"5dadf50e-613c-42dd-b288-fab277d11804","resolution":{"observed_at":"2026-07-30T11:39:01.913748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.918507Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recog- nition (CVPR), pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.918507Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:98d12dc4ec119296e4b02fcf0a891cfe1e3fb959d579ea77bdfe07d43f3c61df","observation_id":"24a72180-47cb-493f-8b87-d66eb0cd5fd6","resolution":{"observed_at":"2026-07-30T11:39:01.918507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1053/j.gastro.2025.07","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:41:21.257556Z","title":"Gastroen- terology170(1), 174–187 (2026).https://doi.org/10.1053/j.gastro.2025.07","venue":null,"work_id":"162f9cf7-d803-47af-8531-c844726ea2eb","year":2026},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.922259Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:e27b7e36ed3ce5fd057f4941e4de0c605385c2d8ee9d84e7cd3eba16ae19d8e7","observation_id":"a9b0048d-3cee-4f70-a6f8-ddaa1982ff0f","resolution":{"observed_at":"2026-07-30T11:41:21.377600Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-30T11:39:01.926475Z","title":"arXiv:2503.19786 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.926475Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:ee90ba443d3b32cef9cc01dc6ad7692f131d5d1b60df6e7a28d258c121996354","observation_id":"1a8f64eb-bbce-462a-92b2-e9d3f5cf03fe","resolution":{"observed_at":"2026-07-30T11:39:01.926475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.930329Z","title":"Advances in Neural Information Processing Systems 36, 10088–10115 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.930329Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:9a8b831d6ead2204a9eb0d24ff33f97ca1b5321aed7aa78aff52391266bc0cb3","observation_id":"37611fd2-18f7-4457-8152-c71707bdb915","resolution":{"observed_at":"2026-07-30T11:39:01.930329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.933784Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence, vol","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.933784Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:73987c1a9b517622cd64278b8c44a5e2502b6f53ad217ff0a58834b388d09a0a","observation_id":"b2661ba6-fb2e-4e89-8795-a8ac67162ba8","resolution":{"observed_at":"2026-07-30T11:39:01.933784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.937188Z","title":"International Journal of Computer Vision128(2), 336–359 (2019).https://doi","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.937188Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:41d5560501fe6e8f0be0347a943870625045e0918571bbbc00004d66766f9f83","observation_id":"d3fffe8b-40ac-4541-bf95-05227866ead5","resolution":{"observed_at":"2026-07-30T11:39:01.937188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.940985Z","title":"In: International Conference on Multimedia Modeling, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.940985Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:1c429a3894f5c126875342515b72d77b6f205256771ffcbe053b0fe515c60e30","observation_id":"0aae1d75-68f5-406c-b278-eca81b723777","resolution":{"observed_at":"2026-07-30T11:39:01.940985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.944328Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.944328Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:aa9e0fb9dc9cf873b0646a58a7220414d274cbdc7611f9a51a73b23907bad3b4","observation_id":"86d17b14-e408-47ff-b413-0aca1c57f8e4","resolution":{"observed_at":"2026-07-30T11:39:01.944328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.947995Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.947995Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:d30ec40c5e072f71d2443c4baf0d9b7d6e8d64e714c8d7bdaaa1e539bad81593","observation_id":"509caa3c-e96c-44e5-878f-f8551dd95d34","resolution":{"observed_at":"2026-07-30T11:39:01.947995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-07-30T11:39:01.951863Z","title":"arXiv:2508.18265 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.951863Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:f6009a7e129d25c78a26d2452fa224d907ae007b8fa2e6b0314627522648a18b","observation_id":"e0c28141-0694-4c5d-a495-7e6785acc172","resolution":{"observed_at":"2026-07-30T11:39:01.951863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.956839Z","title":"Pattern Recognition45(9), 3166–3182 (2012).https: //doi.org/10.1016/j.patcog.2012.03.002","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.956839Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:abd6075656144fc3d4717cf102dac70052b263f533a5d25c6cf06c009e3cfe6b","observation_id":"7bef9fbf-507f-4d8c-8e0f-121feb599880","resolution":{"observed_at":"2026-07-30T11:39:01.956839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.961232Z","title":"In: Proceedings of the 8th ACM on Multimedia Systems Conference (MMSys’17), pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.961232Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:1ab5ea33498dabb83c23cad827e5e90e01e287d67b280824b9febf9a60537c19","observation_id":"c10b2203-fada-4b9f-874d-6a6672a1005f","resolution":{"observed_at":"2026-07-30T11:39:01.961232Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.964953Z","title":"In: MICCAI (2025, early accept, spotlight)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.964953Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:e99aabccce0a9fc9790b0f4d644c2de7d9d496508413e5b2e099a6245b67c663","observation_id":"4b1a8d4f-217e-4e03-adef-56ab96e873d8","resolution":{"observed_at":"2026-07-30T11:39:01.964953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.968620Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.968620Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:d665df115b29343f130a2e8f13a114297c88d2938e1fa61e228de8ebfdc6b397","observation_id":"bdcc4662-a20d-4d0c-b2bf-782c00a6b8a3","resolution":{"observed_at":"2026-07-30T11:39:01.968620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.972222Z","title":"International Journal of Computer Vision 126(10), 1084–1102 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.972222Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:730bdf59f0856b385b05a98c5da2d2053b239f96d8bd56281bfd024656efdebf","observation_id":"933763f1-59c1-4332-a8cf-cd9b9d61e372","resolution":{"observed_at":"2026-07-30T11:39:01.972222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:39:01.975877Z","title":"Medical Image Analysis, 103789 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.975877Z"},"links":{"citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:736059db59f638f9a0f90489c768923d3ec78b8e15533cc0533ebaa6522d5018","observation_id":"f87d25f8-6aed-467a-8adb-308df7bf33c8","resolution":{"observed_at":"2026-07-30T11:39:01.975877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11692","last_updated":"2023-05-19T14:13:47Z","snapshot_observed_at":"2026-08-16T15:31:41.294497Z","submitted_at":"2023-05-19T14:13:47Z","title":"Surgical-VQLA: Transformer with Gated Vision-Language Embedding for Visual Question Localized-Answering in Robotic Surgery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11692","snapshot_observed_at":"2026-07-30T11:39:01.979348Z","title":"arXiv:2305.11692 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T11:39:01.979348Z"},"links":{"cited_paper":"/paper/2305.11692","citing_paper":"/paper/2607.27122"},"observation_digest":"sha256:4f9c4aef89d054061b8d345824b09546b711f3160c3570369f4e987c0feb929d","observation_id":"4a238e02-9e01-4793-aaa8-43fe7f2c179d","resolution":{"observed_at":"2026-07-30T11:39:01.979348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27122","last_updated":"2026-07-29T16:49:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T12:34:21.684892Z","submitted_at":"2026-07-29T16:49:19Z","title":"Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.27122."}