{"as_of":"2026-08-10T23:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ca108fbfd563156b474b933bda978ccd8063a3922b42cbf0596ced80a585550","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:01:51.105545Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08075/citation-record","integrity":"/paper/2607.08075/integrity","json":"/paper/2607.08075/citation-record.json","paper":"/paper/2607.08075"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:47.802229Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:47.802229Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:02ef19d5d97e4bc93c72e2e943cf37f3607e54308b0a0e8e19ce09eddc723276","observation_id":"6cfdc034-3048-4b2d-8825-3cb79a5b76ab","resolution":{"observed_at":"2026-08-02T08:01:47.802229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:47.849146Z","title":"Proceedings of the European Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:47.849146Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:ae4758d950706c85d31c15b4582b859c07d83a463780bb674520e1cf26468e30","observation_id":"8b0ed122-fe5b-44e9-ac92-15314923b628","resolution":{"observed_at":"2026-08-02T08:01:47.849146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:47.897156Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:47.897156Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:f05cde98a37e058499f4b39c5ee8350f01db57d11ae05aaed63feaeedd2ce526","observation_id":"3d17eccd-b784-44d7-acfc-65da2b8f088c","resolution":{"observed_at":"2026-08-02T08:01:47.897156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:47.913494Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:47.913494Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:008fa8248f9f7eef53c030bdf9b8375b6635c5e018d961f83e824268b870e9ab","observation_id":"7a86c805-e25b-44d6-9fb0-ac30b2e8062b","resolution":{"observed_at":"2026-08-02T08:01:47.913494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:47.970261Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:47.970261Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:23e923c9638eaa4a5700e638e4a1f266ae8192f877925fc0eb4a9d67242dd13d","observation_id":"f7c397a0-5b37-4d2f-b54a-f83f1ab2dd60","resolution":{"observed_at":"2026-08-02T08:01:47.970261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.023203Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.023203Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:f1ce4efcc3d0463d59c79be8a4c3b07931cf2fd6839eb4cfccfe3382a21613f5","observation_id":"fb42d276-f161-400c-9a23-cfbdf7739956","resolution":{"observed_at":"2026-08-02T08:01:48.023203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.075453Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.075453Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:5bc745ed9ed35aee7d983d3ada8b274f20c15bfa927221736bc659fd7f4cbee0","observation_id":"9334a9dd-53fc-408f-a22f-5f495e1c854f","resolution":{"observed_at":"2026-08-02T08:01:48.075453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.104205Z","title":"Proceedings of the European Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.104205Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:75b45e0ac7ce32ae74cf50f7236f3ce993b67c43abcf39ba4b13b9581be65f37","observation_id":"a1912b2b-39e7-4e8e-a477-3147e945d9f7","resolution":{"observed_at":"2026-08-02T08:01:48.104205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.136364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.136364Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:ed1383b4b6ace9d4c87bc7918e8fb29a3c5b11195825b49882be36c607f79eb7","observation_id":"c9433c34-ea71-404c-83ef-b7ae683244eb","resolution":{"observed_at":"2026-08-02T08:01:48.136364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.251088Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.251088Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:bfde3770a72ca34ac4df435fedbc86400018a81c5d4a77532323d6070028b904","observation_id":"7fade6fc-4cad-4d59-b52f-948dd7c3f7a5","resolution":{"observed_at":"2026-08-02T08:01:48.251088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.354430Z","title":"Proceedings of the European Conference on Computer Vision , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.354430Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:1da927b3b74eeafa58822444c08cf9bdaaa3802bff0ab4e5d138f4ac2d421fcf","observation_id":"2fafb7cc-649c-4d2d-86c8-0fb1e79466aa","resolution":{"observed_at":"2026-08-02T08:01:48.354430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.395228Z","title":"IEEE Transactions on Circuits and Systems for Video Technology , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.395228Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:ffb5414c05ecab6f002bc0fcb810b9a86e956e9a77435becdf36d33487395cc0","observation_id":"128fe6e1-e0cf-47f9-9b43-f101d9a2323c","resolution":{"observed_at":"2026-08-02T08:01:48.395228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.430638Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.430638Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:c45e00f6d3a1a315d935044faf0889d16a5d27d997435e34cb01104cbfd98e41","observation_id":"9541d966-bb58-4173-a34f-010f2321b17c","resolution":{"observed_at":"2026-08-02T08:01:48.430638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.504202Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.504202Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:d1c9566642dd8f6ca8fd53e76ab73c2d77aa4412b39a5d5a218d52c045db54f3","observation_id":"1ad3dfa3-9518-4cb1-8db7-e7ecfbbac093","resolution":{"observed_at":"2026-08-02T08:01:48.504202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.545699Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.545699Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:4d1acff3ca40f6e2dd3da63dbf09daee67640e48ce18f14bdfa2dba0c9dd1e06","observation_id":"ad268d61-bd11-48b2-92af-ab337677f3fe","resolution":{"observed_at":"2026-08-02T08:01:48.545699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.646701Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.646701Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:3ec8be638c68152b96682a509827fd0972bb8b0cba4551d5b2dae9303a13a510","observation_id":"bc4b37ba-6783-4a1d-ac12-ed74121b289a","resolution":{"observed_at":"2026-08-02T08:01:48.646701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.687959Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.687959Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:ec7b0a699e015308cc984f2fb42ccc380deeb2374c54e3225524e5a119c47279","observation_id":"d332def0-f911-4c6c-afc7-f598ae54cf44","resolution":{"observed_at":"2026-08-02T08:01:48.687959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.761670Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.761670Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:45a65b59d5d2e613a0228e222ac287e75241a207bdde4c3857d956e11684fcb5","observation_id":"d9223024-0e1b-402b-9a7a-39a195eb26e0","resolution":{"observed_at":"2026-08-02T08:01:48.761670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.877672Z","title":"Proceedings of the 38th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.877672Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:78f45303b9c1846efe268a42be2ac56c89b412101aa49ed815c38b46087a6583","observation_id":"4f388d12-0844-4efe-a6dc-081e8da98686","resolution":{"observed_at":"2026-08-02T08:01:48.877672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:48.950149Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:48.950149Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:8d49dd444d213cb44e7c5ef11b4d1e6992bd5ea72fbeda013d9a33c93b4e6be6","observation_id":"2fcabc75-f338-4c87-b7c8-844511e09bd3","resolution":{"observed_at":"2026-08-02T08:01:48.950149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.010615Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.010615Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:0152f98a91e1bd54cd9cb99997957863dec49468e4e7d982a2ee3ef7411dacc9","observation_id":"d0e4b761-19cb-4f08-830b-ca66796e1a3b","resolution":{"observed_at":"2026-08-02T08:01:49.010615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.083617Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.083617Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:dc7aee65aaffc55dfbffcc5e426afb6399ff78a49acc7eb34e81905c3afc7bbe","observation_id":"4c6b4835-80d8-4861-995a-1cf7d58799bb","resolution":{"observed_at":"2026-08-02T08:01:49.083617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.149819Z","title":"Detecting Twenty-thousand Classes Using Image-level Supervision , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.149819Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:cc3ce0005af9bc1776c63b8a12eae601bce3a6954fed43d6f9a29ddb50c00203","observation_id":"06d41ebb-f625-4cc7-af07-396ee361bf5a","resolution":{"observed_at":"2026-08-02T08:01:49.149819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.197519Z","title":"Proceedings of the European Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.197519Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:3fc1dfb3d83b51c327b9acba20ad15e91637df4ef57543f367331fe39b9e0c49","observation_id":"0551190e-2b59-4569-9b2c-a58e4d19630a","resolution":{"observed_at":"2026-08-02T08:01:49.197519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.257662Z","title":"Proceedings of the European Conference on Computer Vision , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.257662Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:4635300e8a4addb8dd1d52f5c93dc85c5f62a21c866502015c146da4a9e70306","observation_id":"34f698cd-f6ba-46ba-824c-72e31e40f263","resolution":{"observed_at":"2026-08-02T08:01:49.257662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.382712Z","title":"Emerging Properties in Self-Supervised Vision Transformers , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.382712Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:921a5a67f2c7fa6bd8d25de79a3ed1b7a29148f56a494be21823405dcd7e5f6f","observation_id":"63cfd662-ff2b-4bef-a0fd-12fd7e96ebc5","resolution":{"observed_at":"2026-08-02T08:01:49.382712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.499612Z","title":"and Lo, Wan-Yen and Dollar, Piotr and Girshick, Ross , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.499612Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:536687d3b7ea45814aee4761fd19b6d16f81c611e0f5f73863f8d909bda6945e","observation_id":"e8c4ed56-3b3e-4b15-9978-0f20d4e42e9d","resolution":{"observed_at":"2026-08-02T08:01:49.499612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.611360Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.611360Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:61f0e1af3fb141747bd6e3f64fefb119b3fdec6afe098300bc1fe23134e6eb5d","observation_id":"f9ff5e35-cdcb-4e9d-8423-6893bdbdefaa","resolution":{"observed_at":"2026-08-02T08:01:49.611360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-02T08:01:49.699015Z","title":"arXiv preprint arXiv:2401.14159 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.699015Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:65ad316fd4842316629b6c0235da379deacb60e83af784c56349da4dea9ff709","observation_id":"852df396-0ba2-4b9b-a85e-55b95b184508","resolution":{"observed_at":"2026-08-02T08:01:49.699015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.772103Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.772103Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:99ba98b2be722eb8a6e24a90b8706ccb6ac1b4707a5b2ab377ba4788d734c7fa","observation_id":"891ba1d4-0347-4043-8476-8de01cdf6545","resolution":{"observed_at":"2026-08-02T08:01:49.772103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.843009Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.843009Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:fcf413cb5b0f72a994bc631942b84063f1e5087d6450fdca0a06d7d3e7fd595c","observation_id":"656f3181-cbd6-4202-bd0e-ceda2c93fb62","resolution":{"observed_at":"2026-08-02T08:01:49.843009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.885740Z","title":"Proceedings of the International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.885740Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:80c55705f64d96679ee1e6c01a65e1c586530f81d6498e53c7421388efff7495","observation_id":"acf329e5-6f01-4aa1-af71-0b7680b444c8","resolution":{"observed_at":"2026-08-02T08:01:49.885740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:49.965721Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:49.965721Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:0b57f4825f259232d695fafcda94604e33fd31aa71fff9b4342b3878c5b3c0c4","observation_id":"3a9a2421-7f67-46d8-bc8b-74cb06114c73","resolution":{"observed_at":"2026-08-02T08:01:49.965721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.093411Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.093411Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:3f7b10c0804cc2da3eb2411ab9e1431edef0269c9a9cabb0155ac0a5b67530e3","observation_id":"990aa7a3-2c32-4422-923c-6933645d8567","resolution":{"observed_at":"2026-08-02T08:01:50.093411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.138671Z","title":"2018 , eprint =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.138671Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:12bedb500b254a48542ab0e95d0f6a9103909a542ce5dc71ce852216f8497617","observation_id":"4075249a-e4f4-48aa-afd0-a5f8175f21a1","resolution":{"observed_at":"2026-08-02T08:01:50.138671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.211381Z","title":"2018 , eprint =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.211381Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:b733bde75a015109c71d4b7c90885fa5b20410009ac4026e1ad5e172841650ba","observation_id":"6e668415-308e-4836-b711-c750a3625e4e","resolution":{"observed_at":"2026-08-02T08:01:50.211381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.238558Z","title":"2021 , eprint =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.238558Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:355b0abdcdb4c6105124dc302e57e46fa51ce943f7041e142845e5280b820e29","observation_id":"b1fb8105-cb95-4f1c-a1b7-f7a3ce8894cd","resolution":{"observed_at":"2026-08-02T08:01:50.238558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.292418Z","title":"2022 , eprint =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.292418Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:f32d60aa4b631479c8fecb1cd93d77b462adbdd443ef21af8f282fd1e92db407","observation_id":"67a3f19d-19fd-4559-bbc4-15e4b222943c","resolution":{"observed_at":"2026-08-02T08:01:50.292418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.375210Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.375210Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:590b257daad92ed9518f2417122416ce342760475a24c08ea6b90552ea3d3c8b","observation_id":"228f8cde-5980-4d53-81b1-0c2ff8b96aad","resolution":{"observed_at":"2026-08-02T08:01:50.375210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.430849Z","title":"IEEE Transactions on Geoscience and Remote Sensing , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.430849Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:80108c00c0f8511d23ddd6c67a1f61f163751be3b7a92c59253b13516bd6d350","observation_id":"c18db49b-e7a0-46b9-a42b-4c87fe887653","resolution":{"observed_at":"2026-08-02T08:01:50.430849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.487374Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.487374Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:2db5d7b8cd68a81eee024ad2dc8d1cda600fb16a413d2f77afc36c74e75a8242","observation_id":"ac5fb7e1-a84a-4f6f-854e-fd40cc96b862","resolution":{"observed_at":"2026-08-02T08:01:50.487374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.516532Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.516532Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:ce88c87a3d23cd3cd1baf47495aea2b6010e6857ecdfd61a724451a5d055961c","observation_id":"7d173a7e-b5a7-4244-8343-ffc1c2efd80b","resolution":{"observed_at":"2026-08-02T08:01:50.516532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.573814Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.573814Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:71d76b0ab1371c3cfda16c745526ad5b680863f5308b732b80cda59ab6121238","observation_id":"1baf5d67-1de9-480d-bb36-6635be124c09","resolution":{"observed_at":"2026-08-02T08:01:50.573814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.603754Z","title":"2018 , eprint =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.603754Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:2dbd58709a6a0db2aa3c1e1de5b3da5f4bf972f0d256f2a5ca26a2753ea24cde","observation_id":"81b16d6b-235a-425e-a527-a8ead4da9a1a","resolution":{"observed_at":"2026-08-02T08:01:50.603754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.689919Z","title":"2023 , eprint =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.689919Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:c2b184d464b946a79f07c8d196b852ecfff4ad474a21b50f062f94956676a0c5","observation_id":"2aefc3ac-0d95-489d-9a88-7ced3065a42c","resolution":{"observed_at":"2026-08-02T08:01:50.689919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.716790Z","title":"Sensors , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.716790Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:6b1caf4dc800956810d76439a8a4673201de994e4f8b1d6cecad5291649777b4","observation_id":"3e5a0024-0b3f-4d09-88ad-f9febb822412","resolution":{"observed_at":"2026-08-02T08:01:50.716790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.770771Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.770771Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:c904a097a62577a2e3b2d16f2eb5b5d889cd1da32628272d9356567734e99e06","observation_id":"6268f394-e417-42f2-8f5f-bf2123a06f2d","resolution":{"observed_at":"2026-08-02T08:01:50.770771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.826857Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.826857Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:d3cf0c44b47608d8bcbe5c130070e36d2f65ffc1c6a3293fa9a9358cc8c0926d","observation_id":"289dd3aa-f81e-46ef-ad97-5b6ea9b564fd","resolution":{"observed_at":"2026-08-02T08:01:50.826857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.856879Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.856879Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:f28ea0025cca1108761ce154b3acbb6fcc8a9389f2ad2c7ae93469f96065cfb8","observation_id":"82d5b8d3-5bf8-4dda-8707-1ef0cafbadbd","resolution":{"observed_at":"2026-08-02T08:01:50.856879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.909983Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.909983Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:62934f878e8ee3f4fb5608fbeded3e2bffe85925b30c89b67024336fed27919e","observation_id":"56c5fb09-bccd-457d-afc7-12dea8495263","resolution":{"observed_at":"2026-08-02T08:01:50.909983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:50.964141Z","title":"IEEE International Conference on Robotics and Automation (ICRA) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:50.964141Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:81727b38d3b72d38468e9016efb6e0d73cc9208107d901b4abc1c9b94e818e28","observation_id":"1160cad1-af1b-4d66-868d-12a2bf3991d4","resolution":{"observed_at":"2026-08-02T08:01:50.964141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:51.003333Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:51.003333Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:e32249da7caa69d27a4dc0f23c96316d6fc084474591165ccf058ea9772086d8","observation_id":"d8e93c62-dad4-47ab-a96f-0ff5145123ff","resolution":{"observed_at":"2026-08-02T08:01:51.003333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:51.071423Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:51.071423Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:0ce215e9c5dac8f453ef1aa50e7f95f674f418c2edff7c21b24c365ba44286c2","observation_id":"a2db0f40-155a-4ca9-b20f-ad7a73945b7b","resolution":{"observed_at":"2026-08-02T08:01:51.071423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:01:51.105545Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T08:01:51.105545Z"},"links":{"citing_paper":"/paper/2607.08075"},"observation_digest":"sha256:db06c7fcec2da04345e503a87adb6aa00b5bfb1c808d25097764f715d88e619a","observation_id":"f02f5d6d-9702-4e35-b3a4-f34be5b27995","resolution":{"observed_at":"2026-08-02T08:01:51.105545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08075","last_updated":"2026-07-22T07:08:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T19:05:36.645272Z","submitted_at":"2026-07-09T03:08:33Z","title":"UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2607.08075."}