{"as_of":"2026-08-21T04:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b35eaa929ac8938cc0eefbc4829965f2b77789770256bf12c823d41b01f16eff","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:37:12.267555Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11681/citation-record","integrity":"/paper/2608.11681/integrity","json":"/paper/2608.11681/citation-record.json","paper":"/paper/2608.11681"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13222","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.105151Z","title":"Neurocomputing 665, 132229","venue":null,"work_id":"c8d66c42-026d-41a3-9138-8e4c12889bc9","year":2025},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.681803Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:0db1f86cdb3ebb008299645529926a53f9cbded4ff910c3d06e7573332b72c00","observation_id":"e425046c-2cce-46fc-b70d-8ebdbc62b595","resolution":{"observed_at":"2026-08-16T00:37:15.132049Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.824303Z","title":"(Eds.), Computer Vision – ECCV 2022, Springer Nature Switzerland, Cham","venue":null,"work_id":"5e773c56-5eed-45c9-8784-2feaccdf6701","year":2022},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.808856Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:c58f091a1a168887b66b8477b00142047df2410854cdf29f106594db26332caf","observation_id":"17f19e31-ea58-4c82-81bd-edcb2eef2830","resolution":{"observed_at":"2026-08-16T00:37:15.829888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.774951Z","title":"7010–7021","venue":null,"work_id":"1114689a-4512-46d5-91ec-946a22fb35b7","year":2022},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.839488Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:01756fc45babe8b86d21933d62913dcecbb12a471092b19c089b285e55435d1f","observation_id":"e88829f7-fb35-4b96-8827-5d1cdacd651f","resolution":{"observed_at":"2026-08-16T00:37:15.787697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13179","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:14.467542Z","title":"Neurocomput- ing 659, 131790","venue":null,"work_id":"50f79054-dfa5-4672-8ae2-ae476d87f797","year":2025},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.858744Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:dc9d92114f40e6adb26a33c4225f21fd1c1ce1c1ace86d2852a7ac2886c1451d","observation_id":"bd100496-35e9-4c17-a0c7-bae2b51affd3","resolution":{"observed_at":"2026-08-16T00:37:14.499148Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13101","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:14.114540Z","title":"Neurocomput- ing 651, 131018","venue":null,"work_id":"f7c0451f-a7e0-4d26-bd7d-598c28cef78c","year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.908451Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:d605fef80512832747211d24dcbd69a01f0a423bfac5b953a3f24ef2d615d593","observation_id":"5c85c68e-54b5-42f4-a1b4-2992669ba9bc","resolution":{"observed_at":"2026-08-16T00:37:14.151000Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.12878","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:13.763574Z","title":"(Eds.), Advances in Neural Information Processing Sys- tems, Curran Associates, Inc","venue":null,"work_id":"22dee7ab-e91e-42e3-a728-44eddaecc34a","year":2023},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.968903Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:b04e0c760852f74176d47bc068f20069c522d6ee64de8f80021863b5dc6708dd","observation_id":"82180302-233b-4050-9dcb-ef05035a76fa","resolution":{"observed_at":"2026-08-16T00:37:13.775230Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.13308","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:13.584273Z","title":"Neurocomputing 677, 133088","venue":null,"work_id":"c2f17cdc-e1dd-4a00-a936-f95d09b72bc2","year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.994847Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:ecac7ce54c986556fd8109947979373e3b4c6c2b8871db2fea1ddb4d51ca97ec","observation_id":"d5d7e449-de77-479f-80f6-dd6d31ff08b0","resolution":{"observed_at":"2026-08-16T00:37:13.602515Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-16T00:37:12.019365Z","title":"URL:https://arxiv.org/abs/2401.14159, arXiv:2401.14159","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.019365Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:a8c82a63b4bd51ec2c12596f8e4588e7beb1554acadd2b594cbf90e9971f8f44","observation_id":"634dc674-1017-4637-8477-6a11fab439b6","resolution":{"observed_at":"2026-08-16T00:37:12.019365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/068431-0932","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:12.467645Z","title":"(Eds.), Advances in Neural Information Pro- cessing Systems, Curran Associates, Inc","venue":null,"work_id":"ba8e4974-a642-4823-beb3-d930c14f2c2e","year":2022},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.050004Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:7c087175bec9aace1cfef7a73e7806951bddd71f6b72fae9eedd8e249d1996b6","observation_id":"520b62ad-42e3-46fe-9247-ed44e3626763","resolution":{"observed_at":"2026-08-16T00:37:12.494559Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:12.095315Z","title":"21881–21891","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.095315Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:00e04a6575231db829b2a810e1de54add3576d2a8c66db984612c5a2a20c9257","observation_id":"0f976859-3bf1-49a0-ab06-2ab413bfef11","resolution":{"observed_at":"2026-08-16T00:37:12.095315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.12998","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:12.978859Z","title":"Neurocomput- ing 636, 129982","venue":null,"work_id":"aa42cc29-1760-4cad-b7ea-4c0ac33c53e2","year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.102719Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:166de3e71d2ad66f32265f90fe2df06aeb5ab7a5180741b259639a1b7e8be2e5","observation_id":"f3796f8e-e81b-411d-ad50-7ff4968e1295","resolution":{"observed_at":"2026-08-16T00:37:12.990578Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.595399Z","title":"(Eds.), Computer Vision – ECCV 2024, Springer Nature Switzer- land, Cham","venue":null,"work_id":"881db1fb-92e2-4cc1-bcb5-f77eab5927a6","year":2024},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.135525Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:6802f245722365b5ed3e55acc1ccfd0372d6ed259d653bea5dc7c97d22c2b3e4","observation_id":"c7e0a6ee-1975-4593-bd7b-1ef77eb0f354","resolution":{"observed_at":"2026-08-16T00:37:15.612479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.542626Z","title":"14388–14397","venue":null,"work_id":"290e0fc5-9151-43dd-87ad-becf95b2fb1f","year":2021},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.151827Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:e802097f6e2bed21d3cd34b98748348d08e966fc3ae69138d99497e4e627a9c4","observation_id":"04d52dec-59f3-4882-b28c-db328ec6746a","resolution":{"observed_at":"2026-08-16T00:37:15.564992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.504580Z","title":"(Eds.), Advances in Neural Information Process- ing Systems, Curran Associates, Inc","venue":null,"work_id":"1edc1645-664f-408c-a58b-dc7d91e30167","year":2023},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.167582Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:7e8c55acee79831cd228b6a0818280895124332542a0532a22a5172082a36a60","observation_id":"3abe94f3-4b63-46aa-a9d2-84050e39fca4","resolution":{"observed_at":"2026-08-16T00:37:15.516826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.455853Z","title":"2593–2602","venue":null,"work_id":"f87b61f8-3e4d-43ba-a38b-63a3ea0bfe8f","year":2021},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.197134Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:2af1c0e20841384f7df9af9cb8448425781f7228d696d224f7c4ec602e65ba12","observation_id":"e66c43ea-2bc8-44bf-896d-ca4702f29d20","resolution":{"observed_at":"2026-08-16T00:37:15.473689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12957","last_updated":"2024-11-27T09:54:05Z","snapshot_observed_at":"2026-08-16T13:24:22.934921Z","submitted_at":"2024-08-23T10:07:59Z","title":"Image Segmentation in Foundation Model Era: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12957","snapshot_observed_at":"2026-08-16T00:37:12.224336Z","title":"URL:https://arxiv.org/abs/2408.12957,arXiv:2408.12957","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.224336Z"},"links":{"cited_paper":"/paper/2408.12957","citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:b0329f5dae72900447c455cea26e84b3c24739b3addb50b8fadb43ecbef9dc27","observation_id":"e1208927-4742-48aa-8a52-5066a482e839","resolution":{"observed_at":"2026-08-16T00:37:12.224336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11694","last_updated":"2022-12-09T17:38:58Z","snapshot_observed_at":"2026-08-16T16:14:27.145212Z","submitted_at":"2022-11-21T18:12:53Z","title":"Exploring Discrete Diffusion Models for Image Captioning","version":2},"cited_work":{"arxiv_id":"2211.11694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.11694","snapshot_observed_at":"2026-08-16T00:37:12.578554Z","title":"Exploring Discrete Diffusion Models for Image Captioning","venue":"cs.CV","work_id":"2f0f7e1c-d5b5-4afc-9057-04009a6fc8e9","year":2022},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.245324Z"},"links":{"cited_paper":"/paper/2211.11694","citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:1558552fe8489f1e888bab9de7b72c00d34514258462f5f0b34912fedf7a3778","observation_id":"ed6893e1-4814-413d-bdf0-74d6f92a559c","resolution":{"observed_at":"2026-08-16T00:37:12.611095Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:12.267555Z","title":"15116–15127","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:12.267555Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:c02e2865fb361b2cbe9c796e6f35d6a9762c3b6a1d37211ae536683efc8eb871","observation_id":"7ae0524b-0ef7-4d16-8432-72b08e59f5a5","resolution":{"observed_at":"2026-08-16T00:37:12.267555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.672101Z","title":null,"venue":null,"work_id":"7087c1ef-947a-4014-bfa9-1e5a4678ff90","year":2014},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.952610Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:c58e29310a46a0f830b695195121ee177781260496c3d58d0c69606ca5a7d234","observation_id":"8b555687-60ac-4e6c-bc23-1134d629ac53","resolution":{"observed_at":"2026-08-16T00:37:15.692513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.871587Z","title":null,"venue":null,"work_id":"f015323e-9a07-4b4c-94d9-f40e1ffe3da7","year":2019},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.792725Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:4b5ead7ef40c3e69c54fa6810cb6c08b7b2b048dc0c5ad841320bb76f94b05de","observation_id":"82e0508e-adaf-4bfd-8a39-fbbd021785b8","resolution":{"observed_at":"2026-08-16T00:37:15.877322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.725099Z","title":"International journal of computer vision 128, 1956–1981","venue":null,"work_id":"be401dc4-8850-42f6-b75b-daa45f7e01fb","year":1956},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.880219Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:70245f131726975c392a277afb26ac873f0f4f1786b1331096e4acb551942936","observation_id":"40682133-2656-4871-ac1e-3d8938e59ab1","resolution":{"observed_at":"2026-08-16T00:37:15.734607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.920048Z","title":"(Eds.), Advances in Neural Informa- tion Processing Systems, Curran Associates, Inc","venue":null,"work_id":"456b6c77-d858-4c99-adc7-3400fd11d508","year":2021},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.745335Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:e5b95035b014febad3a033f8bcd44b3906de461f11be5a9e7d4e974ce8ee3725","observation_id":"ceb692d9-b472-4424-8b7b-96e5b787569c","resolution":{"observed_at":"2026-08-16T00:37:15.935580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:11.707511Z","title":"1280–1289","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.707511Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:f895ef1ccd3c58db3b641416bed552d56d11b901a24cf7fa7be7779d0483b5b4","observation_id":"8d5e5e23-c4f4-4758-b6aa-49560af29c41","resolution":{"observed_at":"2026-08-16T00:37:11.707511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:11.866571Z","title":"3992–4003","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.866571Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:e4bc3f443675adc509ed9664d1394c4721b7322745c50bb1fccb4eacd78d7db9","observation_id":"8fb4b292-c239-46b5-925b-39c813a8ab56","resolution":{"observed_at":"2026-08-16T00:37:11.866571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:11.925725Z","title":"27948–27959","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.925725Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:ff6511aabbc4929766febc530548a058989f18d3050ae0d7e4b9521fcbcd42c2","observation_id":"31868b80-b1b7-42f9-b5a4-235c3aa8f2c3","resolution":{"observed_at":"2026-08-16T00:37:11.925725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.12970","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:14.653756Z","title":"Neurocomput- ing 630, 129702","venue":null,"work_id":"0f7930af-4324-4f43-bc7b-1811d68fd418","year":2025},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.771279Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:b8bab176bd4ef90937ee64830cd352e45332df814813102da8321e85ea0ad8cf","observation_id":"243bba2a-e03b-48b3-894a-25a6a4327e9f","resolution":{"observed_at":"2026-08-16T00:37:14.687852Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13184","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:37:15.391103Z","title":"Neurocomputing 660, 131844","venue":null,"work_id":"d3cd69e5-6f4c-4662-82b4-a5bc0f635ec5","year":null},"citing_paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-16T00:37:11.663914Z"},"links":{"citing_paper":"/paper/2608.11681"},"observation_digest":"sha256:c1c6c225f50a63b802239c333ef06c91518e152a836e93dae6a860a453876104","observation_id":"e410b405-f0e3-4c74-81c5-3ab071362add","resolution":{"observed_at":"2026-08-16T00:37:15.419016Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.11681","last_updated":"2026-08-12T05:39:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T10:01:55.784480Z","submitted_at":"2026-08-12T05:39:57Z","title":"Learning from Multimodal Pseudo-Labels for Robust Open-Vocabulary Instance and Panoptic Segmentation"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":6,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.11681."}