{"as_of":"2026-08-07T23:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:338db8aed8036fb875e2edc8aad09c2556be8bf5f839572f62a075df954e6ed2","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T17:14:57.621581Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.27556/citation-record","integrity":"/paper/2603.27556/integrity","json":"/paper/2603.27556/citation-record.json","paper":"/paper/2603.27556"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.331119Z","title":"Advances in Neural Information Processing Systems35, 33781–33794 (2022) 2, 4, 6, 10, 11","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.331119Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a414f1b4e61dcefe8e245a38318433d2596b0e0c377a751e7bd7d7312994f699","observation_id":"e999b05d-6940-44be-87bf-e190e511c54f","resolution":{"observed_at":"2026-08-02T17:14:57.331119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.336943Z","title":"In: Pro- ceedings of the 26th annual international conference on machine learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.336943Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:821f85723cea2473439afc5fb189baca5c2a5d8cfb46d560659f36c3fcd0522d","observation_id":"6a812bf8-40b2-4406-a3c5-03db5bcfd128","resolution":{"observed_at":"2026-08-02T17:14:57.336943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04807","last_updated":"2018-05-13T02:10:56Z","snapshot_observed_at":"2026-08-06T21:56:49.153179Z","submitted_at":"2018-05-13T02:10:56Z","title":"Curriculum Adversarial Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04807","snapshot_observed_at":"2026-08-02T17:14:57.342227Z","title":"arXiv preprint arXiv:1805.04807 (2018) 5","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.342227Z"},"links":{"cited_paper":"/paper/1805.04807","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a1baf196bb161a48412f943a4c27b71dee7cef23402355f4382eb14c1a4fdef4","observation_id":"a83992b5-d814-47f1-ac42-53357c7eb730","resolution":{"observed_at":"2026-08-02T17:14:57.342227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.347493Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.347493Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:59153ee599b7b2842f3b89ed493e701731ff402cffdc250602d480ff9d8cc20a","observation_id":"ff7e1ac2-4339-40db-be9a-b93caa3d1db6","resolution":{"observed_at":"2026-08-02T17:14:57.347493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.352450Z","title":"Advances in Neural Information Processing Systems36, 51758–51777 (2023) 2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.352450Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:3d0270eb1a08326c013cb103fd2ee8b9e8dc7dbeaa1785ec13944c3f0b0c1897","observation_id":"c2603ab8-288d-4145-a5ac-af3a06d7ecb8","resolution":{"observed_at":"2026-08-02T17:14:57.352450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.357397Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.357397Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:b26ba7d65b9a3c41e0df68ab63963b54945802ba64e6546f89c0bf73cb0bca0e","observation_id":"00411c22-f33d-46f7-8fa4-05e42499ef4b","resolution":{"observed_at":"2026-08-02T17:14:57.357397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17270","last_updated":"2024-02-22T13:05:52Z","snapshot_observed_at":"2026-08-06T03:42:49.390767Z","submitted_at":"2024-01-30T18:59:38Z","title":"YOLO-World: Real-Time Open-Vocabulary Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17270","snapshot_observed_at":"2026-08-02T17:14:57.362927Z","title":"arXiv preprint arXiv:2401.17270 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.362927Z"},"links":{"cited_paper":"/paper/2401.17270","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:cbc0147459eaf0c388ad7b5f6af80f5e7759a00249d24ce6fb838e03701a285d","observation_id":"aa9eeb73-dffc-44f0-a615-b6acb90bf4f6","resolution":{"observed_at":"2026-08-02T17:14:57.362927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.367732Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.367732Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:305ba01c871678f9e38245091a28583bbe292ea50eb8938b45148bc06c4ea9a8","observation_id":"e4efe9f7-d3f2-417c-854b-fc857fed5c88","resolution":{"observed_at":"2026-08-02T17:14:57.367732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.372958Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.372958Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:b7c3217bac600269cc611a76fd54150f74cb046f51cdfe14ea1baf82c6a260c5","observation_id":"0740dbff-664d-4ea8-93e3-5244c57223cd","resolution":{"observed_at":"2026-08-02T17:14:57.372958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.377646Z","title":"In: 2009 IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.377646Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:0469380c21da02b8c223164c335d0f1d0c2053c6f9217f0060749cbbe1521615","observation_id":"75da5dad-ebac-4c20-a7f9-ca03893a981e","resolution":{"observed_at":"2026-08-02T17:14:57.377646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.382499Z","title":"Journal of machine learning research17(59), 1–35 (2016) 4","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.382499Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:2cb6b76b5fc94fe5fed97f3f299579bab65701903eebbebe93a3b6126021f471","observation_id":"08e3d909-339b-4381-901a-627629287893","resolution":{"observed_at":"2026-08-02T17:14:57.382499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.02515","last_updated":"2018-11-27T15:26:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-10-06T17:49:51Z","title":"Integrable deformations of the $G_{k_1} \\times G_{k_2}/G_{k_1+k_2}$ coset CFTs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.02515","snapshot_observed_at":"2026-08-02T17:14:57.387697Z","title":"arXiv preprint arXiv:1710.02515 (2017) 5 16 X","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.387697Z"},"links":{"cited_paper":"/paper/1710.02515","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a16dc3093730058b739543deea61bc882ec957441aabbf5146a0e3c32b9c1e10","observation_id":"616dbe28-23f1-4d41-86a3-ffa13f4a4725","resolution":{"observed_at":"2026-08-02T17:14:57.387697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.393552Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.393552Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:fad9a9a46621c273cc215c6400fa468571ad24f8dec61763c53b33d3a07468e3","observation_id":"8b8fb85c-bd7e-43ae-81bf-a3f686877258","resolution":{"observed_at":"2026-08-02T17:14:57.393552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.01434","last_updated":"2020-07-02T23:08:07Z","snapshot_observed_at":"2026-08-07T18:31:23.290877Z","submitted_at":"2020-07-02T23:08:07Z","title":"In Search of Lost Domain Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.01434","snapshot_observed_at":"2026-08-02T17:14:57.398767Z","title":"arXiv preprint arXiv:2007.01434 (2020) 4","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.398767Z"},"links":{"cited_paper":"/paper/2007.01434","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:2926b8641159c8fa0d4dce3c442279db1b85f48f8b4be34bdea371668d27fb66","observation_id":"6cb70299-f2b5-447b-a71a-5b9fd7ee7b56","resolution":{"observed_at":"2026-08-02T17:14:57.398767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.404147Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.404147Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a395771b57b5286cf7f5af03a6fba58430bc325c0a080316b6706d4ce6106ca2","observation_id":"6a955007-e42b-4130-8719-9452eb14b691","resolution":{"observed_at":"2026-08-02T17:14:57.404147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.12261","last_updated":"2019-03-28T20:56:37Z","snapshot_observed_at":"2026-08-02T09:01:28.869881Z","submitted_at":"2019-03-28T20:56:37Z","title":"Benchmarking Neural Network Robustness to Common Corruptions and Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.12261","snapshot_observed_at":"2026-08-02T17:14:57.408553Z","title":"arXiv preprint arXiv:1903.12261 (2019) 4, 9","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.408553Z"},"links":{"cited_paper":"/paper/1903.12261","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:ea0656a211fa9dfbd5b6277b7347db7669380c88107a1b26fdc65f1a4525cfe1","observation_id":"5ed92af9-080a-46c4-8233-27a213f69737","resolution":{"observed_at":"2026-08-02T17:14:57.408553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02781","last_updated":"2020-02-17T06:16:13Z","snapshot_observed_at":"2026-07-06T08:42:24.926713Z","submitted_at":"2019-12-05T18:18:10Z","title":"AugMix: A Simple Data Processing Method to Improve Robustness and Uncertainty","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02781","snapshot_observed_at":"2026-08-02T17:14:57.413777Z","title":"arXiv preprint arXiv:1912.02781 (2019) 4","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.413777Z"},"links":{"cited_paper":"/paper/1912.02781","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:b63689c17a1827f2cbbfdfe3ff84a06016d501ba307b7788ed875f6dade7f533","observation_id":"8fc7ccae-e8f7-4410-b2ef-2815bdfec6c6","resolution":{"observed_at":"2026-08-02T17:14:57.413777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.418752Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.418752Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:5ac9bd10f055a3468cfc1e64d5adc66c15201af21392d15aa98753c3fcda167d","observation_id":"711caa4e-6968-47c8-8466-af42a7b3d6ef","resolution":{"observed_at":"2026-08-02T17:14:57.418752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.423359Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.423359Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:b21a93d696ed1ca87408bd56ca5fb01953245a5fc1a9be8b5de704f50f7884d1","observation_id":"7f005bc2-9a0b-4006-b86b-2e52d6c9ba16","resolution":{"observed_at":"2026-08-02T17:14:57.423359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.427934Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.427934Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:3d8b175b9a9921821325baad43af7937dcede05c3061837cf90d9420d5786340","observation_id":"c0fc9036-3a11-446c-a7a2-95dea16d214a","resolution":{"observed_at":"2026-08-02T17:14:57.427934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-07-06T05:10:58.923264Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-02T17:14:57.432743Z","title":"arXiv preprint arXiv:1609.04836 (2016) 14","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.432743Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:dea4cf52d9f617055a0b6bc6c3dab0a0fb61731faac1fad67c789a8bb8fb8cb5","observation_id":"404d6b5d-2bd2-4775-99ea-ace0d1024a40","resolution":{"observed_at":"2026-08-02T17:14:57.432743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.437947Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.437947Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:6751a1358c696afcb19ee5a112961f731a3e6ed49f3d8768d4c80aa069c99581","observation_id":"efe678bc-25d5-447e-b62a-f6bf0c3eecad","resolution":{"observed_at":"2026-08-02T17:14:57.437947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.443000Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.443000Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:e553d3f29c46a46548740dcbc4e9b59d28db61037f90bcd40760c53e1983171c","observation_id":"57989072-a6b7-4a16-a059-927dfb5d6df1","resolution":{"observed_at":"2026-08-02T17:14:57.443000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.448207Z","title":"In: Advances in neural information processing systems","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.448207Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:27bd16c11280edc5b5bf0856f11ebe6dea7042bb2a515f46d692b7c5a6a1f508","observation_id":"6daa75e8-7efb-44be-be48-8fce59f161c7","resolution":{"observed_at":"2026-08-02T17:14:57.448207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.452787Z","title":"In: Proceed- ings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.452787Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:9beb023cedef90bb5f65873f663a9814b9b61568031970ce84207333e362b653","observation_id":"4aa383bf-5631-4c89-8e99-1064768c5f94","resolution":{"observed_at":"2026-08-02T17:14:57.452787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.457383Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.457383Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:6e2e456790adae12cc48c338ac9c62dfcdd7bd13874a17f594ab7b97de48cde8","observation_id":"13a7ae47-730b-48d5-b373-99a9ab95b3bb","resolution":{"observed_at":"2026-08-02T17:14:57.457383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.463048Z","title":"Advances in Neural Information Processing Systems34, 18878–18890 (2021) 14","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.463048Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:56387859a29ade5ce3b274f6acfc40cf15d7ade6e927b05f42d3761d5cf87936","observation_id":"3aedc1f1-c3e9-4d90-9242-38b47f518d0c","resolution":{"observed_at":"2026-08-02T17:14:57.463048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13624","last_updated":"2023-07-27T13:13:11Z","snapshot_observed_at":"2026-07-06T11:42:55.121494Z","submitted_at":"2021-08-31T05:28:42Z","title":"Towards Out-Of-Distribution Generalization: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13624","snapshot_observed_at":"2026-08-02T17:14:57.467740Z","title":"arXiv preprint arXiv:2108.13624 (2021) 4","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.467740Z"},"links":{"cited_paper":"/paper/2108.13624","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:0a14c948c8dd96a14d918a74d555e27f8ac11bf43bfff3aabe9c101c978f1e3b","observation_id":"545d790b-112c-4666-af70-ea23e2482486","resolution":{"observed_at":"2026-08-02T17:14:57.467740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.473939Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.473939Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:0955b1bcebbf1899da236138eeb01fef7b91173d86c9329bc74018fefdc5f441","observation_id":"d3590180-5993-4dda-b25f-5dc34e67fc8b","resolution":{"observed_at":"2026-08-02T17:14:57.473939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.478529Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.478529Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:775bea16afd20a5a970399086df6760384aeb7807ba71180c75a4e4c31d72f3c","observation_id":"cba4ed00-f9d7-4761-be1c-50d65d992e16","resolution":{"observed_at":"2026-08-02T17:14:57.478529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.07484","last_updated":"2020-03-31T08:42:46Z","snapshot_observed_at":"2026-08-03T06:25:53.775445Z","submitted_at":"2019-07-17T12:51:10Z","title":"Benchmarking Robustness in Object Detection: Autonomous Driving when Winter is Coming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.07484","snapshot_observed_at":"2026-08-02T17:14:57.482974Z","title":"arXiv preprint arXiv:1907.07484 (2019) 4","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.482974Z"},"links":{"cited_paper":"/paper/1907.07484","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:09d537db101c108628a88d885ab93956bfd60cd55296ac2e1f8aec891bdbee62","observation_id":"9b6cdfe6-31e2-4b45-b726-13caa402277a","resolution":{"observed_at":"2026-08-02T17:14:57.482974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.487825Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.487825Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:f543ef1d7c727e469fb45db1371b5b0ff776d194176be2d7b8a2f26377011ecd","observation_id":"c5e72e69-e98c-462f-b553-59e5587b8eb9","resolution":{"observed_at":"2026-08-02T17:14:57.487825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.492625Z","title":"Journal of Machine Learning Research21(181), 1–50 (2020) 5","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.492625Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:1735ff59035fb066b2fa7c033b98956187950e5c9e52ffb6d22a73b6defb4cc9","observation_id":"c68d657b-0a31-43a8-ba3c-03b163d85327","resolution":{"observed_at":"2026-08-02T17:14:57.492625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.497215Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.497215Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:e048392b68520c36f4fb45e71ba01daa0a6fd3f58a117a489450b8ee929cb199","observation_id":"482e0a1b-5b63-4474-9d22-4a67974ecc46","resolution":{"observed_at":"2026-08-02T17:14:57.497215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.501706Z","title":"In: Proceedings of the IEEE international conference on computer vision","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.501706Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:210212fc185f3d37abfaf9df1eb555a402424631255fdb8444e272be09ccd99b","observation_id":"96563487-0ce0-4822-8b1f-2b8f55276b50","resolution":{"observed_at":"2026-08-02T17:14:57.501706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.506131Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.506131Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:d9f171dc5711fa886701288c844dbaa0f34bf431a03da05c82676b6073d9b9de","observation_id":"92c4084f-5ecb-4bbc-962c-c66c23b591aa","resolution":{"observed_at":"2026-08-02T17:14:57.506131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01946","last_updated":"2021-10-18T16:55:50Z","snapshot_observed_at":"2026-08-02T21:54:52.288981Z","submitted_at":"2021-03-02T18:58:33Z","title":"Fixing Data Augmentation to Improve Adversarial Robustness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01946","snapshot_observed_at":"2026-08-02T17:14:57.511532Z","title":"arXiv preprint arXiv:2103.01946 (2021) 4","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.511532Z"},"links":{"cited_paper":"/paper/2103.01946","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:cd969c673112e01b2eb30240ddad791e3b8ee654095759377b309bb9775fde8d","observation_id":"f0a335d2-1b6d-4da9-b515-a72fb9b79875","resolution":{"observed_at":"2026-08-02T17:14:57.511532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.516441Z","title":"Advances in neural information processing systems28(2015) 9, 10","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.516441Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:857acd683856b39c750c0d7e87f26d2fbd448039ad54d32769cb8a7497924c47","observation_id":"8b7609e9-156d-464c-ab40-25fe5877097d","resolution":{"observed_at":"2026-08-02T17:14:57.516441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.520718Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.520718Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:c1546d3061ed09fd65d0d581a2a6412a67d9578ccebfc3b675c7267c8b0f81ca","observation_id":"235a6884-46bf-4257-a3ca-b1290ea93c2d","resolution":{"observed_at":"2026-08-02T17:14:57.520718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16188","last_updated":"2025-02-22T17:14:26Z","snapshot_observed_at":"2026-07-06T17:49:45.103989Z","submitted_at":"2024-03-24T15:10:22Z","title":"Cross-domain Multi-modal Few-shot Object Detection via Rich Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16188","snapshot_observed_at":"2026-08-02T17:14:57.525510Z","title":"arXiv preprint arXiv:2403.16188 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.525510Z"},"links":{"cited_paper":"/paper/2403.16188","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:e1dd041a4076e9b82fc563963230acb8232c1d415b223feae0d6d6aea7d423c9","observation_id":"05e315e5-e0fc-4a8c-a960-e8d2139022b2","resolution":{"observed_at":"2026-08-02T17:14:57.525510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.530358Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.530358Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:d3f51d2d33ffac02ce5ccc36ef9765b124af47cb1cda8c0dee96a7ef230418d5","observation_id":"341d41ec-a22e-403d-95d2-238c1e73c1af","resolution":{"observed_at":"2026-08-02T17:14:57.530358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.535081Z","title":"In: Proceed- ings of the 56th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.535081Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a4a13b51c2e29f9d1fcd0afa4bbbbd7f2d80ab7f5b25761b1e313fc13024f7b4","observation_id":"7c99e1b4-0d25-45cb-955c-2acdc903e06f","resolution":{"observed_at":"2026-08-02T17:14:57.535081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.539707Z","title":"In: Pro- ceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recogni- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.539707Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:988ea24f14883bfd3ba48be9d5f4d66b96789d82071917d5570ca35f46b8daec","observation_id":"89800ab4-27a0-4203-bb60-c818203f64fc","resolution":{"observed_at":"2026-08-02T17:14:57.539707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.544603Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.544603Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:40d7f2725f876aabcd8348b8f35836332d830cc6abec7caa95a0332ff44413ca","observation_id":"337dde26-337a-4d7a-bc2d-1e03eb0171bb","resolution":{"observed_at":"2026-08-02T17:14:57.544603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.549547Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.549547Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:327110b27b49e30cf33e6e4b3e55e1647e15d5437e03b7f4c4254ff31b0a2408","observation_id":"f7671daa-c5c3-435d-b158-cef36d9a60b7","resolution":{"observed_at":"2026-08-02T17:14:57.549547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3474","last_updated":"2014-12-10T21:20:54Z","snapshot_observed_at":"2026-07-06T04:03:12.627088Z","submitted_at":"2014-12-10T21:20:54Z","title":"Deep Domain Confusion: Maximizing for Domain Invariance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3474","snapshot_observed_at":"2026-08-02T17:14:57.554186Z","title":"arXiv preprint arXiv:1412.3474 (2014) 10, 11","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.554186Z"},"links":{"cited_paper":"/paper/1412.3474","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:6cea16bfabd527fc265345a5a9fd1f41eb116789c5f3f22041aad3a114bfe44d","observation_id":"a3a6729f-6484-4058-a2ad-1332445b0a80","resolution":{"observed_at":"2026-08-02T17:14:57.554186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.558895Z","title":"IEEE transactions on knowledge and data engineering35(8), 8052–8072 (2022) 4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.558895Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:b17a21d8b57794ffbe346afbc49bf50851e527f74d9ac5b651343ca2c55ec6c9","observation_id":"85531d54-9986-4b23-9ad6-94791a088dce","resolution":{"observed_at":"2026-08-02T17:14:57.558895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.563765Z","title":"In: Proceedings of the AAAI conference on artificial intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.563765Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:30871d6b09035ae7d8aff2f450f27027e4f9eaf2d54f252684bd624e856282b4","observation_id":"ee2ade6a-e656-4b35-9cb2-bc3cbdcc9f4b","resolution":{"observed_at":"2026-08-02T17:14:57.563765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.568202Z","title":"arXiv preprint arXiv:2502.00604 (2025) 14","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.568202Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:32c7efe0829741bcfdf9ae5c2179e5e53511c5147b8191973f3ae4a0750eda59","observation_id":"f4d20100-9d89-4392-bef2-98a1a62a646d","resolution":{"observed_at":"2026-08-02T17:14:57.568202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-02T17:14:57.572731Z","title":"arXiv preprint arXiv:2108.10904 (2021) 1","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.572731Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:600e786d557fa13eff1f4f114230a25c8b5b8d139e95fcc47643d2a6707d0f7b","observation_id":"5e42c1d0-96fb-429a-bbdd-c8fbb123c2e5","resolution":{"observed_at":"2026-08-02T17:14:57.572731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.577473Z","title":"In: Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.577473Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:2cebe72d6b59c81324cb59372a4dec02cbfc59d2b3b5c6e21e71b8ca3064a511","observation_id":"38ef6fb9-27c1-4a45-b8af-268258adc14f","resolution":{"observed_at":"2026-08-02T17:14:57.577473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.582192Z","title":"In: Proceedings of the IEEE/CVF conference on com- puter vision and pattern recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.582192Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:753e14f8c9092f1c1aab136a767f7764c527277bb239677dbed82c55fa7fd523","observation_id":"b3d6eb59-c3ab-4413-967b-6b18a713264a","resolution":{"observed_at":"2026-08-02T17:14:57.582192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.587058Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.587058Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:ffbee3058dc5eb3d81915091cb40983f5f4b621b8d54498b5ce44c938d0f42f1","observation_id":"a85a5d63-0775-4a3d-9306-bb1c58194f2a","resolution":{"observed_at":"2026-08-02T17:14:57.587058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.591816Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.591816Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:3d5bf4acb3b048bce22e265ba0d49c25b17aaee7a9015597b75fb06c623d788c","observation_id":"1ab926b3-a73c-4955-8d38-360ba6433c46","resolution":{"observed_at":"2026-08-02T17:14:57.591816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.596563Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.596563Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:a81483028cab508161e86dd91ea82d1f1bb86e0b41753dd248130af656a9ca65","observation_id":"991d8713-0210-4fc1-ac2a-6e0d9789be76","resolution":{"observed_at":"2026-08-02T17:14:57.596563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-07-06T06:06:04.571585Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-02T17:14:57.602287Z","title":"arXiv preprint arXiv:1710.09412 (2017) 10","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.602287Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:4fc770de85814809001c81fe2a58e812c012e376c8f2b64c05f25bb01efbfc8f","observation_id":"36fc064f-9180-4840-bf20-c51f4f4df19f","resolution":{"observed_at":"2026-08-02T17:14:57.602287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.607470Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.607470Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:571378847fc56b355a7e151e1e55ffb40c11daefdf20c6a34323ec8f3b80b740","observation_id":"af81b754-7362-4203-a283-b26f168930bc","resolution":{"observed_at":"2026-08-02T17:14:57.607470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.612063Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recog- nition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.612063Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:52a32c0c31fd25b8ff7218f193321f8b79641995306c9a19013142447a2ad48f","observation_id":"5cf2f4f9-a0a3-44e4-a123-2ce0aba34fd3","resolution":{"observed_at":"2026-08-02T17:14:57.612063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.616872Z","title":"In: European conference on com- puter vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.616872Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:4f7a1747bd228d6a69d3946ed4b2bf4e5d2222033347aa271679431094780ab9","observation_id":"fe6720a5-621b-46b4-a5a1-fbd38f1db3be","resolution":{"observed_at":"2026-08-02T17:14:57.616872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:14:57.621581Z","title":"International Journal of Computer Vision132(9), 3375–3407 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T17:14:57.621581Z"},"links":{"citing_paper":"/paper/2603.27556"},"observation_digest":"sha256:7394d4acc9de73b4ba4fd72456ea938b0daffbeaf2e6ca745e814caa232d433d","observation_id":"d5a0cfd4-e78e-465a-a6bb-3a0c4f6a2a4c","resolution":{"observed_at":"2026-08-02T17:14:57.621581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.27556","last_updated":"2026-07-17T03:36:55Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T09:32:09.869491Z","submitted_at":"2026-03-29T07:39:31Z","title":"Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2603.27556."}