{"as_of":"2026-08-15T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acc6dc16fe1f61a8d5d4c6124e12b0b1904eda0a8d1d1b7aa674f407ef86d903","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:47:30.027583Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.10680/citation-record","integrity":"/paper/2412.10680/integrity","json":"/paper/2412.10680/citation-record.json","paper":"/paper/2412.10680"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.397793Z","title":"Contrastive learning of semantic concepts for open-set cross-domain retrieval","venue":null,"work_id":"0cf826d1-5fce-4704-8c5e-b40ca7d706b1","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.684114Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:5f038a491c8ac31b75df57b52e1994d8cf99d1acaa2c61a39dd6999d42f661ee","observation_id":"e7c20acc-6faf-406d-9ba6-b9a243c15c7c","resolution":{"observed_at":"2026-08-11T15:47:31.403772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.376526Z","title":"Handling class-imbalance for improved zero-shot domain generaliza- tion","venue":null,"work_id":"9f97ce38-0ddb-47c2-8d55-ce830450d82a","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.694623Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:73a0dbaa4e9bf22aaa10352a83860f61071fd88ec83b316179ca5a22f0697878","observation_id":"806a06bf-7f82-4d88-bffd-f246727241e9","resolution":{"observed_at":"2026-08-11T15:47:31.382825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.356861Z","title":"General- izing from several related classification tasks to a new unla- beled sample","venue":null,"work_id":"6265b837-6937-4305-9bb0-c8e2a9e12626","year":2011},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.703645Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:b568686e4d298f7b3356ce5716f9363155c18d1791246e7135bea1cd68363072","observation_id":"c86e320a-53d8-419d-8400-e58f530bd862","resolution":{"observed_at":"2026-08-11T15:47:31.363466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.337923Z","title":"Stylip: Multi-scale style- conditioned prompt learning for clip-based domain general- ization","venue":null,"work_id":"f5183fdb-9582-4d35-a2fe-f789ddb6512f","year":2024},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.711088Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:ceb68730780d537baf0a5168dc78b530e29d135d6425078658dffde9d00840ae","observation_id":"377af791-0d3e-45af-b3cf-867a02808439","resolution":{"observed_at":"2026-08-11T15:47:31.344052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.316145Z","title":"A review on multi- modal zero-shot learning","venue":null,"work_id":"84cea407-6b09-40c8-91bc-a4411c8a25dc","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.718699Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:9cef4635801fe4fd703fae14578eaca00aadb55ee9a96b5459ad8d3e4aabaf4b","observation_id":"bd62b85a-3661-4dcc-ad5d-a749915a5507","resolution":{"observed_at":"2026-08-11T15:47:31.324039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.291349Z","title":"Uniter: Universal image-text representation learning","venue":null,"work_id":"10af4c33-c6d9-4d94-bb0a-7f1e1daec837","year":2020},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.726914Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:875f2b159f00b46de8b8303a3e01fa9e3bb8d93bf9a2494ab07f38fbf06ca923","observation_id":"cfab177c-9657-47cf-8a03-00c44a2fdc7a","resolution":{"observed_at":"2026-08-11T15:47:31.298626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.268928Z","title":"Video ecommerce: Towards online video advertising","venue":null,"work_id":"cb023824-de0e-4adf-adbf-c415786802fa","year":2016},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.735589Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:d0534631d7f5fa43a63d9c655d4edea07d3cbe6fc43c7fa75bfe184678cf9bc4","observation_id":"5e9788c6-51b5-441c-b445-3061402f1cbf","resolution":{"observed_at":"2026-08-11T15:47:31.276549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.242453Z","title":"Video ecommerce++: Toward large scale online video adver- tising","venue":null,"work_id":"5b79996b-3bf3-4f67-a159-3bb23f7baf75","year":null},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.742954Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:360333a35f11876f0929140e65ffd4f4146ad4d3b3789dc2a31ed303cf78cf66","observation_id":"490d7aff-032c-4779-a200-298ee81d4ac9","resolution":{"observed_at":"2026-08-11T15:47:31.249793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.214655Z","title":"Video2shop: Exact matching clothes in videos to online shopping images","venue":null,"work_id":"507791b7-9345-43e0-bb0b-63e0c6bf310d","year":null},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.751237Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:199991273997a1683793b85338249d98d4ebac32425dab0affceebf3bb444762","observation_id":"93a3e97c-cd02-45a4-aa96-58e869fc8a3b","resolution":{"observed_at":"2026-08-11T15:47:31.227090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.188065Z","title":"On the selection of anchors and targets for video hyperlink- ing","venue":null,"work_id":"50c9ba17-023c-4f00-9e12-c5a20e383656","year":2017},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.756727Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:1c1116c9257ddd168cd24fa4bcc4429af9d0c5ea89e96865656fa83609c6dc89","observation_id":"229a7498-2848-4734-8554-ddcbe02791d0","resolution":{"observed_at":"2026-08-11T15:47:31.195143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.162739Z","title":"An evaluation of descriptors for large-scale image retrieval from sketched feature lines","venue":null,"work_id":"ee1df923-cb0a-49db-bf68-087cad2f6f31","year":2010},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.762845Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:3b0844e01a5fd1520b3d14cbbc05deb788274314322699e199f2817006340609","observation_id":"aff4ac5b-6297-4adb-9c9a-cde781e65cee","resolution":{"observed_at":"2026-08-11T15:47:31.170886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.137074Z","title":"Pros: Prompting-to-simulate generalized knowledge for universal cross-domain retrieval","venue":null,"work_id":"b8e83ec3-a071-427e-a272-66c2a198cc84","year":2024},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.768646Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:3be14e4caaaaac2fded5b6a56ef579112db8d56c0685cd43018222779f962fc9","observation_id":"4f196da1-e340-4723-8935-93e7ad696ca7","resolution":{"observed_at":"2026-08-11T15:47:31.143125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:29.774305Z","title":"Domain adaptation via prompt learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.774305Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:8a925daa3e025f994719a5b149bb1728772e6dc1f4c85a851ca60082f181f6bc","observation_id":"942c3675-23d7-46b6-9fad-a5e1d65adb53","resolution":{"observed_at":"2026-08-11T15:47:29.774305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.099895Z","title":"Improv- ing diversity with adversarially learned transformations for domain generalization","venue":null,"work_id":"62670417-74eb-4a97-8e72-9eaaf37184c3","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.780168Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:9e6e2cd3593ca4eba68d170a45eb9db453fc64ebfd33f5b0f92b45ce12ebd811","observation_id":"8391679f-03bc-4a3e-90f1-0b74bef8662a","resolution":{"observed_at":"2026-08-11T15:47:31.105870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.075800Z","title":"Mixup as locally linear out-of-manifold regularization","venue":null,"work_id":"e5a428c9-d051-4a79-8198-a0419a453da8","year":2019},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.785506Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:1077e943d53ffa4b0a02331412b28ad4ea8327f4fa59fb64451dd332227a75db","observation_id":"c26ddd30-0178-4617-8437-d7b4ba8b7ad6","resolution":{"observed_at":"2026-08-11T15:47:31.083818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:29.791285Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.791285Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:79b0e435a4ac550b1d148ad7c3a923b4ec2e27cfe5e2d90dee97bb8723d3766a","observation_id":"6b5fe7f3-cd61-4205-b0a0-9798f1661ef5","resolution":{"observed_at":"2026-08-11T15:47:29.791285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.031779Z","title":"Vi- sual prompt tuning","venue":null,"work_id":"102a2935-433a-4ef9-b5a7-3841dd89d3f0","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.797991Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:1aa6223d6e99428a4b7bf44cb6a4a69ce622913af1556a214d1a2718e4c61166","observation_id":"bf8669c8-0e8e-4b6c-8031-19ecfff35aea","resolution":{"observed_at":"2026-08-11T15:47:31.038080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:31.004089Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"0cfee416-a800-464f-a943-21e18fa1a855","year":2019},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.804836Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:320b28e4ea9629cb69879b7275c0fbfb157db7e2b9fa814a38d34b27033df8a2","observation_id":"ca65de6f-5287-4b7a-b79e-9d68699c7955","resolution":{"observed_at":"2026-08-11T15:47:31.011206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.984495Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"946523c4-97b8-41c5-a8fc-bf80f0bb7b3f","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.811637Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:be72267ef6a583310227d1654d2a0bd4fc78f54c83006189ce0f2711736a3102","observation_id":"a224e1a6-1f02-4462-b133-e2e632cf7d70","resolution":{"observed_at":"2026-08-11T15:47:30.990185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.964372Z","title":"Self-regulating prompts: Foundational model adaptation without forgetting","venue":null,"work_id":"676147f1-19f1-4e78-9182-6168a81e2959","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.817269Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:0a572db335135a643c02f7e17fa03eb6c82c32e2473d747c3216ecc5ac9128f7","observation_id":"13988ba2-8842-41ca-ab24-e62e8c094c75","resolution":{"observed_at":"2026-08-11T15:47:30.971587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.943969Z","title":"Interpretability be- yond feature attribution: Quantitative testing with concept activation vectors (tcav)","venue":null,"work_id":"54ffe97c-d183-42ae-b22d-4bbf8aba5c4c","year":2018},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.825144Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:f7969ce0ccd9cb93dba70b6eb6be4e270f98670f5ccdaca71724d2cb8fc97008","observation_id":"4d5fd7ae-18e7-4dad-a607-ac2274b345e5","resolution":{"observed_at":"2026-08-11T15:47:30.949646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.922243Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":"fbc50b9e-7d1a-4daf-8ba6-331dfb60cdd4","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.831798Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:990424bedd0d58216a73d58db1ff4402f74991b4e55770f7a68f96bda1fbd220","observation_id":"67ccb769-1768-4e38-ace6-1ce541c7e559","resolution":{"observed_at":"2026-08-11T15:47:30.929635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.892687Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"195449d8-4b00-4a7f-83ed-a7546ad69d9f","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.836910Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:4b41a0badaa50fa0626c8ad9a79f302272fa885141171211cfa43aff042af8d5","observation_id":"9cab681e-3a91-4fb9-9604-8ba026d6f0e5","resolution":{"observed_at":"2026-08-11T15:47:30.901170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.871134Z","title":"Align before fuse: Vision and language representation learn- ing with momentum distillation","venue":null,"work_id":"5726246f-2f9c-4f83-b933-04584574416b","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.842107Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:859b6745f09487419eceb5a06a4975e4ecb88383eb5945cfedb1803faf94434e","observation_id":"8c93638e-a690-47f6-91a3-f5094def5f66","resolution":{"observed_at":"2026-08-11T15:47:30.876672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.842014Z","title":"Oscar: Object-semantics aligned pre-training for vision-language tasks","venue":null,"work_id":"caedfbae-98cd-4c35-b072-7bfb5755b862","year":2020},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.847403Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:f58d4179c32454f207efb7ba8700196fc2e726d5838307ead9bb10cbf8c16891","observation_id":"52d56236-2b59-4f70-bbab-e6440e584ac7","resolution":{"observed_at":"2026-08-11T15:47:30.851334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.818237Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":"763249c6-3826-4a42-837f-98d692bb4ccc","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.852165Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:7e74a3f5bbed2efb989b0ba66d30cd762dcebe907e9402fcae9824f02ee63889","observation_id":"ee9eb51a-e7c5-47a8-bb74-5fcbcbbfd3b7","resolution":{"observed_at":"2026-08-11T15:47:30.826747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.781483Z","title":"Deep sketch hashing: Fast free-hand sketch-based im- age retrieval","venue":null,"work_id":"511f54e3-352f-4871-a61a-0bf571f181c2","year":2017},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.857777Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:3b0417e8a7eb7c73133539b5c48b9139f8ddead76e1e93fd1c1b0dfcb58e0241","observation_id":"8f8ce084-4963-4c06-a42b-4acbc9d80712","resolution":{"observed_at":"2026-08-11T15:47:30.790458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.742929Z","title":"Cocoa: Context-conditional adaptation for recognizing unseen classes in unseen do- mains","venue":null,"work_id":"a097e7c6-ea22-4607-8556-b81b8c13f1a5","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.862804Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:af1d9b694dca08c2230a5960a5aaac9b81e943247051e5cc3c9562b45d3d7c43","observation_id":"3c4d17bd-5af2-44fd-9056-7ba131f0376e","resolution":{"observed_at":"2026-08-11T15:47:30.755626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.712548Z","title":"Seic: Semantic embed- ding with intermediate classes for zero-shot domain general- ization","venue":null,"work_id":"736b076e-e2d3-4f4b-a6e3-86edc59fa0fd","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.867863Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:8a5f6a1dad5cb7ea5f8ba75050908aeab5c27e8a300cf609ca59fb0eaf430501","observation_id":"9b465454-68cd-4fe2-a27b-212dd94e64f1","resolution":{"observed_at":"2026-08-11T15:47:30.723035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.681007Z","title":"Vireo@ trecvid 2017: Video-to-text, ad-hoc video search and video hyper- linking","venue":null,"work_id":"1b9d9c2c-c8cd-493a-895e-c68cd023d381","year":2017},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.873098Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:2bdf777122bd3bd70fd429f29262e6e334c916fe4216850aa25818f570a51a0f","observation_id":"9f6387b6-a9bf-448e-99c8-dfbdf7c02140","resolution":{"observed_at":"2026-08-11T15:47:30.687860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01723","last_updated":"2024-11-07T06:25:25Z","snapshot_observed_at":"2026-08-13T05:33:40.552198Z","submitted_at":"2023-11-03T05:41:25Z","title":"Towards Calibrated Robust Fine-Tuning of Vision-Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01723","snapshot_observed_at":"2026-08-11T15:47:29.879587Z","title":"Towards calibrated robust fine-tuning of vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.879587Z"},"links":{"cited_paper":"/paper/2311.01723","citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:d4f9b7760e16d9bbd575769499be94cbae660a0e7f2e2fbf0880cd7ba359a6da","observation_id":"d4b698ba-035d-4e81-ad05-10a51fb62318","resolution":{"observed_at":"2026-08-11T15:47:29.879587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17491","last_updated":"2026-04-03T23:10:26Z","snapshot_observed_at":"2026-08-13T12:50:57.041166Z","submitted_at":"2024-07-04T02:35:00Z","title":"Robust Adaptation of Foundation Models with Black-Box Visual Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17491","snapshot_observed_at":"2026-08-11T15:47:29.886780Z","title":"Ro- bust adaptation of foundation models with black-box visual prompting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.886780Z"},"links":{"cited_paper":"/paper/2407.17491","citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:8f1e8058d7ba78503b0984e207ae1e7ad41e8a6aabe505bad691d816ff49c7b6","observation_id":"0fc1bb8b-bed2-4b57-a62a-26ad2f8141f6","resolution":{"observed_at":"2026-08-11T15:47:29.886780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.635628Z","title":"Universal cross-domain retrieval: Generalizing across classes and do- mains","venue":null,"work_id":"bc547288-4644-41ea-8eca-7332a2c585cf","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.894303Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:477675e98a3d0578a0d8144b3326c3cc6866edbb0a11c088c79c31ac1cf01146","observation_id":"3bb68d79-0fed-46a3-aefd-f0e0246e11da","resolution":{"observed_at":"2026-08-11T15:47:30.658315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.606788Z","title":"Clipping: Distilling clip-based models with a student base for video- language retrieval","venue":null,"work_id":"e5f0d20a-5f6b-45f0-b930-ccd4a4f3f0f6","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.900879Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:19d7f47989d170f0eaaf5cda57ed9bd7f23d7ea6e613ecee4c94b58677709056","observation_id":"3ca5babd-0e75-460e-bf33-edd39f7e7142","resolution":{"observed_at":"2026-08-11T15:47:30.613592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.582497Z","title":"Moment matching for multi-source domain adaptation","venue":null,"work_id":"d3137ded-7a22-4d04-8430-cc1411f81455","year":2019},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.907034Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:f0ca556dc8b5b91f44d9be4e9c31117d4f063957154e00650375cf8ff47fc862","observation_id":"37a23471-ef22-43b6-992b-f69cea5e195b","resolution":{"observed_at":"2026-08-11T15:47:30.592047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.561744Z","title":"Language models as knowledge bases? In EMNLP, pages 2463–2473, 2019","venue":null,"work_id":"d9d72bde-d954-4a14-8f2a-d909cb10c94b","year":2019},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.913331Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:a24ecea0bdcf6761b25e268281964ed5c341928900e3ab7496c397270636e33b","observation_id":"e75ab3bb-ab6d-4e1d-b136-a031205df59d","resolution":{"observed_at":"2026-08-11T15:47:30.568633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.530417Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"34ba1f89-a1ef-439e-8bfe-f0206aff9498","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.919995Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:37984f70b2d8b850a6d354ca9bafae41413d271134d813f308e2e399b01eb93e","observation_id":"3a19ab14-f4f7-4334-a1e2-bd7f73674757","resolution":{"observed_at":"2026-08-11T15:47:30.541793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.505637Z","title":"Visual semantic segmentation based on few/zero-shot learning: An overview","venue":null,"work_id":"aaa9a7ed-e4c5-44f6-95ed-5d527368c05e","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.925836Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:e3786b09f1a54b2b1b5db54885212c72dd4fd2da633147bd8e8f372fe96c9053","observation_id":"fa7000d5-74ab-4805-bff3-ad647d01ca80","resolution":{"observed_at":"2026-08-11T15:47:30.512373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.478949Z","title":"Clip for all things zero-shot sketch-based image retrieval, fine- grained or not","venue":null,"work_id":"8ef3dfcf-af46-4d82-bffd-c39cb3c8d0e7","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.931895Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:8f24a6abff449c7ae707d9b1ede839d7807aa8a083be5c32dac4a07f7f9a9f01","observation_id":"2c3b03ca-c892-4d89-a427-7fc607d43db4","resolution":{"observed_at":"2026-08-11T15:47:30.488657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.452717Z","title":"The sketchy database: learning to retrieve badly drawn bunnies","venue":null,"work_id":"3dc30397-e9cc-40b1-8b49-8d142cb6e97d","year":2016},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.938644Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:74f439c8ef68e4f2829435512673bc69f8103fa0adfaf4dd3c37ac65a10d23c8","observation_id":"f9963754-31fe-4920-b53a-d08ef7ddd271","resolution":{"observed_at":"2026-08-11T15:47:30.459109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.416733Z","title":"Structure-aware semantic-aligned network for universal cross-domain retrieval","venue":null,"work_id":"3045e491-fec9-4cfa-bfc1-b4c2037f53ab","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.944522Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:e026b9cbbd34cc14a963d983370e8b1319a0588e939ccdb2f3550547f9d0ef7c","observation_id":"fe84fac4-91b9-4858-aa70-fb355f6bd293","resolution":{"observed_at":"2026-08-11T15:47:30.433154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.385306Z","title":"Generalizing to unseen domains: A survey on domain generalization","venue":null,"work_id":"ea049121-4648-495c-9ec8-adb8ddc90bf1","year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.953485Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:55477eb653bc5ea91478bd9eb50f3910342fe7ef3daa9085e3e25c5e243bda66","observation_id":"6b8e1403-f8ea-4c5a-979b-f7db6cfbbcf2","resolution":{"observed_at":"2026-08-11T15:47:30.396938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.354303Z","title":"Image as a foreign language: Beit pretraining for vision and vision- language tasks","venue":null,"work_id":"397eff49-ecda-4c67-bd05-36134176385f","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.961136Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:40ff4a3e1359163b88367989b6a9279681b872a9e38fdb8ac91ed250c0a784de","observation_id":"725281c3-fbad-4123-8537-e874e16bb5dd","resolution":{"observed_at":"2026-08-11T15:47:30.361529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.321861Z","title":"Ra-clip: Retrieval augmented contrastive language-image pre-training","venue":null,"work_id":"2d75254f-37b9-45ce-944f-b363838c2e1e","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.968856Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:d299c0c5d7da5f1fd7347e17fb8028018d26ad16d5d085b02667ab65a8a6f36c","observation_id":"3e44bcd6-1cfa-47c0-b9a2-8624c89f36bf","resolution":{"observed_at":"2026-08-11T15:47:30.333299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.297618Z","title":"Towards zero-shot learning: A brief review and an attention-based embedding network","venue":null,"work_id":"ee0131c1-6ec1-401d-ae70-dd1896dea046","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.974512Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:3766fe881fc160913d626ed19cf3a5f8744d411b61064f3bae5e371453284471","observation_id":"fac74cf3-5cce-4b79-8be1-b857f6592ca8","resolution":{"observed_at":"2026-08-11T15:47:30.305360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.274329Z","title":"A fourier-based framework for domain generaliza- tion","venue":null,"work_id":"0243673c-3292-42cc-ba19-5f25216ae17a","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.980694Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:e3c91143c8535617d4e6a831810ad7811c263ca24912889fb45b83bee643d92d","observation_id":"5e9133de-e645-4298-a2fc-c2d71a4eb0f1","resolution":{"observed_at":"2026-08-11T15:47:30.280229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.253184Z","title":"Mixup without hesitation","venue":null,"work_id":"aec81f14-e28b-412c-9a34-db20b58de637","year":2021},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.986351Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:7595f177d9bb656416b56eb431f6cdf9e2c47ecfa88241f90516b058c449753d","observation_id":"a0821ea1-f111-43af-974b-4da53c6c327a","resolution":{"observed_at":"2026-08-11T15:47:30.260180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.230980Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":"4bce2d6b-c709-4157-9a0c-f0f32ec0dbb0","year":null},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.992105Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:76085ca599f9fe59e7dae86debd18ec37e131041d2108bd33006b5cfc3f54657","observation_id":"57f2b9bc-8de2-498a-8ae1-09e7ba215c5d","resolution":{"observed_at":"2026-08-11T15:47:30.238522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.203610Z","title":"mixup: Beyond empirical risk minimiza- tion","venue":null,"work_id":"b5a98274-3031-4a8d-ac47-69ccc8f326bd","year":2018},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:29.998074Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:b9236a3be34da3ab90feaddb07b9d0c6ee5e9d69107774875547d8327a827514","observation_id":"891a94b8-d415-4c6d-8ccf-e495c334aea1","resolution":{"observed_at":"2026-08-11T15:47:30.210814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.172415Z","title":"Domain generalization: A survey","venue":null,"work_id":"bdcb1c91-c44d-49d3-8cf0-1e498f9c9365","year":2023},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:30.006795Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:13a5a58b791ac989e3f2f078e66621e1a6d5e396fb7447a384f760e30969046d","observation_id":"e38a05f0-a20e-4061-8fd3-085ca8e66726","resolution":{"observed_at":"2026-08-11T15:47:30.179985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.019008Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:30.019008Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:7f1f8f77e990e99514050c7ecb24e33b51bab6bafd85f892ea86632b5b17ecab","observation_id":"19a1227f-019e-40fb-a072-669294c18e85","resolution":{"observed_at":"2026-08-11T15:47:30.019008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:47:30.027583Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T15:47:30.027583Z"},"links":{"citing_paper":"/paper/2412.10680"},"observation_digest":"sha256:5860841bb735842cf1763c85ed2d1bbd12dc6ff2b83e517d6ca74f5fb56a8d6a","observation_id":"21331f54-17a1-4bbc-ae19-da5906a76dc4","resolution":{"observed_at":"2026-08-11T15:47:30.027583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.10680","last_updated":"2024-12-14T04:59:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T20:56:00.180616Z","submitted_at":"2024-12-14T04:59:38Z","title":"UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2412.10680."}