{"as_of":"2026-08-13T01:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96c6a2f4942829eb059c851fb9d5b0519f00c9627e88ac82c8011b1fa729a17b","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:43:17.255931Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16018/citation-record","integrity":"/paper/2411.16018/integrity","json":"/paper/2411.16018/citation-record.json","paper":"/paper/2411.16018"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.954566Z","title":"Stylip: Multi-scale style- conditioned prompt learning for clip-based domain gener- alization","venue":null,"work_id":"0e5cc21f-badf-4e22-a6d8-e2489b699c1f","year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.029906Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:1865480edf17466f6535091b0673e1b7c6747b751b52db1e92cd1bfc522e21ad","observation_id":"c3ca9e72-72ac-4875-a12f-331ac6d95284","resolution":{"observed_at":"2026-08-12T13:43:17.959412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.940112Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"0be11871-2ba9-42fe-856a-1a1ee76bb5c2","year":2014},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.035189Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:59d8b9afce970a9ff182697a5b6faf1a544e254fdbb288144eaf8fb9620d1b4d","observation_id":"fd82672e-ccf4-43fe-b69c-90c64bfdad9e","resolution":{"observed_at":"2026-08-12T13:43:17.944728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.925941Z","title":"LASP: Text-to- text optimization for language-aware soft prompting of vi- sion & language models","venue":null,"work_id":"b6f49379-8b82-441f-aac2-fac04a587590","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.040045Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:cef310bc38f20c9f6be6ca3073c358d56229b9df6af1d4bdd1c3b4718697b197","observation_id":"51ff15e1-ac32-4a44-b269-452f71b17b76","resolution":{"observed_at":"2026-08-12T13:43:17.930524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01253","last_updated":"2023-02-09T23:26:37Z","snapshot_observed_at":"2026-08-10T02:29:50.187262Z","submitted_at":"2022-10-03T22:21:07Z","title":"PLOT: Prompt Learning with Optimal Transport for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01253","snapshot_observed_at":"2026-08-12T13:43:17.045176Z","title":"PLOT: Prompt learning with optimal transport for vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.045176Z"},"links":{"cited_paper":"/paper/2210.01253","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:fdbf0719fb52c9bdf8bb72c8baa8180c0728efad23f47dde8c8d78ed51de0afc","observation_id":"7a8d533c-9ec1-4fc1-ad0f-02587bfbd8c4","resolution":{"observed_at":"2026-08-12T13:43:17.045176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.911219Z","title":"TokenMixup: Efficient attention-guided token-level data augmentation for transformers","venue":null,"work_id":"1573cd3b-d7cf-4d9d-ac84-1df298e7d873","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.050206Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b732e54e8aa0216eca01e017a1bb3ab6a75a77cd17bd5b600b32fa21317b8479","observation_id":"3efc590f-1de9-4236-a803-efd263daf65f","resolution":{"observed_at":"2026-08-12T13:43:17.916082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.054542Z","title":"Describing textures in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.054542Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:89a0da2301f43afcd8c1b348d5239b412068cacbab3aa3e15bd64f6515b871c7","observation_id":"1870c37e-896f-4d09-969a-6dc9bda195b8","resolution":{"observed_at":"2026-08-12T13:43:17.054542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.888952Z","title":"RandAugment: Practical automated data augmenta- tion with a reduced search space","venue":null,"work_id":"9593a45b-6621-481a-b5c5-a2059c7b4200","year":2020},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.058792Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:a579bd27a2356afa0c4472c0c60664cbe24e6bbbefd507662d55cd31cfc65526","observation_id":"cb40b0d5-8171-4c8f-b272-8731edb20110","resolution":{"observed_at":"2026-08-12T13:43:17.893660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.874912Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"8a54ef42-77c2-4614-97df-dcb1377af7f8","year":2009},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.063277Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:77b823206f4accc3b4d1f8b88119643c26650dd0330e630e80bde4c4910ff460","observation_id":"89c20a9d-c461-4792-ae7f-897101ddb70c","resolution":{"observed_at":"2026-08-12T13:43:17.879614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.860339Z","title":"Bayesian prompt learn- ing for image-language model generalization","venue":null,"work_id":"9fb2d502-3a27-4b10-8b8e-c5b37e398e01","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.068725Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:09afca0e610bc8aa47076467ff722287a37b55374af40aedf6d0d978112cc02c","observation_id":"6cb34863-c9a6-4791-b571-1d395c1c7e84","resolution":{"observed_at":"2026-08-12T13:43:17.865278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.073193Z","title":"De- coupling zero-shot semantic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.073193Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:00cf946b5cfbc91a1177b11c58a6eef121ce07f10ad9493db7b5c4c11970bfdc","observation_id":"dbeff9d6-0a42-42f2-9ff6-e10f89f3f288","resolution":{"observed_at":"2026-08-12T13:43:17.073193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.835524Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"f0cabeec-ae74-42da-8acc-840ff81707d2","year":2004},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.077918Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:e1860bf4c63bb0eae04884b58368cfcae714aaaec22c98512420ebacbcc09df5","observation_id":"637af28f-0763-4930-9825-376404253760","resolution":{"observed_at":"2026-08-12T13:43:17.840574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.819444Z","title":"Prompt- Det: Towards open-vocabulary detection using uncurated images","venue":null,"work_id":"4fe69e26-e6e2-49c9-9898-cf154987eb04","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.082410Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:9f0d91c6501636ea2f725169250e4663280557e003b2e52f3244f240b3d65bd5","observation_id":"a0d50bc8-aed7-4d12-b9fe-3bba72eff8b7","resolution":{"observed_at":"2026-08-12T13:43:17.824676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.804633Z","title":"StyleAdv: Meta style adversarial training for cross-domain few-shot learning","venue":null,"work_id":"6f5234e5-22bf-4175-8e1a-4f1a762c67d2","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.086972Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:9c6601c8249a1430539eaa599564fe7611aa86d2d0ce884810c8f849064d28bf","observation_id":"e99bd2ba-65d9-4e89-b62c-d1c9e880227b","resolution":{"observed_at":"2026-08-12T13:43:17.809229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.790658Z","title":"CLIP-adapter: Better vision-language models with fea- ture adapters","venue":null,"work_id":"c7b951b4-5cca-42f5-9a61-0bce01be7fa5","year":2024},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.091763Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:8d825d919a59f458e9c6066fe526ec20414258b79e8e18e5dbca4f6755a4aaa3","observation_id":"a4318924-287e-4ccc-9da7-d2a8d6fff95e","resolution":{"observed_at":"2026-08-12T13:43:17.795197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.776453Z","title":"CLIP-S4: Language-guided self-supervised semantic seg- mentation","venue":null,"work_id":"3ff184c2-ff5f-4601-aceb-a87a7b137fe7","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.096225Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b9b0ce03351e8594abf486ae3379d507071b91cb7259e6636393c851d1ec20cc","observation_id":"02b751f5-f2f7-4f3a-9eaf-7c6ae1e348fb","resolution":{"observed_at":"2026-08-12T13:43:17.781297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.762629Z","title":"EuroSAT: A novel dataset and deep learn- ing benchmark for land use and land cover classification","venue":null,"work_id":"50a8abf9-3d26-4e32-ad5d-9b72b2059bff","year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.100731Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:61f191195121bb78f8802e14fdd82335ab19f40b210d02ab9f44bcc335551347","observation_id":"ab84ac1e-a08f-4e4e-8d1a-f6de3b5a99a1","resolution":{"observed_at":"2026-08-12T13:43:17.767056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.105137Z","title":"The many faces of robust- ness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.105137Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b03cb3940ff40fc73c1f2829b9c57580987a590c1b4b527a782d985de957e905","observation_id":"afb63f31-85d0-4d7f-a7d1-4e0f4ef41933","resolution":{"observed_at":"2026-08-12T13:43:17.105137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.109370Z","title":"Natural adversarial examples","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.109370Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b898b35b3d57f2d8ef88997a42670d3d6070d5948afada8b1e072c6c8fc8f7e8","observation_id":"c7e895f4-a907-4f40-8ea1-7ccb77a3c558","resolution":{"observed_at":"2026-08-12T13:43:17.109370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.731574Z","title":"StyleMix: Sep- arating content and style for enhanced data augmentation","venue":null,"work_id":"81174aba-3ccb-41d5-a0e1-53ff7e1aaca9","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.113689Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:91ed270d2a68faf01426b7c5b0c7b452d12459035535911ea44554cec4605631","observation_id":"2a2002b5-8f92-4853-9afe-eac001718b41","resolution":{"observed_at":"2026-08-12T13:43:17.736038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.717835Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":"83989ebb-db11-48bc-a47d-35a01a3cab21","year":2017},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.118103Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:df7f48232c068ea509543c2b2690b202e66f60e297bcdf63652bd7329b8d0987","observation_id":"b7b472c8-5e91-4f12-8e49-823b94a887b7","resolution":{"observed_at":"2026-08-12T13:43:17.722125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.122464Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.122464Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c7d2fa13b50ddb9c361163ba249875cdd994775169f945f0120fbc0e1be02b66","observation_id":"cefd05dc-3dfe-4d98-8c0f-9843819bf688","resolution":{"observed_at":"2026-08-12T13:43:17.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.694176Z","title":"MaPLe: Multi-modal prompt learning","venue":null,"work_id":"4b0435a2-0b52-4f51-915a-03405881b838","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.127110Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:acb05ce9761c9f163c6e6b45b2a57f6dce20e694a23af250068be5850dd9a2c2","observation_id":"73fc887c-2cd0-44c2-9a1e-ca0cb7e2374e","resolution":{"observed_at":"2026-08-12T13:43:17.699074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.680020Z","title":"Self-regulating prompts: Foundational model adaptation without forgetting","venue":null,"work_id":"31e84f8a-9252-43d2-a33e-24df01d44464","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.131422Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:b9911fed8fc5a85e71485ce9c3e88fdf94b096e26d600f3e9e0d7bcb77ee9331","observation_id":"32512aff-3ad6-4c9e-abdb-fb8f8ab6c0cd","resolution":{"observed_at":"2026-08-12T13:43:17.684468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.664634Z","title":"How to adapt your large-scale vision-and-language model","venue":null,"work_id":"b46bb83f-3099-40cb-839c-49313c107547","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.135707Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f028aeb5721d19a656cea38bb085a8428f1a2a3f617514260f805aad2d1166bb","observation_id":"8d4dc1da-979d-4d9b-9736-531dd085eb29","resolution":{"observed_at":"2026-08-12T13:43:17.669396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.649558Z","title":"3D object representations for fine-grained categorization","venue":null,"work_id":"496e183c-988a-4470-b5a9-261c583d76ce","year":2013},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.140436Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:fd94afaef345a6a2c162ddc232f8f36bf2ba9362834ba8898ec72b58c1e520ae","observation_id":"c83f340d-f7d6-4d11-af8d-2be212f13440","resolution":{"observed_at":"2026-08-12T13:43:17.654574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.634417Z","title":"Cross- domain ensemble distillation for domain generalization","venue":null,"work_id":"af9b3f57-bea4-49cc-b83c-40daddc39021","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.145878Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c7b39d38ea2ced2f37e4e88789a31184d1872071096777726d81fe07da664206","observation_id":"bb0b007c-de1c-4c0e-a7b9-152d3d9970f9","resolution":{"observed_at":"2026-08-12T13:43:17.639530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T13:43:17.151021Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.151021Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:fa3758e351898425defddd6409b0c85e8cbe0978a73137e018e2d384f2b512b7","observation_id":"16677cc3-1d28-479a-a337-38b02df588c7","resolution":{"observed_at":"2026-08-12T13:43:17.151021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.620020Z","title":"Prompt distribution learning","venue":null,"work_id":"fcf14b6e-2bca-4b1b-a859-e915521e6c2d","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.156378Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:1cb8631778480f24e27723143558544fa78a11d18799200988c8db7e5e4e0d2a","observation_id":"c2b3d254-1e27-4b9e-bc63-4071bf98b636","resolution":{"observed_at":"2026-08-12T13:43:17.624321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-12T13:43:17.161247Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.161247Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:6cc583a8aff2c99fae871f3ebc75ca71a8a326768c7fb5dc6ac2954e608260ed","observation_id":"f3176a53-d0bb-4522-988b-80b680365948","resolution":{"observed_at":"2026-08-12T13:43:17.161247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.605602Z","title":"I2DFormer: Learning image to docu- ment attention for zero-shot image classification","venue":null,"work_id":"caa78a7a-3e51-4e7d-bf44-30592c5e6fa2","year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.165941Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:67c884098404e9bdec3b27a5df18f13f5ad9f5edeca21357a707e066cfc607de","observation_id":"340f13ab-c3f6-48ac-8554-311d550bc91e","resolution":{"observed_at":"2026-08-12T13:43:17.610290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.170393Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.170393Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:1c577a00aab9be8f75291f79d602a9445b4f08e2cb7989f3f455ec50dbbc42be","observation_id":"e2549246-3e49-46f0-a567-d284c6e64216","resolution":{"observed_at":"2026-08-12T13:43:17.170393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.581202Z","title":"Cats and dogs","venue":null,"work_id":"7d9bcb04-5531-4154-adf8-71eed33dc5c1","year":2012},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.174943Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:433dc33c19ada3154f30febc67c4757f0005e7bf2d1fccf36fc7f87f85a6ae4a","observation_id":"45bd7b0c-e5ef-4f0d-801c-d1b588bea9bd","resolution":{"observed_at":"2026-08-12T13:43:17.586386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.565275Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"a52c697b-47cb-48ec-8e7b-5984a1edfc6c","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.179500Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:5ff11a9e1bc590f6eba428dd10a53dd71b5160c7ac6a92a1c526bbf0aada5707","observation_id":"0061fe7d-4958-4299-84ed-7048782bf1f8","resolution":{"observed_at":"2026-08-12T13:43:17.570187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.549774Z","title":"DenseCLIP: Language-guided dense prediction with context-aware prompting","venue":null,"work_id":"ca1b3469-6e11-4449-abd9-fb95a62855ea","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.183781Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:44d4f5cf6bb732469d4b03d70c4d5fcaa3c193b3debfface60ec8b5541f22a8e","observation_id":"be973264-c81e-4e24-9203-e1a03b0e5842","resolution":{"observed_at":"2026-08-12T13:43:17.554335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.535241Z","title":"Fine-tuned CLIP models are efficient video learners","venue":null,"work_id":"06dd8627-edd4-410d-abcf-83a3db4afe29","year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.188175Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:05f59b224d89edd5a15f205bbb60bcf50ad7068654e82d8673f72c823825011f","observation_id":"abbb866d-e1d7-40d3-adb1-4b0c9918609e","resolution":{"observed_at":"2026-08-12T13:43:17.539984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.520510Z","title":"Do ImageNet classifiers generalize to Im- ageNet? In International Conference on Machine Learning, pages 5389–5400","venue":null,"work_id":"60e18305-d892-47cc-b560-4a38cffcc7c2","year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.192526Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:7d3ca0806475a38f56bcd9f9fd844fa1001b68a8f430d83174df6ef852d2f6cc","observation_id":"bad5c5dd-fa5c-4c5c-bfeb-77488c61b008","resolution":{"observed_at":"2026-08-12T13:43:17.525589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01195","last_updated":"2024-08-03T18:48:43Z","snapshot_observed_at":"2026-07-06T15:36:56.786182Z","submitted_at":"2023-06-01T23:20:47Z","title":"Consistency-guided Prompt Learning for Vision-Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01195","snapshot_observed_at":"2026-08-12T13:43:17.196914Z","title":"Consistency-guided prompt learning for vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.196914Z"},"links":{"cited_paper":"/paper/2306.01195","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:0c8fc882ac66eada4bcfe0f64a934c4f4e2e8824c1c88a648498452039141d22","observation_id":"10dc5289-f6bc-43a1-bd77-f95113efe67c","resolution":{"observed_at":"2026-08-12T13:43:17.196914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-12T17:34:19.526460Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-12T13:43:17.201302Z","title":"UCF101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.201302Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:51953a8d74a71c27ec99cf09b54040e254bd71da2d95dfc3e599ed1390cee54f","observation_id":"ee464c62-9fcb-4972-ad23-d4f51f2cd4bf","resolution":{"observed_at":"2026-08-12T13:43:17.201302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.506057Z","title":"Dropout: a simple way to prevent neural networks from overfitting","venue":null,"work_id":"32860cfb-1828-401f-ae14-2b24c9f96b3b","year":1929},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.205994Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:896cb2ef03320d86da67af657e841c5e00f2ef2856c6b552f06afa0482fe178d","observation_id":"81fa0f43-5c55-4bd1-b9e0-926c0840b46e","resolution":{"observed_at":"2026-08-12T13:43:17.510776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.210455Z","title":"Multimodal few-shot learning with frozen language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.210455Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:495ff4440962f34cab8cdeec0de94af2a83b6fbe79e9e44e989ea25c5930214d","observation_id":"07bded2c-1812-4283-9e73-3f1e23206a40","resolution":{"observed_at":"2026-08-12T13:43:17.210455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.482231Z","title":"Calculation of the Wasserstein distance be- tween probability distributions on the line","venue":null,"work_id":"86fb5f24-4177-4f56-8955-e174b7473baa","year":1974},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.215154Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:0285c62c72d65f3013e246d0d87e47ec7bb59e85a58e7cc434dea6e4f34b0d6a","observation_id":"fd2486e5-b147-4d31-817b-22b2942e8b0f","resolution":{"observed_at":"2026-08-12T13:43:17.487076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.219519Z","title":"Learning robust global representations by penalizing local predictive power.Advances in Neural Information Pro- cessing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.219519Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:67e39f6d0018eafff4e2c60f77a27dfd96a7c0e117805934dd1fbca8ef775643","observation_id":"f79c5157-f452-460a-a4e6-03f430ca325e","resolution":{"observed_at":"2026-08-12T13:43:17.219519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.458815Z","title":"Feature- based style randomization for domain generalization","venue":null,"work_id":"61e03566-f3bb-4d8b-a21b-4b070a0b91e4","year":2022},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.223587Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c107afa9734701dbb158626a9a40650a763b3f78121cb7f88c8524f2a2396f64","observation_id":"95100914-fa1a-4868-88bc-5f4cad3e6026","resolution":{"observed_at":"2026-08-12T13:43:17.463746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.443799Z","title":"SUN database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"d3e90cb3-9022-4268-b55b-c6623872ce53","year":2010},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.228072Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:07f1b57fe914fbf34ae5f096b4f49445cfe9f68d298fb39b24880646aaf971f0","observation_id":"0436bb29-7b48-4bf6-9260-13c3225f5c70","resolution":{"observed_at":"2026-08-12T13:43:17.448583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.428864Z","title":"MMA: Multi-modal adapter for vision-language models","venue":null,"work_id":"f70d8259-c26e-4438-ac65-02cc9d57b736","year":2024},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.232505Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:c155eccda536cff18a41ca06787581920b522957a18da1cf41aa05957e5adeeb","observation_id":"7df83f5d-6dec-4e2c-a0ee-f11827727ee5","resolution":{"observed_at":"2026-08-12T13:43:17.433726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-12T13:43:17.237195Z","title":"FILIP: Fine-grained interactive language- image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.237195Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:db4bd98036245467b27d35228382edec312fb687718fa5747834d668d99955b6","observation_id":"b19e2ac0-7835-4940-8197-219afc716d48","resolution":{"observed_at":"2026-08-12T13:43:17.237195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.410705Z","title":"Barlow Twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":"8282ffa4-e807-4878-8f81-7f3d826c9144","year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.242155Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:2b669ec808f815165dc2e22a405f0c8354965c7794fa40bb553c9cf189a70be8","observation_id":"8540c76e-078d-4324-b728-6eedc0780908","resolution":{"observed_at":"2026-08-12T13:43:17.417580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.246354Z","title":"Conditional prompt learning for vision-language mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.246354Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:460d6f5091aa725874b8e821e6bfb96354380739724627b68acbfd0b454d1ff3","observation_id":"1e69d658-16df-49b6-abc0-3dd8f44c904c","resolution":{"observed_at":"2026-08-12T13:43:17.246354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:17.251062Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.251062Z"},"links":{"citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:d7417216cd027c4f7a5a6c2027cf55d407145581eb1353f784fb5d35197f7154","observation_id":"d09415e4-1066-4c7c-9166-48f2bd54f83a","resolution":{"observed_at":"2026-08-12T13:43:17.251062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02008","last_updated":"2021-04-05T16:58:09Z","snapshot_observed_at":"2026-08-10T09:28:28.538323Z","submitted_at":"2021-04-05T16:58:09Z","title":"Domain Generalization with MixStyle","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02008","snapshot_observed_at":"2026-08-12T13:43:17.255931Z","title":"Domain generalization with MixStyle","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:17.255931Z"},"links":{"cited_paper":"/paper/2104.02008","citing_paper":"/paper/2411.16018"},"observation_digest":"sha256:f80152e427d51e33f2cbcc3b35dd332e31134a3212e69adff6d364227de4da55","observation_id":"5cce0ce8-e5b3-4884-8985-46150e3aa315","resolution":{"observed_at":"2026-08-12T13:43:17.255931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16018","last_updated":"2024-11-25T00:20:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:35:38.512073Z","submitted_at":"2024-11-25T00:20:53Z","title":"Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.16018."}