{"as_of":"2026-08-08T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0fdc27bed7b2f9cb3b5ec36ea54904a4fe6403b92427d753554b283be22ab39","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:56:32.082419Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.17417/citation-record","integrity":"/paper/2508.17417/integrity","json":"/paper/2508.17417/citation-record.json","paper":"/paper/2508.17417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:21.313379Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.313379Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:41a765932a0a16fcd588a4874bd373ccc98218e66522e223522ddcf05767361e","observation_id":"c8c8c761-ad66-4996-b2ce-87ff1215eb9b","resolution":{"observed_at":"2026-08-05T16:56:21.313379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-05T16:56:21.422372Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.422372Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e366dc95451a708fff03b9a76fb1d7745e8fb4772b10d55a0e63e4ddb423a5f7","observation_id":"49d06e05-f51c-4b05-9f73-6163a0c31e9f","resolution":{"observed_at":"2026-08-05T16:56:21.422372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:52.344867Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"f5579981-797d-4cc8-a2c1-72f6c89fedcc","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.591992Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:f5bcb3cd26718f54e9ec96c1732285c9377c1e8c3d73436c9d79ebca6d86242c","observation_id":"535f3df9-4666-4195-bd9d-62db10446307","resolution":{"observed_at":"2026-08-05T16:56:52.514923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:52.024753Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"520ddc24-09d8-4455-bba7-1b6567f8b73b","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.743402Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:2b450978ee3fc86a19aa3b66b29c0e0d4234b5516e70f3670338f32ecdc9f4d4","observation_id":"f337120e-bdcf-4e9d-b258-fbfc93d83714","resolution":{"observed_at":"2026-08-05T16:56:52.161408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:51.568671Z","title":"Lit: Zero-shot transfer with locked-image text tuning","venue":null,"work_id":"3635943d-d2ea-4414-a69d-6654ee8292a0","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:21.893229Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:3fab629dd7764d9112db074188324e92703b11160b337059c11c0ea7049289b8","observation_id":"444680d6-705b-4c17-91d2-b07e5e8d7d0f","resolution":{"observed_at":"2026-08-05T16:56:51.754742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09592","last_updated":"2022-12-22T00:55:29Z","snapshot_observed_at":"2026-08-07T00:31:48.017638Z","submitted_at":"2022-06-20T06:43:17Z","title":"DALL-E for Detection: Language-driven Compositional Image Synthesis for Object Detection","version":3},"cited_work":{"arxiv_id":"2206.09592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.09592","snapshot_observed_at":"2026-08-05T16:56:33.732887Z","title":"DALL-E for Detection: Language-driven Compositional Image Synthesis for Object Detection","venue":"cs.CV","work_id":"8bacb058-6101-44b9-ac0a-3a631169d70c","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.048767Z"},"links":{"cited_paper":"/paper/2206.09592","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e0d09f9f3dca38285433c1a2004d21ffee3d72c35c14a8f8da578cf6e36ea261","observation_id":"fedcb52c-a8fe-474e-8af8-b00f2394a436","resolution":{"observed_at":"2026-08-05T16:56:33.907280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:22.274493Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.274493Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:17e6271108822e970fdd8ca5ae672157543c7b042dbd366cc22033030faf04dd","observation_id":"ea4060a8-f1bb-4b42-8c49-bdace9083d96","resolution":{"observed_at":"2026-08-05T16:56:22.274493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:51.294753Z","title":"A survey on bias and fairness in machine learning","venue":null,"work_id":"75a66374-169e-4432-b702-b2a25998dc02","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.423039Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:62a9f05d4e064de8f976a47e1513775acf1f5f0757e3474b72172d78f7a0eb20","observation_id":"63dce2e1-fdfd-4838-bfc9-4936db10418b","resolution":{"observed_at":"2026-08-05T16:56:51.394859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04412","last_updated":"2022-12-08T17:10:31Z","snapshot_observed_at":"2026-07-06T14:28:25.630901Z","submitted_at":"2022-12-08T17:10:31Z","title":"Task Bias in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04412","snapshot_observed_at":"2026-08-05T16:56:22.558215Z","title":"Task bias in vision-language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.558215Z"},"links":{"cited_paper":"/paper/2212.04412","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:acd92209478fbbcfa1842365ff5da3ec13c7e8f1c384cbfe7dccfa90b1e44325","observation_id":"950e7d10-0b9b-48e0-8b71-d01cd5288f81","resolution":{"observed_at":"2026-08-05T16:56:22.558215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02818","last_updated":"2021-08-05T19:05:57Z","snapshot_observed_at":"2026-08-07T23:14:14.994634Z","submitted_at":"2021-08-05T19:05:57Z","title":"Evaluating CLIP: Towards Characterization of Broader Capabilities and Downstream Implications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02818","snapshot_observed_at":"2026-08-05T16:56:22.655634Z","title":"Evaluating clip: towards characterization of broader capabilities and downstream implications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.655634Z"},"links":{"cited_paper":"/paper/2108.02818","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1f9916fa41e51a728fb903a0caff7017f298f9e3999343bfe877bf26f50060ea","observation_id":"e1bda523-21bc-4b8a-b8b2-d5126c285824","resolution":{"observed_at":"2026-08-05T16:56:22.655634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.944754Z","title":"Visual classification via description from large language models","venue":null,"work_id":"bb903f3d-0e46-4702-b49f-16a045863b28","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:22.855317Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:02765c15c9ab6d50e41ae55e81c4fe8e863d10104cbfbff40ae1ed36aaa1d67a","observation_id":"733d2098-bd7c-456f-b247-911f22669ad5","resolution":{"observed_at":"2026-08-05T16:56:51.083626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12952","last_updated":"2024-12-10T22:53:16Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:54:34Z","title":"Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12952","snapshot_observed_at":"2026-08-05T16:56:23.006176Z","title":"Just shift it: Test-time prototype shifting for zero-shot generalization with vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.006176Z"},"links":{"cited_paper":"/paper/2403.12952","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:1292eca6cd887f869216b23bb10bd142f8b94f7542f9536c3a2650ec9297839d","observation_id":"b3a4d953-ec17-4a30-bfcf-5886d277c139","resolution":{"observed_at":"2026-08-05T16:56:23.006176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.674752Z","title":"Awt: Transferring vision-language models via augmentation, weighting, and transportation","venue":null,"work_id":"d75df83b-56cb-4bea-9a68-c0e2d37234e6","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.135856Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:334d7a6f10f701c4698aa2d13a47c1d38e7d2de25bb4c9faf11b7617f57d64a9","observation_id":"21327a27-b384-4928-b820-05b35c3de49b","resolution":{"observed_at":"2026-08-05T16:56:50.804844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:50.354756Z","title":"The neglected tails in vision-language models","venue":null,"work_id":"87dee6fa-af7f-442d-a137-c4168ed23e72","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.299058Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:434ece4fab8d005f3d8c68742f51ef246dd1f57b62d1b2c062615ed410b10c65","observation_id":"1d4a1ff4-6500-4f54-8d65-6b795edbab0c","resolution":{"observed_at":"2026-08-05T16:56:50.494769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02915","last_updated":"2024-06-05T04:08:41Z","snapshot_observed_at":"2026-07-06T18:25:40.229186Z","submitted_at":"2024-06-05T04:08:41Z","title":"Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2406.02915","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02915","snapshot_observed_at":"2026-08-05T16:56:33.417358Z","title":"Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models","venue":"cs.CV","work_id":"2252ac60-a7d7-4907-9f08-fb428f677531","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.425788Z"},"links":{"cited_paper":"/paper/2406.02915","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a09f3905089e7c40ecd6736332b92e51ff6dee220307c137d688e3581b283e55","observation_id":"d1dd3986-f640-441f-a1c4-83afc3a06ec3","resolution":{"observed_at":"2026-08-05T16:56:33.495768Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:23.536646Z","title":"The claude 3 model family: Opus, sonnet, haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.536646Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:04934fe489492aae3d45b9ea0426f3779a53a3ed7fcf0ed2c8f026fd359ed568","observation_id":"d01b4a18-1960-4149-9125-0e066e4284df","resolution":{"observed_at":"2026-08-05T16:56:23.536646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T16:56:23.637996Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.637996Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a5d630e381c45b7e2205f8d5037fe10bcec3f793c73408e33846f3164ec2c120","observation_id":"37673094-b179-412c-a7d8-72487fa37f80","resolution":{"observed_at":"2026-08-05T16:56:23.637996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:23.736980Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.736980Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6b3c056e14bcf6ed7bbeaecd9f7b53602c495359c6f85bde957a1c0c02bbce6d","observation_id":"d13cb8ba-6a9b-478e-a49d-0433020fb721","resolution":{"observed_at":"2026-08-05T16:56:23.736980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.878638Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"31a4f6a5-e58c-4976-886c-019537f25075","year":2008},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.838694Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6e40373dfc37fc115e4cf51d3dd9d496467dba47f12d9a74ca5576e5d827b466","observation_id":"6748b9da-eedd-4c05-986b-5ad593168133","resolution":{"observed_at":"2026-08-05T16:56:50.027254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.524756Z","title":"Describing textures in the wild","venue":null,"work_id":"888e0d52-4951-46db-9666-223e36b2356f","year":2014},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:23.966463Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e76b71d747342e604f93bc35010e4a58077fe89ed3042f99872ab5baca362f75","observation_id":"97f8ab56-a535-4925-91cf-72aaa9062510","resolution":{"observed_at":"2026-08-05T16:56:49.684771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:49.165923Z","title":"Cats and dogs","venue":null,"work_id":"f4705eea-32fa-4390-a60d-5f253a8ddbfa","year":2012},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.137558Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:782b1beec2752373e30f0c45bf905ea34bff448a5b190b2fd6cfc1c2e26f07c3","observation_id":"350e58c3-6883-4945-ab16-8c10f95562b8","resolution":{"observed_at":"2026-08-05T16:56:49.314756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.866823Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"2d226a7d-d694-42f7-b2ab-a25d9e4c7881","year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.227495Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:0353070749e3bbf9eb7b5bfed0992ede8ed67afbbf280150310f27deb5d3d917","observation_id":"aa874e91-d946-4842-9a99-44eb59cc262f","resolution":{"observed_at":"2026-08-05T16:56:48.995360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T16:56:24.374740Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.374740Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a1ca85ababff52da937b19a0bb196d14ec774e837c0ea78498bb015ec736ff7d","observation_id":"30453b8b-c72a-4709-b123-fec286be3094","resolution":{"observed_at":"2026-08-05T16:56:24.374740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.554791Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"7a568810-68f8-44d7-91ef-b70d665d2895","year":2004},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.498592Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7956a826e0f3fc24540f247137ba96245eed85bef2518fd08d4a889afbaae2d0","observation_id":"84836bb8-79bf-46cc-88e8-80dbed42f68f","resolution":{"observed_at":"2026-08-05T16:56:48.675055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:48.243387Z","title":"Food-101--mining discriminative components with random forests","venue":null,"work_id":"00ea9e88-22b4-48aa-b6f2-6afcb547e7cd","year":2014},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.642439Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:3816d69f7447c96bb1904e1ca903796a1940c3dc05cfe9063209d0cdc721ba8f","observation_id":"72cfc87d-a211-49da-a58a-6d12178fb360","resolution":{"observed_at":"2026-08-05T16:56:48.373659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.874756Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"28804674-8ba3-49d4-a5f5-f85b94d225f9","year":2010},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.802819Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:99ffa76971c934eba86d2c33fdce3caa7645554f0fb4518bf725823154ddfa3f","observation_id":"29dafd16-603a-430d-89e8-bd3f322c4459","resolution":{"observed_at":"2026-08-05T16:56:48.017076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-05T16:56:24.991347Z","title":"Fine-grained visual classification of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:24.991347Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e6700796a43414fc37663ec5fee85bda464cfb4bd43bc08b2aeb747954d35dfd","observation_id":"fa459683-3112-4396-9c2b-c4b4c9f95477","resolution":{"observed_at":"2026-08-05T16:56:24.991347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:25.113859Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.113859Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e1865849536db6066544c4209b6a3db523bb11de8d9e61fd58c4c9fef2b5fccf","observation_id":"4465be75-9d42-4543-ab10-440b8894d4ec","resolution":{"observed_at":"2026-08-05T16:56:25.113859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.474757Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"cc2b644d-d75d-4570-948c-bb834fadead3","year":2009},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.271660Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:60b8105c14ace5bb96bcd67153b940983688641642a7c824a90f0989b3837910","observation_id":"eb007dc9-b3c0-4b03-87c5-c27d13ee8fb3","resolution":{"observed_at":"2026-08-05T16:56:47.604881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:47.134832Z","title":"Natural adversarial examples","venue":null,"work_id":"f88c27b4-4eb1-436a-91d2-84d7e6b9d292","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.406558Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:dee585d69ced6a721f6a621ce8e8bab3c2f537128147462e3384dea13b1b7adc","observation_id":"47e34d39-a541-4131-8b4f-a0f5c48a95c1","resolution":{"observed_at":"2026-08-05T16:56:47.254755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:46.794753Z","title":"Do imagenet classifiers generalize to imagenet? In International Conference on Machine Learning, pages 5389--5400","venue":null,"work_id":"2ccd0f34-2c01-46bb-81f1-7d1503aa7d6d","year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.563571Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:40a6a2e567a7e39422922eafcd7798bebdff61bb8488cf82374c60433a08cb02","observation_id":"eb5b3199-40b2-4d6f-afcb-874810b4b83f","resolution":{"observed_at":"2026-08-05T16:56:46.915058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:46.345710Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"749dd0de-156f-4634-a251-c9d87a3dfece","year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.696304Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6b6970df27c327e30fbf2acaf510571741dda95012cbd9903f07a1f2b1127a90","observation_id":"22055c34-0c71-4c59-ab45-d8d4db1e978a","resolution":{"observed_at":"2026-08-05T16:56:46.524575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:45.854938Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"e98a9281-9e15-49f1-b6cc-b79c74de4d1d","year":2019},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.878557Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:133d768183b03ee5ae9995ca2d2b080301722a9b828582f8b1b7e636f1e141d1","observation_id":"1aa43631-29df-4431-b812-436722748aad","resolution":{"observed_at":"2026-08-05T16:56:46.044755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:45.434797Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"3b27f3f8-5f23-40a1-b355-500a787dd452","year":2011},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:25.986884Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:4a18df6a214c75759a71df98f802b509110c95891c023c15c0e6bb21e9cbee6a","observation_id":"b03099b8-b08a-4c78-942d-f26cb9c98bb9","resolution":{"observed_at":"2026-08-05T16:56:45.604758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.01340","last_updated":"2018-08-03T20:17:05Z","snapshot_observed_at":"2026-07-06T06:54:00.483796Z","submitted_at":"2018-08-03T20:17:05Z","title":"A Short Note about Kinetics-600","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.01340","snapshot_observed_at":"2026-08-05T16:56:26.108454Z","title":"A short note about kinetics-600","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.108454Z"},"links":{"cited_paper":"/paper/1808.01340","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:3127913c14f140cab775b2a76160b0db064cfe5208f03b568442af0f2b2006b6","observation_id":"87b72080-6e1b-4771-9341-0724feb56a35","resolution":{"observed_at":"2026-08-05T16:56:26.108454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.954853Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"6dc374ed-cfa4-4ed6-bbca-577e0481d58c","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.457794Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:32ad612ff49593466f0942a2608698d1f78f1d2d002126558fb344c4c0ffca22","observation_id":"51feb682-3833-42f2-9c18-4da66ec5a487","resolution":{"observed_at":"2026-08-05T16:56:45.094760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-07-06T15:08:34.018146Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-05T16:56:26.617118Z","title":"Eva-clip: Improved training techniques for clip at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.617118Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e45c662d25241426e6b07c8c344dda750ea7a88d35f5f90c64649360499d60c5","observation_id":"e6a312fb-d024-40b9-b282-71b5beeada23","resolution":{"observed_at":"2026-08-05T16:56:26.617118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03546","last_updated":"2022-04-03T03:33:43Z","snapshot_observed_at":"2026-08-01T06:14:31.660540Z","submitted_at":"2022-01-10T18:59:10Z","title":"Language-driven Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03546","snapshot_observed_at":"2026-08-05T16:56:26.737825Z","title":"Language-driven semantic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.737825Z"},"links":{"cited_paper":"/paper/2201.03546","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:dc48e03838648f92b08bbfd216e106bd29c6d9d310b90e99d9efed7785959d35","observation_id":"d509531e-ea47-4d57-9f4f-1ab5cf55e893","resolution":{"observed_at":"2026-08-05T16:56:26.737825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.614838Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"08b1b428-7f7a-4274-847c-547c7d861bb1","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:26.832904Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7ab38993d1eb62223422cf4a358aee7c71cdea5a190a7e68fc86921346cb311b","observation_id":"b3b14165-0be8-4381-8f76-d876bfdbbe44","resolution":{"observed_at":"2026-08-05T16:56:44.735087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:44.264944Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"39a92ebf-e6bc-4f74-bad6-98c08b79e8cf","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.011946Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:4fbc3bb10ccb89903510a4bcbb38cfd2be30782c8af3128bcd1390bfd3a784aa","observation_id":"563334ef-11ad-4e64-98ec-79d0b536f932","resolution":{"observed_at":"2026-08-05T16:56:44.375052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.954745Z","title":"Towards open-vocabulary detection using uncurated images","venue":null,"work_id":"dbfa9f77-3d60-45c9-8bbb-56d31ee7d761","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.163331Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:ede4aec2559c8cfd5b4432a477c02462cc38edc9a9f8fdaebf518550c43317cf","observation_id":"1f9fe65c-d619-4eae-a60a-1b683a003093","resolution":{"observed_at":"2026-08-05T16:56:44.064833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-07-06T11:04:30.929441Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-05T16:56:27.247293Z","title":"Zero-shot detection via vision and language knowledge distillation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.247293Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:64b896f62a5bc48b81cb64ac450997d0ff4f2738186fa28bf5d2002d82d9311f","observation_id":"ac8ad135-8559-48e8-98ee-91830211d1a1","resolution":{"observed_at":"2026-08-05T16:56:27.247293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.639118Z","title":"Learning to prompt for open-vocabulary object detection with vision-language model","venue":null,"work_id":"2206ba3a-b4fa-49b3-9222-a18b10dceca9","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.312753Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:9b349f8ddab7d03d556cec61239ab2d2ca8744b428f68c783a875043f9e836c1","observation_id":"d9606749-7dbb-4ed0-87ef-b19eba0a18e4","resolution":{"observed_at":"2026-08-05T16:56:43.775067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08472","last_updated":"2021-09-17T11:21:34Z","snapshot_observed_at":"2026-07-06T11:48:42.000083Z","submitted_at":"2021-09-17T11:21:34Z","title":"ActionCLIP: A New Paradigm for Video Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08472","snapshot_observed_at":"2026-08-05T16:56:27.442977Z","title":"Actionclip: A new paradigm for video action recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.442977Z"},"links":{"cited_paper":"/paper/2109.08472","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:d7bb06423905e1ef40ff45843a26e727ea09c1e234549257f649d80e487ba2dc","observation_id":"8793f05a-a5f2-4c71-9e9d-648154d60476","resolution":{"observed_at":"2026-08-05T16:56:27.442977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.397213Z","title":"Open-vclip: Transforming clip to an open-vocabulary video model via interpolated weight optimization","venue":null,"work_id":"12b1a0de-2f19-43dd-96a3-bcbca67c324e","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.573432Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:ea052c2e172106f2ca82cf03361492cb42ecfad473bbc4d665303da1a7db55eb","observation_id":"3386808a-79da-46f2-b10d-4833db01ad8d","resolution":{"observed_at":"2026-08-05T16:56:43.494835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03241","last_updated":"2024-02-05T17:56:41Z","snapshot_observed_at":"2026-08-07T04:24:11.074881Z","submitted_at":"2024-02-05T17:56:41Z","title":"FROSTER: Frozen CLIP Is A Strong Teacher for Open-Vocabulary Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03241","snapshot_observed_at":"2026-08-05T16:56:27.685761Z","title":"Froster: Frozen clip is a strong teacher for open-vocabulary action recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.685761Z"},"links":{"cited_paper":"/paper/2402.03241","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6d1075a842204608f3a07d3f9e76367ca44e60477692a1c75dffa2b339aeb9d1","observation_id":"2b572db5-e794-4d38-ab53-ae4b1e2c1363","resolution":{"observed_at":"2026-08-05T16:56:27.685761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:43.135940Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":"7bfb26d3-52f5-4e61-a1f9-d600a2a23695","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.832840Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e5b6bcff133b66ddf3ab2f4dd1de8643de212cf737111694ce15d800c3523ab8","observation_id":"a1b99094-d1aa-4767-bdbd-69d7ab0178db","resolution":{"observed_at":"2026-08-05T16:56:43.214755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:42.574752Z","title":"Language models are few-shot learners","venue":null,"work_id":"4d2d3b89-eae7-46ea-8d3e-146feef900a2","year":1901},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:27.982311Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e1c5d5853f839e6eea310420b392adb3a3c04d4a63e5b35d93109cd40ee2b66f","observation_id":"e9a25d44-8408-4a80-be51-7484593d9b16","resolution":{"observed_at":"2026-08-05T16:56:42.864740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:42.217109Z","title":"Waffling around for performance: Visual classification with random words and broad concepts","venue":null,"work_id":"7260d9b0-6b4a-43d2-8971-e2ed985eaebe","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.105132Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:33d062c7ebf5be329c4111a8fff3e9ca8671dacfe60f761d4c86204157cc8b5d","observation_id":"cdf0e85a-6eaa-46e5-976d-15cfb2d036e0","resolution":{"observed_at":"2026-08-05T16:56:42.384859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.800955Z","title":"Meta-prompting for automating zero-shot visual recognition with llms","venue":null,"work_id":"127f457d-59a2-426f-bb32-4f82ad6da303","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.235947Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a1fcbbacb96f217b1c1d60c4276af60c04f934af5195c43c005c9b436607dd13","observation_id":"f7062c60-c7c2-4c5a-aa40-969a595b6f70","resolution":{"observed_at":"2026-08-05T16:56:42.022718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.499088Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models","venue":null,"work_id":"1af92059-6f55-4b21-99b4-65f9d2b6b106","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.398019Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7b075af2a743f7ba217b987879c163730905cf75bb98e7183ddb7f1f296a794c","observation_id":"531f865f-dbd1-4d59-9f32-fa0c4dfa01e4","resolution":{"observed_at":"2026-08-05T16:56:41.637583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:41.124528Z","title":"Diverse data augmentation with diffusions for effective test-time prompt tuning","venue":null,"work_id":"b7742e1d-56e7-42db-a5c8-ceb4db2de65f","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.566663Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:c5d7c392d4dd06038be5067dfc05e3310c0e3a4ef08fa54e4b462f468eb95b15","observation_id":"c9e4580d-0947-4b49-9070-272edb50bdbb","resolution":{"observed_at":"2026-08-05T16:56:41.294760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.875974Z","title":"Align your prompts: Test-time prompting with distribution alignment for zero-shot generalization","venue":null,"work_id":"026795d1-3a92-4784-8f10-1a568ea340df","year":2024},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.703161Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:a350a26eface6304e694629f95c0baa79b1da110b98f2cbdf4baba62d06721b5","observation_id":"60608a08-bec1-467e-a586-9fb455c11135","resolution":{"observed_at":"2026-08-05T16:56:40.948684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.566596Z","title":"Test-time low rank adaptation via confidence maximization for zero-shot generalization of vision-language models","venue":null,"work_id":"6d2b88f9-cd54-4a2c-9c97-41dec5f8d7ee","year":2025},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:28.928978Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7d99b05ba5fab515867e0fd51001f816d2f84437213c2f5dc27cced4e5dd2551","observation_id":"5e9f55bf-d615-43a8-8448-82e2903e6215","resolution":{"observed_at":"2026-08-05T16:56:40.702424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-05T16:56:29.058468Z","title":"Siren's song in the ai ocean: a survey on hallucination in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.058468Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:7be8a3792d5c026ab0bd39294e40dd2a03a58ca6c9d6a3a9a0203463ed6b504f","observation_id":"be7368a7-1894-4fc1-abe5-fe285db8c13c","resolution":{"observed_at":"2026-08-05T16:56:29.058468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-05T16:56:29.199766Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.199766Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:26922a9d166cc033a14686f9263eeb56f45c9547179b8364fe4ae81bad70cb89","observation_id":"0c467758-f47d-4c81-9811-50d5004900ae","resolution":{"observed_at":"2026-08-05T16:56:29.199766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:40.255011Z","title":"Computational homology","venue":null,"work_id":"630abd97-9e01-4797-9703-d27dbe76e0da","year":2004},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.407524Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:8057c276b56817c145d8fab91f20436668519018d55ed57c8008a5e2cff2242b","observation_id":"c53674d8-f7eb-4eec-86a3-d271ebe29060","resolution":{"observed_at":"2026-08-05T16:56:40.404753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.962235Z","title":"Persistent homology: An introduction and a new text representation for natural language processing","venue":null,"work_id":"c5b3d83b-ed55-49a0-828f-56496632fdc6","year":1953},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.547863Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:f399675816c47e555569c1cdb28b26240555dc0182f39b0c3a051950faaf0e0d","observation_id":"59a768ed-b431-4267-8910-35970e90125f","resolution":{"observed_at":"2026-08-05T16:56:40.044760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.594755Z","title":"Statistics notes: measurement error","venue":null,"work_id":"0a494c2a-16e0-45e9-a54c-cae64e8fdaeb","year":1996},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.820360Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:618ce872216ed3754c682633a1c6eec3e13e5d6f51e9d509fcb9757246be95ee","observation_id":"081ff389-8b84-47c8-ac45-d34ebd4e9f64","resolution":{"observed_at":"2026-08-05T16:56:39.794839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:39.137690Z","title":"M \\'e moire sur la th \\'e orie des d \\'e blais et des remblais","venue":null,"work_id":"170fcb56-048f-4494-be8e-7f6e7d965c3b","year":null},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:29.950212Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:225326da68cab3dc14bfdae39e6f938bad1528143d0059a2b97ba958bb1a8b7c","observation_id":"27cc522b-b7dc-4cfb-89b6-020148ae89dd","resolution":{"observed_at":"2026-08-05T16:56:39.344859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.775037Z","title":"On the translocation of masses","venue":null,"work_id":"d052e575-45f1-4e1b-a9d5-84a73ca43872","year":2006},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.127605Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:71cfaab4fc80a2858ccc086e79b97ffee7dee9c3bacc95e2308fdd9c14dd05ee","observation_id":"471b29ad-11cb-47a7-9a2c-0e31d5a8936b","resolution":{"observed_at":"2026-08-05T16:56:38.965026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.404753Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport","venue":null,"work_id":"bb1fa353-ae89-45f9-aab9-7bd5b34b6c10","year":2013},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.264340Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:32169438b9506d176401354b707a671dfb36d751b2ec5b5bd81bbf6a1784615a","observation_id":"30111325-eaa1-468c-827f-69f862a0c641","resolution":{"observed_at":"2026-08-05T16:56:38.564863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04341","last_updated":"2019-06-11T01:31:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-06-11T01:31:41Z","title":"What Does BERT Look At? An Analysis of BERT's Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04341","snapshot_observed_at":"2026-08-05T16:56:30.457669Z","title":"What does bert look at? an analysis of bert's attention","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.457669Z"},"links":{"cited_paper":"/paper/1906.04341","citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:76db9670e5deba5c24ba43058bd5d3c8d90bed68c98f698738367bcc2b49e3c8","observation_id":"51e45676-51e1-4745-9dbc-899aa16c3c01","resolution":{"observed_at":"2026-08-05T16:56:30.457669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:38.114766Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"e9ca0ebd-a704-445f-b49c-10fa05c0711e","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.598383Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:036543d6811bbe5bbbec333e39e8fa38fe4e813007259401ff66160762c5143f","observation_id":"8a912ac3-f178-480a-b3ae-74df75eedd7b","resolution":{"observed_at":"2026-08-05T16:56:38.225174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.794755Z","title":"Plot: Prompt learning with optimal transport for vision-language models","venue":null,"work_id":"98ae0aae-67b8-4fe2-a7da-0ef4534f55d4","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.777577Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:e0c1521b0a116f3dffbaad5c4ad3bdcf321d4c763ec651daa9be85e9e3b24ff0","observation_id":"40fa3893-642d-4eb9-95ea-6916435ef972","resolution":{"observed_at":"2026-08-05T16:56:37.922607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.408069Z","title":"Prompt pre-training with twenty-thousand classes for open-vocabulary visual recognition","venue":null,"work_id":"7be20d48-c2e9-4708-84cd-295d36afee96","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.891428Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:d28ecd6ca49136d088055dbc36f7df6562f3a6930af09d5d8882ea1312679bea","observation_id":"fd94c28a-2e24-4521-b32f-07c9ce3acc89","resolution":{"observed_at":"2026-08-05T16:56:37.554832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:37.054863Z","title":"Progressive visual prompt learning with contrastive feature re-formation","venue":null,"work_id":"573b0143-f652-43e3-9ff1-7d7609ba94ec","year":2025},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:30.978988Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:8077bdc80515c88339eef114d3918452ba74fc2de43f76d17c831ba93f727164","observation_id":"d4a41edd-8e2c-42a6-8604-5dd005d8d848","resolution":{"observed_at":"2026-08-05T16:56:37.183790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.744754Z","title":"Sus-x: Training-free name-only transfer of vision-language models","venue":null,"work_id":"1b617e4d-9bee-46d5-bc4f-ff97f9aa8e69","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.161055Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:bc8b91e5d8b97c870e11109d71e32795bc4de600667db2534807ba1d5cf6de52","observation_id":"9c316020-d540-4431-9e06-1130128560b4","resolution":{"observed_at":"2026-08-05T16:56:36.834755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.294754Z","title":"Expanding language-image pretrained models for general video recognition","venue":null,"work_id":"ae72fe1e-5deb-4a6e-b343-60586182aedb","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.279343Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:54991212263819e1d0940c9128b30257cf20487b0831f87b8898d19008c565f5","observation_id":"2b9864b4-95cb-4eb0-afba-dd2048b66db8","resolution":{"observed_at":"2026-08-05T16:56:36.476755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:36.042286Z","title":"Aim: Adapting image models for efficient video action recognition","venue":null,"work_id":"45e04571-4cae-45d9-8e77-c33013039615","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.376546Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:ce3d3a004ad26817a13acadb0030a8383cc489d6f2ccebf3355f9cccd3f69474","observation_id":"6b8f0241-f31b-45f2-96f2-ba26ab718d33","resolution":{"observed_at":"2026-08-05T16:56:36.140739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:35.694756Z","title":"St-adapter: Parameter-efficient image-to-video transfer learning","venue":null,"work_id":"335c4dff-150b-41ea-9b0a-bee9aa034cdf","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.472482Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:efc502d58f6ed436c6574bdb1c5c32d1344666e6236932dfa1ccb85e57a14b37","observation_id":"fc34f552-a61e-456b-b4ff-5c4dd2b87957","resolution":{"observed_at":"2026-08-05T16:56:35.846629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:35.285836Z","title":"Vita-clip: Video and text adaptive clip via multimodal prompting","venue":null,"work_id":"011d3de6-8425-4181-a43a-2a6969560ba0","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.584758Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:6c4e992ebcadfe31bb1232ab96f037fb3dfae5123f44a9c21c916e0a1bc314ea","observation_id":"c808adf0-bcd8-4696-bf77-50815d56bdbd","resolution":{"observed_at":"2026-08-05T16:56:35.409624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.984989Z","title":"Fine-tuned clip models are efficient video learners","venue":null,"work_id":"b09e721a-fb3e-4201-94db-e778450b0bf8","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.695057Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:57332a91d68b69d9e5fa2c2c46622c3c5fed3452a89e226ae3b3f289aaccb2e5","observation_id":"60937bb5-9db1-428a-a577-1e93083869f0","resolution":{"observed_at":"2026-08-05T16:56:35.131472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.635712Z","title":"Adaptformer: Adapting vision transformers for scalable visual recognition","venue":null,"work_id":"d0b73a19-7357-40fa-b04e-3f326366ce5e","year":2022},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:31.824750Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:20e4470a9a326b98d4b917f6c3aeef054800df6d84673e7d8cbaf2ea44a64f41","observation_id":"ba7ae1bd-fa9a-45bf-b5c0-168f32c2102f","resolution":{"observed_at":"2026-08-05T16:56:34.768234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:56:34.293831Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"1d04027f-0754-4184-a6ce-f5415ff717c0","year":2023},"citing_paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:32.082419Z"},"links":{"citing_paper":"/paper/2508.17417"},"observation_digest":"sha256:42f1c942ff59afce23d71c04d88c3055d958c3be86d997ef75a0ed5f0c4240ee","observation_id":"b42dd996-929f-4482-a95b-15e75df6ba26","resolution":{"observed_at":"2026-08-05T16:56:34.484053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.17417","last_updated":"2025-08-24T15:45:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T13:13:22.600253Z","submitted_at":"2025-08-24T15:45:22Z","title":"Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":52},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2508.17417."}