{"as_of":"2026-08-16T09:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e67651065f9a04f2186afde2466d5cec98154d46712f004fbad805626035ca6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:10:33.024513Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:56:11.264751Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2407.17491","last_updated":"2026-04-03T23:10:26Z","snapshot_observed_at":"2026-08-13T12:50:57.041166Z","submitted_at":"2024-07-04T02:35:00Z","title":"Robust Adaptation of Foundation Models with Black-Box Visual Prompting","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T23:23:03.562550Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2407.17491"},"observation_digest":"sha256:bf371004ffa5e496f697ff8663925869c4756ed72c768f7e156a3aeea8b5bcc9","observation_id":"9b391797-2dda-4b4e-bf9b-be54cf8708e6","resolution":{"observed_at":"2026-05-23T23:23:36.362418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-12T19:14:24.286924Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10928","last_updated":"2024-11-17T01:16:37Z","snapshot_observed_at":"2026-08-14T10:09:58.775826Z","submitted_at":"2024-11-17T01:16:37Z","title":"Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T19:14:24.286924Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2411.10928"},"observation_digest":"sha256:504aff05586e27e7cebf771f3df6ecffde613ca2d4553cb23ed11e5fb506ee4d","observation_id":"7fa3b420-754e-499b-9489-2fb4b47b4d9c","resolution":{"observed_at":"2026-08-12T19:14:24.286924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T17:27:49.486626Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08979","last_updated":"2024-12-12T06:26:02Z","snapshot_observed_at":"2026-08-12T10:06:15.056325Z","submitted_at":"2024-12-12T06:26:02Z","title":"A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T17:27:49.486626Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.08979"},"observation_digest":"sha256:9743b9210b0590b79312c3572acfc5429fc8676c5e2f7135738e06ff5b820a8e","observation_id":"2fae7ffd-2efb-4a74-832f-e2492235e3c3","resolution":{"observed_at":"2026-08-11T17:27:49.486626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T15:20:47.281351Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11087","last_updated":"2024-12-15T07:09:02Z","snapshot_observed_at":"2026-08-15T19:54:00.452893Z","submitted_at":"2024-12-15T07:09:02Z","title":"Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T15:20:47.281351Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.11087"},"observation_digest":"sha256:bae1c48c155e8baa3036f9d011105f0282d25fa97123824cec92e579d9b63dc1","observation_id":"5004d9f0-efa5-4d6c-956a-19b78d0446eb","resolution":{"observed_at":"2026-08-11T15:20:47.281351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-11T14:57:26.850243Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11484","last_updated":"2024-12-16T06:53:00Z","snapshot_observed_at":"2026-08-15T21:19:39.311459Z","submitted_at":"2024-12-16T06:53:00Z","title":"Efficient Policy Adaptation with Contrastive Prompt Ensemble for Embodied Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:26.850243Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2412.11484"},"observation_digest":"sha256:a870d14066eab72a93b42b76387abccabb94355c0d89d43616df75642118317a","observation_id":"1d8a6df2-3b78-4d5b-b138-bac6621499c6","resolution":{"observed_at":"2026-08-11T14:57:26.850243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-10T22:54:52.244277Z","title":"Unified vi- sion and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.00457","last_updated":"2024-12-31T14:13:28Z","snapshot_observed_at":"2026-08-15T18:22:17.984449Z","submitted_at":"2024-12-31T14:13:28Z","title":"Differentiable Prompt Learning for Vision Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:52.244277Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.00457"},"observation_digest":"sha256:7b38e5d0f4834ef86e3b8071d7e0f2b6a47849a8bab9f506349bcf1a11219331","observation_id":"d83aaa4e-80f9-4c28-a96b-cb41c20b476a","resolution":{"observed_at":"2026-08-10T22:54:52.244277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-10T18:40:27.352337Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11175","last_updated":"2025-01-19T21:25:53Z","snapshot_observed_at":"2026-08-15T17:59:21.502153Z","submitted_at":"2025-01-19T21:25:53Z","title":"ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T18:40:27.352337Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.11175"},"observation_digest":"sha256:eb3e2d2a9d678510378c9cad5cbdd66930907624da99442f6a8b01c1de96dac8","observation_id":"81e7903e-4ab9-4d2c-95f2-8fe5605cacde","resolution":{"observed_at":"2026-08-10T18:40:27.352337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-09T22:41:21.249653Z","title":"Unified vi- sion and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18753","last_updated":"2025-01-30T21:07:14Z","snapshot_observed_at":"2026-08-10T01:57:58.405485Z","submitted_at":"2025-01-30T21:07:14Z","title":"INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T22:41:21.249653Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2501.18753"},"observation_digest":"sha256:be7d40027f17add0db30cb1a6ca22fc6974eb5ee92904d1e0abdfce3c4ff4ce0","observation_id":"1f316495-d2d1-41c2-a895-ee29292b7a3f","resolution":{"observed_at":"2026-08-09T22:41:21.249653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-16T05:10:33.024513Z","title":"Runjia Zeng, Cheng Han, Qifan Wang, Chunshu Wu, Tong Geng, Lifu Huang, Ying Nian Wu, and Dongfang Liu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21423","last_updated":"2025-04-30T08:28:38Z","snapshot_observed_at":"2026-08-16T06:44:10.764782Z","submitted_at":"2025-04-30T08:28:38Z","title":"Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:10:33.024513Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2504.21423"},"observation_digest":"sha256:dd920ab44454d2050ae00fc9888b55474c87b0e411407593123fb590abfd87fe","observation_id":"1b30b410-3ea5-4a2f-87a9-676f990ee42d","resolution":{"observed_at":"2026-08-16T05:10:33.024513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-16T04:09:12.396220Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02056","last_updated":"2025-05-04T10:24:34Z","snapshot_observed_at":"2026-08-16T04:00:11.374555Z","submitted_at":"2025-05-04T10:24:34Z","title":"Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:12.396220Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2505.02056"},"observation_digest":"sha256:363ca3e118010a21bc145bd4d1566d6ade9f6459ce5d0522e20ea227e92e3a0e","observation_id":"7123ad45-4d58-4392-a778-c9aa7356ea6a","resolution":{"observed_at":"2026-08-16T04:09:12.396220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-15T20:24:33.625715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13233","last_updated":"2025-05-19T15:15:37Z","snapshot_observed_at":"2026-08-15T20:14:51.390069Z","submitted_at":"2025-05-19T15:15:37Z","title":"From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:24:33.625715Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2505.13233"},"observation_digest":"sha256:1f107e59b7a739de8751c5c4b21f0a5b530f87d1328567bc855b3a3b72c07f6a","observation_id":"8c07e3f0-3ee9-462b-a1af-89adab118d97","resolution":{"observed_at":"2026-08-15T20:24:33.625715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T23:20:44.558520Z","title":"Unified vision and language prompt learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18504","last_updated":"2025-06-30T05:24:22Z","snapshot_observed_at":"2026-08-16T09:44:26.567520Z","submitted_at":"2025-06-23T10:56:37Z","title":"Generalizing vision-language models to novel domains: A comprehensive survey","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:44.558520Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2506.18504"},"observation_digest":"sha256:e1492be21fe84354dd0bfadeee2260823570fdd254476b0b835eb27bec4f4f48","observation_id":"a4721250-0fee-4c53-9569-210c1669cab5","resolution":{"observed_at":"2026-08-06T23:20:44.558520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T18:27:46.914058Z","title":"Unified vision and language prompt learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08410","last_updated":"2025-07-11T08:45:27Z","snapshot_observed_at":"2026-08-09T12:40:28.487754Z","submitted_at":"2025-07-11T08:45:27Z","title":"Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:27:46.914058Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.08410"},"observation_digest":"sha256:daf0f070d3651d72e838305ea835c0575fec96671115c7caac13aa1e04c5cdaa","observation_id":"238e3490-284d-4bb2-961f-47d8d62720ee","resolution":{"observed_at":"2026-08-06T18:27:46.914058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:42:16.472212Z","title":"Unified vision and language prompt learning.arXiv:2210.07225, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15480","last_updated":"2025-07-28T04:47:15Z","snapshot_observed_at":"2026-08-15T20:19:55.065831Z","submitted_at":"2025-07-21T10:35:32Z","title":"One Last Attention for Your Vision-Language Model","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:16.472212Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15480"},"observation_digest":"sha256:0fb1bf1ea976018fab523d360b6b2f8642b045fdcca426624905a7358e08e9c3","observation_id":"4e1bf780-8215-4fab-ba9e-e3142fd70d09","resolution":{"observed_at":"2026-08-06T15:42:16.472212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:36:17.773682Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15542","last_updated":"2025-08-04T02:28:09Z","snapshot_observed_at":"2026-08-14T18:20:35.027776Z","submitted_at":"2025-07-21T12:15:27Z","title":"HOLa: Zero-Shot HOI Detection with Low-Rank Decomposed VLM Feature Adaptation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:36:17.773682Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15542"},"observation_digest":"sha256:c17ed858a062a8244402f02f0eb0eb645a07ff977f8b7d330acc2b86591caab3","observation_id":"39cf9e76-117e-4977-ac08-f79d7f62f868","resolution":{"observed_at":"2026-08-06T15:36:17.773682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-06T15:34:44.496621Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15569","last_updated":"2025-07-21T12:50:49Z","snapshot_observed_at":"2026-08-13T20:41:43.519119Z","submitted_at":"2025-07-21T12:50:49Z","title":"DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:34:44.496621Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2507.15569"},"observation_digest":"sha256:99e5ac028e4640b3f939f534f0c3f8aa92cbc625ddc922dcebedc43c03ab20b9","observation_id":"624eca69-ece9-48ad-a3fe-6ee505763a9a","resolution":{"observed_at":"2026-08-06T15:34:44.496621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-05T16:05:18.776777Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19024","last_updated":"2025-08-26T13:42:48Z","snapshot_observed_at":"2026-08-08T00:07:02.060969Z","submitted_at":"2025-08-26T13:42:48Z","title":"ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T16:05:18.776777Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2508.19024"},"observation_digest":"sha256:c1673fb48ab49f90af69d23e1488b8c517d6829b2a6fc8073673abd9d7626c52","observation_id":"14f5836f-5f9b-4a54-9b2e-280aa943cf85","resolution":{"observed_at":"2026-08-05T16:05:18.776777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-02T21:07:50.961211Z","title":"arXiv preprint arXiv:2210.07225 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.21397","last_updated":"2026-07-01T05:08:00Z","snapshot_observed_at":"2026-08-15T11:03:53.825448Z","submitted_at":"2026-02-24T22:00:34Z","title":"MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T21:07:50.961211Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2602.21397"},"observation_digest":"sha256:0b2351e5831701ab762f3acff69f93f03e655cd130660354d1a0d8ffe738708d","observation_id":"430a400d-024f-44b2-aaed-d4f41bdcf8ee","resolution":{"observed_at":"2026-08-02T21:07:50.961211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.05910","last_updated":"2026-05-07T09:20:42Z","snapshot_observed_at":"2026-08-16T01:06:25.963385Z","submitted_at":"2026-05-07T09:20:42Z","title":"Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T15:52:06.698536Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.05910"},"observation_digest":"sha256:8fc15f3a66004935ac40c85ac4a2c409f7ad51294cea4b142341baf6d45e44e1","observation_id":"b8f107ab-92ba-40cf-8cca-ad6cd4da042d","resolution":{"observed_at":"2026-05-11T16:36:09.434253Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.08156","last_updated":"2026-05-04T09:07:00Z","snapshot_observed_at":"2026-08-11T05:30:38.614499Z","submitted_at":"2026-05-04T09:07:00Z","title":"LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:09.299209Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.08156"},"observation_digest":"sha256:c2ba8e734d868e9bffeeba53df9352fad47f0190cc0495ad527c2c3b9ff015c1","observation_id":"9dbc0ea5-6f51-4c6a-a557-f63ee02a9a45","resolution":{"observed_at":"2026-05-12T01:46:14.753399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":"2210.07225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-01T19:56:11.264751Z","title":"Unified vision and language prompt learning","venue":null,"work_id":"1f5888f6-45b3-4315-b4bf-61f128fcfcd0","year":2022},"citing_paper":{"arxiv_id":"2605.31246","last_updated":"2026-05-29T12:46:15Z","snapshot_observed_at":"2026-08-14T12:50:50.277598Z","submitted_at":"2026-05-29T12:46:15Z","title":"BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T21:52:23.150188Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2605.31246"},"observation_digest":"sha256:a899c8012c1410800ee03ea9fe4f23644aaeece04ab9ab2b1ca6dd048b14b24e","observation_id":"1f3fa981-2b57-451d-8e51-02776867f051","resolution":{"observed_at":"2026-07-01T19:56:11.266427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-07-13T01:03:27.721212Z","title":"Unified vision and language prompt learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09008","last_updated":"2026-07-10T00:24:41Z","snapshot_observed_at":"2026-08-13T22:18:29.704830Z","submitted_at":"2026-07-10T00:24:41Z","title":"C-GAP: Class-Aware and Online Prompting Improves Vision-Language Models on Imbalanced Classes","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T01:03:27.721212Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2607.09008"},"observation_digest":"sha256:75f8409b748c5a9bfc5a12c2e7208807659a90766725857623a5c29ede34e54f","observation_id":"b6ab8ff8-cd44-49a3-838d-280f7150b7ac","resolution":{"observed_at":"2026-07-13T01:03:27.721212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07225","snapshot_observed_at":"2026-08-05T10:32:23.244452Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03885","last_updated":"2026-08-04T16:20:54Z","snapshot_observed_at":"2026-08-15T15:44:28.184205Z","submitted_at":"2026-08-04T16:20:54Z","title":"MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:23.244452Z"},"links":{"cited_paper":"/paper/2210.07225","citing_paper":"/paper/2608.03885"},"observation_digest":"sha256:e11667897dc4e1c6ee4f990eefe40d677451215074fd96414002dfe60427be39","observation_id":"8b1b1f59-2338-4732-a32c-6c7cbda10091","resolution":{"observed_at":"2026-08-05T10:32:23.244452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.07225/citation-record","integrity":"/paper/2210.07225/integrity","json":"/paper/2210.07225/citation-record.json","paper":"/paper/2210.07225"},"outbound":[],"paper":{"arxiv_id":"2210.07225","last_updated":"2022-10-13T17:50:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T22:17:23.358616Z","submitted_at":"2022-10-13T17:50:24Z","title":"Unified Vision and Language Prompt Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2210.07225."}