{"as_of":"2026-08-19T07:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e65313ce595203e061827446071b6fd0543b98113ca4f1467024eb96897aa11","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:12:43.318792Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.21263/citation-record","integrity":"/paper/2504.21263/integrity","json":"/paper/2504.21263/citation-record.json","paper":"/paper/2504.21263"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.086277Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.086277Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:2125949b78c00dad5a0705d58a31420765557ce700e27ab06cb2710926bfa36a","observation_id":"09c9d36b-7a06-4edd-9847-e4968303d1fa","resolution":{"observed_at":"2026-08-16T05:12:43.086277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:44.101060Z","title":"Visual prompting via image inpaint- ing","venue":null,"work_id":"d918baec-a33c-4bd2-8945-43cb5606c5e4","year":2022},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.091933Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:d23d5d68ec2a9713242fd2d9b9b6f56b62985c67964c9b1c29f8349d163b294b","observation_id":"037a2a1b-4b9d-48f6-adc9-5cfb2db92f59","resolution":{"observed_at":"2026-08-16T05:12:44.106739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:44.080671Z","title":"Language models are few-shot learners","venue":null,"work_id":"88ac13fa-41b4-49e8-8cbd-67abe05628ce","year":1901},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.097952Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:0280f5bfed32e9c0f0edf9ab6478a3a4ed49f51c9f46166d890a65ffd7e0bfa3","observation_id":"f0c1fdde-05fc-4384-b87d-e3264fe354f5","resolution":{"observed_at":"2026-08-16T05:12:44.086176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:44.060842Z","title":"Why can gpt learn in-context? language models secretly perform gradient descent as meta- optimizers","venue":null,"work_id":"d3c564ed-90fd-4d00-8ace-b56b66709f93","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.103945Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:ad10b9042603c8728408c9843468c81a7da91af37830ebb3ac50455b052bc4bb","observation_id":"8a165846-d522-443d-8e57-f385bcbcccf1","resolution":{"observed_at":"2026-08-16T05:12:44.068751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:44.042122Z","title":"Why can GPT learn in-context? language models secretly perform gradient descent as meta- optimizers","venue":null,"work_id":"7e408f39-2358-426c-b1c5-cde492f58f74","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.109072Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:1cc44ccec308e24ed65e63daa85d3dbf3a8e5bbefac38b6d66fe40a67df26efb","observation_id":"ee7af2de-b636-4e3d-a1a8-213360c1ea32","resolution":{"observed_at":"2026-08-16T05:12:44.048735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:44.010636Z","title":"A survey on in-context learning","venue":null,"work_id":"eef46c06-2765-4722-b25b-81b0cff1d55c","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.119136Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:3f11678cc93ec0adba339650d118f15e6774459db389ace68ca5e4ae24297b79","observation_id":"8110bb54-5fc6-4a6e-b27c-4a90ae71af7e","resolution":{"observed_at":"2026-08-16T05:12:44.015916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.993294Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"c2197462-b873-405f-bae2-1153857816a9","year":2021},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.123985Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:b9e417a6406361533497c1e44a6a6985713c04a6ad1c55975b7e642fa1b965f8","observation_id":"477e48e7-21e7-40c8-8956-df521c4e8653","resolution":{"observed_at":"2026-08-16T05:12:43.998457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.129236Z","title":"The pascal visual object classes challenge: A retrospective","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.129236Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:66bacced03fc1c7bcf07232e01698fa3cd1a49cca455632b312154fcabfc2263","observation_id":"52500beb-ebeb-41f5-b255-43188ed5dc50","resolution":{"observed_at":"2026-08-16T05:12:43.129236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.964690Z","title":"Explore in-context learning for 3d point cloud understanding.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"e5d22d01-387b-4057-9e5d-1821e240d31e","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.133751Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:661dfa0fc596e0be0b275918615965b23fc89b282d3b4d08db6555a5c5dde219","observation_id":"0f80b276-862d-4c1f-b189-2eee41fcd80c","resolution":{"observed_at":"2026-08-16T05:12:43.970145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.138499Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.138499Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:ccc4b8cc19abb2422a53b87b585f6ed6c5fb0ac6a36c9a5784f2c0509928a55c","observation_id":"4fa4bc87-e4c6-4d60-b08a-54696e648e4a","resolution":{"observed_at":"2026-08-16T05:12:43.138499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15916","last_updated":"2023-10-24T15:17:14Z","snapshot_observed_at":"2026-08-17T03:03:22.868290Z","submitted_at":"2023-10-24T15:17:14Z","title":"In-Context Learning Creates Task Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15916","snapshot_observed_at":"2026-08-16T05:12:43.144547Z","title":"In- context learning creates task vectors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.144547Z"},"links":{"cited_paper":"/paper/2310.15916","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:0ff45166a4471b3d29d3e3a08d5eec6ae775d57d5a9056de4755bbc0a9d23cd0","observation_id":"f5bd6351-6cd7-44f2-9342-6b5f1aaf18db","resolution":{"observed_at":"2026-08-16T05:12:43.144547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T05:12:43.150291Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.150291Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:cc208828ff6a52343f1f85c81a908defa0cf76cf79f21fc29d1e192660614a8a","observation_id":"a240d9dc-96c3-4767-8fa7-1fd9a1971ba9","resolution":{"observed_at":"2026-08-16T05:12:43.150291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05425","last_updated":"2023-06-08T17:59:56Z","snapshot_observed_at":"2026-08-16T15:25:23.093007Z","submitted_at":"2023-06-08T17:59:56Z","title":"MIMIC-IT: Multi-Modal In-Context Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05425","snapshot_observed_at":"2026-08-16T05:12:43.156342Z","title":"Mimic-it: Multi-modal in-context instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.156342Z"},"links":{"cited_paper":"/paper/2306.05425","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:24d09629c48a2354176a80f852e7e362e88382626300ec682a378750c56ebf53","observation_id":"4b6f8670-5679-42a1-b0e9-d5aace0a00b3","resolution":{"observed_at":"2026-08-16T05:12:43.156342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.936931Z","title":"Visual in-context prompting","venue":null,"work_id":"970ef718-cfb9-4ea9-900d-195374732dea","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.161407Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:79fd02c68a307ceceddd5006c480ec6fc01dc977717a1a9b1bc8f61b1f06d191","observation_id":"eb0bd2cc-8ff5-4802-a194-8777bbfe6981","resolution":{"observed_at":"2026-08-16T05:12:43.942955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.167715Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.167715Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:4e289442e40df70ca512946843f4d1bb6bca98505fd9d13823a8f198a039473f","observation_id":"e79820b0-0e6e-4210-8104-a1020581fad9","resolution":{"observed_at":"2026-08-16T05:12:43.167715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-18T04:49:12.041312Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-16T05:12:43.174370Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.174370Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:d067c1bcdac0f84f21b013ee66294c78eebfb10258f59c6c1a409d5cc2228255","observation_id":"c6dcea9f-04c7-4633-b420-5a363085b3e0","resolution":{"observed_at":"2026-08-16T05:12:43.174370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.180678Z","title":"Context diffusion: In-context aware image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.180678Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:c35bc57d5260881b9282c33ae99aee1162d5709573f46432dd2bd28e8f08a393","observation_id":"c5c4336e-44f8-4954-998a-4b11b8720e87","resolution":{"observed_at":"2026-08-16T05:12:43.180678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-16T05:12:43.187196Z","title":"Kosmos-2: Ground- ing multimodal large language models to the world","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.187196Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:f8d6663f38bb65f9d59b90091eac31e7f54e700f0cf0cb83116936832825cc27","observation_id":"a91a195e-a492-415d-9146-2f10d5128eef","resolution":{"observed_at":"2026-08-16T05:12:43.187196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03350","last_updated":"2023-10-17T18:57:17Z","snapshot_observed_at":"2026-08-15T17:25:43.175408Z","submitted_at":"2022-10-07T06:50:23Z","title":"Measuring and Narrowing the Compositionality Gap in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03350","snapshot_observed_at":"2026-08-16T05:12:43.193441Z","title":"Measuring and narrowing the compositionality gap in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.193441Z"},"links":{"cited_paper":"/paper/2210.03350","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:678642854f429e21cc96fb8b3afd3a9ea57c887d577ef53568d0eb98a2c0f343","observation_id":"0ec7e0bc-cb32-41fa-846f-44ae1d3ac1b8","resolution":{"observed_at":"2026-08-16T05:12:43.193441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.199317Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.199317Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:c004cf09d5f5a30b0714bdb1b4aefc917eb54ffad7e4b6ab348e46f207220b96","observation_id":"b83a6800-b869-454e-bab3-0b19b78f126b","resolution":{"observed_at":"2026-08-16T05:12:43.199317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.03410","last_updated":"2017-09-11T14:34:58Z","snapshot_observed_at":"2026-08-17T15:29:01.385951Z","submitted_at":"2017-09-11T14:34:58Z","title":"One-Shot Learning for Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.03410","snapshot_observed_at":"2026-08-16T05:12:43.204365Z","title":"One-shot learning for semantic segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.204365Z"},"links":{"cited_paper":"/paper/1709.03410","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:9bffd2be3f1e95d8441c4e5639bb85b3b9ebc5473a04d1aaafffdac54e661517","observation_id":"862cc234-0f4e-4028-b925-bbb85c40cb3e","resolution":{"observed_at":"2026-08-16T05:12:43.204365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13509","last_updated":"2022-05-08T06:36:19Z","snapshot_observed_at":"2026-08-16T23:37:54.092154Z","submitted_at":"2022-04-28T13:59:54Z","title":"On the Effect of Pretraining Corpora on In-context Learning by a Large-scale Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13509","snapshot_observed_at":"2026-08-16T05:12:43.209568Z","title":"On the effect of pretraining corpora on in-context learning by a large-scale language model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.209568Z"},"links":{"cited_paper":"/paper/2204.13509","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:f9eb366db31de73fa0b4b0f7b1b782f9ecf8f2fdc6aa7c9dc7696acaa8e513a5","observation_id":"fc7c940c-1782-4590-8bc6-84a4d0375615","resolution":{"observed_at":"2026-08-16T05:12:43.209568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.882094Z","title":"Generative multimodal models are in- context learners","venue":null,"work_id":"9e948278-6f9b-4ff1-ae36-0eb7eb740010","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.215251Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:859c93ee1d6c3fb04e940fbea112a17778f494d3897df99f194f2e66395dd485","observation_id":"87120e2a-fd86-493a-9c8f-6c511490109c","resolution":{"observed_at":"2026-08-16T05:12:43.888875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.220638Z","title":"Exploring effective factors for improving visual in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.220638Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:b5aca584f0d680f37a2da46680277b943717d4dc32baa8a4f44523d28b0ea3f2","observation_id":"63a787fe-1176-4d10-b137-7ac012a125d1","resolution":{"observed_at":"2026-08-16T05:12:43.220638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.225660Z","title":"Rethinking and improving visual prompt selection for in-context learning segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.225660Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:bd8b30016e7da206972916e47bf1a985fc870eea90b61501bd6fa266d601f50e","observation_id":"19353e04-9c22-4668-8a02-4a1a9cacb89f","resolution":{"observed_at":"2026-08-16T05:12:43.225660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T05:12:43.231123Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.231123Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:d13853e84b95f207edd88c55d19781f692deaae135dd6a6f846bea0b9d13aa87","observation_id":"e6ecead2-b0ec-4fd2-a608-d7c4e2261312","resolution":{"observed_at":"2026-08-16T05:12:43.231123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T05:12:43.236675Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.236675Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:8026907c4ea800fe86c73f55af501c3561c03aa0dfce9141d49e7b0c38e5550d","observation_id":"a125e601-c513-4f29-a908-bb71e0aeb5d2","resolution":{"observed_at":"2026-08-16T05:12:43.236675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.851718Z","title":"Transformers learn in-context by gradient descent","venue":null,"work_id":"27e887c1-d58a-49c9-a9c2-87985998beaf","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.244767Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:6f991647bc8dd3d4d7ba17574831f80d9236533d82c1421cf6244bf6cb698e62","observation_id":"91e845be-518d-41d0-9834-05ff6c6e48cb","resolution":{"observed_at":"2026-08-16T05:12:43.856938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.832387Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":"93055d82-8c44-4806-a16b-5ff3de2b3494","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.251538Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:114281cd463efa50c93a07089b139178a74f13216b9ad1b7d4fb14b76fd38928","observation_id":"f1220948-9b87-4f6f-8a40-412645341f4b","resolution":{"observed_at":"2026-08-16T05:12:43.838881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03284","last_updated":"2023-04-06T17:59:57Z","snapshot_observed_at":"2026-08-16T15:42:11.267112Z","submitted_at":"2023-04-06T17:59:57Z","title":"SegGPT: Segmenting Everything In Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03284","snapshot_observed_at":"2026-08-16T05:12:43.258254Z","title":"Seggpt: Segmenting everything in context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.258254Z"},"links":{"cited_paper":"/paper/2304.03284","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:4805d2bf007930cb332ff6899299687266769f516f6ccc7eecc332411e6655b9","observation_id":"cf2b64a0-14da-4a1d-9eba-fbfda98d8d62","resolution":{"observed_at":"2026-08-16T05:12:43.258254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.813180Z","title":"In- context learning unlocked for diffusion models","venue":null,"work_id":"6bdf0ab6-732e-4b4c-a25d-83d0e3a80cd4","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.269509Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:f38a8809014d52309419cb4c48032e37a16ad639a74103689797f2453a37bf8e","observation_id":"8752d6ed-c736-4a48-a5f8-fd36dbf522e8","resolution":{"observed_at":"2026-08-16T05:12:43.819218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-08-18T13:27:58.239266Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-16T05:12:43.275668Z","title":"Larger language models do in-context learning differently","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.275668Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:0b3dee7b554a3f1fc215657bb8bc6288bba37f8e3212d4e8ad49bfb6d1132dd1","observation_id":"f271e597-d663-4a02-95d6-5f80d84d3957","resolution":{"observed_at":"2026-08-16T05:12:43.275668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.794092Z","title":"Towards global optimal visual in-context learning prompt selection","venue":null,"work_id":"0974c106-e5ac-40ab-abd1-1fb80b4670da","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.282367Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:69f5e74b46b79dc207e4f1da40cd7f043bdb382eb009b50ff3434338b592dee9","observation_id":"e3460d02-5db6-4e38-936a-981bc3965cc1","resolution":{"observed_at":"2026-08-16T05:12:43.800337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12685","last_updated":"2022-10-24T17:44:25Z","snapshot_observed_at":"2026-08-19T06:44:47.839864Z","submitted_at":"2022-05-25T11:45:14Z","title":"Ground-Truth Labels Matter: A Deeper Look into Input-Label Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12685","snapshot_observed_at":"2026-08-16T05:12:43.288678Z","title":"Ground-truth labels matter: A deeper look into input- label demonstrations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.288678Z"},"links":{"cited_paper":"/paper/2205.12685","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:baeca686b5d274cb5e1d9499c17bf0e4b66d22336efa8d7c1b59583b67022769","observation_id":"f69c66cb-3ae8-41d2-a53a-b104a14b9798","resolution":{"observed_at":"2026-08-16T05:12:43.288678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.776341Z","title":"Instruct me more! random prompt- ing for visual in-context learning","venue":null,"work_id":"963dfa86-967c-4a85-9382-9b1dad38c29e","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.295758Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:48687d2be8a86f90255be2dec11522d62122495a5178aa2b0578426e31b1c664","observation_id":"ce09b2f6-c75d-42c6-a7aa-103013e43c24","resolution":{"observed_at":"2026-08-16T05:12:43.781826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.756330Z","title":"What makes good examples for visual in-context learning? Advances in Neural Information Processing Systems, 36, 2023","venue":null,"work_id":"b3a44014-c25d-41d0-b921-b3dcea96bfac","year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.301726Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:1581b4bc6a376caadb46bc4c34154a5105a2d1322288b2aa974efffde559cc9b","observation_id":"cb80cf3a-0cd3-4d5d-9d89-473592dc8aaf","resolution":{"observed_at":"2026-08-16T05:12:43.762937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.732469Z","title":"Mmicl: Empowering vision-language model with multi-modal in-context learning","venue":null,"work_id":"32425cdb-d1c8-447b-80b3-2f7db96e1f5a","year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.307513Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:f6cc1e829a6c0b8e291b1a6195054192c9f40f1ce868bfdb4a46bfb06b50a01f","observation_id":"1c3bd1a0-311c-4876-a000-c1d69f88bf05","resolution":{"observed_at":"2026-08-16T05:12:43.740550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12740","last_updated":"2023-05-22T06:07:58Z","snapshot_observed_at":"2026-08-18T03:50:53.083544Z","submitted_at":"2023-05-22T06:07:58Z","title":"Can We Edit Factual Knowledge by In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12740","snapshot_observed_at":"2026-08-16T05:12:43.312726Z","title":"Can we edit fac- tual knowledge by in-context learning? arXiv preprint arXiv:2305.12740, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.312726Z"},"links":{"cited_paper":"/paper/2305.12740","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:0691b2d765f1b4a4be90df91d20bedd26181c625e7eddf64684494f116f7af6a","observation_id":"67fe4a03-0411-4932-8902-486515969664","resolution":{"observed_at":"2026-08-16T05:12:43.312726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11574","last_updated":"2024-02-18T12:43:38Z","snapshot_observed_at":"2026-08-19T06:38:14.054679Z","submitted_at":"2024-02-18T12:43:38Z","title":"Visual In-Context Learning for Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11574","snapshot_observed_at":"2026-08-16T05:12:43.318792Z","title":"Visual in-context learning for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.318792Z"},"links":{"cited_paper":"/paper/2402.11574","citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:4b7944eb0db2f3cc50dab53bdd58616e822cec1c36f82e5f0dd7cd00d8358210","observation_id":"0ea49a14-a23f-4a3d-95f1-6bb3fd59179d","resolution":{"observed_at":"2026-08-16T05:12:43.318792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:12:43.114116Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T05:12:43.114116Z"},"links":{"citing_paper":"/paper/2504.21263"},"observation_digest":"sha256:e780870d8c283269f0e3ba801c3f26772ee655f38f21def82aab3852396e44c2","observation_id":"7aff7bd1-7e60-4758-807d-b6a26cb7406c","resolution":{"observed_at":"2026-08-16T05:12:43.114116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.21263","last_updated":"2025-04-30T02:43:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T06:38:37.607609Z","submitted_at":"2025-04-30T02:43:03Z","title":"Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2504.21263."}