{"as_of":"2026-08-18T22:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b3e14c1773ab970a24c66a304f9cdebc5402bf252b09f214358c01df779a1a6","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T09:34:20.560870Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.12744/citation-record","integrity":"/paper/2606.12744/integrity","json":"/paper/2606.12744/citation-record.json","paper":"/paper/2606.12744"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:690caadf288ec318d339685345a3549676646a02484d8f50ac16aab38078a23e","observation_id":"0a5bdd23-4ccd-4312-aa10-fa9761ecb0dc","resolution":{"observed_at":"2026-07-03T11:28:04.242745Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:20.560870Z","title":"Can multimodal large language models truly perform multimodal in-context learning? In 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:2ff46f787184a442889e0425efaea9366b593852e5cc2d2b0b0631da5c2da950","observation_id":"5ee41487-1255-490b-96aa-edb7c7393298","resolution":{"observed_at":"2026-06-27T09:34:20.560870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-16T01:18:27.067382Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":"1504.00325","doi":"10.48550/arxiv.1504.00325","metadata_source":"pith","pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","venue":"cs.CV","work_id":"b3d6fb46-4169-4a28-8f7e-2ca6774211da","year":2015},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:625689c9963f71ba847c82ec50f51fa0e668b1500ec5f613a09aadac212e4cdf","observation_id":"7a679b94-225d-4ed4-bbb4-77322b9887a4","resolution":{"observed_at":"2026-07-03T11:28:04.248622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:1f4f41978a755966c9ec7e0c84c624f3a618359a7ccddf49bb9029bf100b4ab1","observation_id":"83f0f176-fd2f-43e0-a44e-864edf16aafd","resolution":{"observed_at":"2026-07-03T11:28:04.237290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.5143773","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ilharco, M","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"564dbf7c-d36d-4604-a76f-f485274a2431","year":2021},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:a6fd2693e2f9a0f9460e7c634d51c05c5278241d638de8ec4d1ad35a1a517a61","observation_id":"802d269e-ac42-4592-a967-8c7e58bcd151","resolution":{"observed_at":"2026-06-27T09:40:47.154456Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-13T21:08:14.396191+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T21:08:14.396191+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03824","last_updated":"2025-02-14T01:05:29Z","snapshot_observed_at":"2026-08-14T07:43:20.338603Z","submitted_at":"2025-02-06T07:19:59Z","title":"Syntriever: How to Train Your Retriever with Synthetic Data from LLMs","version":3},"cited_work":{"arxiv_id":"2502.03824","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03824","snapshot_observed_at":"2026-07-03T11:28:04.238254Z","title":"Syntriever: How to train your retriever with synthetic data from llms","venue":null,"work_id":"e6e4c023-42f0-4c35-9bf4-e1d6e9abba8b","year":null},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2502.03824","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:02f7fa3bc63cffae89cf34715550d4690568698d3c59cb9d33e2aab34b59698d","observation_id":"868bcc42-3554-4402-8961-38e86c4f2eab","resolution":{"observed_at":"2026-07-03T11:28:04.239902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2307.16125","doi":"10.48550/arxiv.2307.16125","metadata_source":"pith","pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","venue":"cs.CL","work_id":"23881ff0-b851-474c-8712-90744cc07a3a","year":2023},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:dcfb0cf3b37e6775fc23ee4ff3331d3fe2727ec4bfd033011dfc5dce6ec08296","observation_id":"dc7c6749-ea1f-494a-b27d-2d9ee8fa0c43","resolution":{"observed_at":"2026-07-03T11:28:04.234876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14128","last_updated":"2023-05-23T14:55:25Z","snapshot_observed_at":"2026-08-16T15:30:36.371468Z","submitted_at":"2023-05-23T14:55:25Z","title":"Dr.ICL: Demonstration-Retrieved In-context Learning","version":1},"cited_work":{"arxiv_id":"2305.14128","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.14128","snapshot_observed_at":"2026-07-03T11:28:04.252844Z","title":"Dr.ICL: Demonstration-retrieved in-context learning","venue":null,"work_id":"8dfed6ec-8806-4b78-aba4-d2e23e661a44","year":2023},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2305.14128","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:585e4ed48c61ff20fdaef91d9aa36c8b3759e28d4e4f8a4fc1cb40b117263c8b","observation_id":"e637aabf-a534-4df9-b8f6-6443c32d8321","resolution":{"observed_at":"2026-07-03T11:28:04.254399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:20.560870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:2611879fff52267017aa2694e919dbfc09442aba59a692ddde350ac6ff3a5937","observation_id":"a5e59d3d-858c-49ba-9e33-dc4f44a7cdc1","resolution":{"observed_at":"2026-06-27T09:34:20.560870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:34:20.560870Z","title":"Learning to retrieve prompts for in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:e26b0293ddb4f17f5c185eb026a4f39586e2490c2fc0937b886d1cb0abe2320f","observation_id":"29cabaae-74e9-4750-8c8b-173e3350f50c","resolution":{"observed_at":"2026-06-27T09:34:20.560870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.naacl-main.191","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://aclanthology.org/2022.naacl-main.191","venue":"Proceedings of the 2022 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies","work_id":"296fa0b3-6893-4f3b-91ed-fdc7880ae1ab","year":2022},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:5bd94bffaabf0bbb4325ef23dd7e4655f5ba1fb8b7a6320a62fe4dc2255280cd","observation_id":"9ffb31f5-d8df-4999-9fb8-df3e97e286f1","resolution":{"observed_at":"2026-06-27T09:40:47.156390Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07164","last_updated":"2024-01-26T07:04:02Z","snapshot_observed_at":"2026-08-16T15:16:19.554159Z","submitted_at":"2023-07-14T05:23:08Z","title":"Learning to Retrieve In-Context Examples for Large Language Models","version":2},"cited_work":{"arxiv_id":"2307.07164","doi":"10.48550/arxiv.2307.07164","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.07164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to retrieve in-context examples for large language models","venue":"arXiv (Cornell University)","work_id":"601ba16c-a897-4381-93aa-6f018dd72bcf","year":2023},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2307.07164","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:df15247f41912ee57cb45c48011ccb453029bfca484e94cf61153a50ccdd3ab7","observation_id":"2f51f9f6-309d-46f3-81ee-2473e4e755fd","resolution":{"observed_at":"2026-07-03T11:28:04.240181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03966","last_updated":"2025-05-24T14:53:24Z","snapshot_observed_at":"2026-08-14T21:02:25.534354Z","submitted_at":"2024-12-05T08:33:52Z","title":"Demonstration Selection for In-Context Learning via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2412.03966","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03966","snapshot_observed_at":"2026-07-03T11:28:04.246731Z","title":"Demonstration selection for in-context learning via reinforcement learning.arXiv preprint arXiv:2412.03966,","venue":null,"work_id":"e5be5bda-7bc2-4181-94a1-a0139bdce24a","year":null},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2412.03966","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:68780138024aebb014de601d6f56437d0a98a9bcceffc87fa8966f1418e93eed","observation_id":"1190a19c-0add-4172-b484-ad9a0e91232a","resolution":{"observed_at":"2026-07-03T11:28:04.248446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07915","last_updated":"2024-03-20T16:17:02Z","snapshot_observed_at":"2026-08-16T15:00:37.541236Z","submitted_at":"2023-09-14T17:59:17Z","title":"MMICL: Empowering Vision-language Model with Multi-Modal In-Context Learning","version":3},"cited_work":{"arxiv_id":"2309.07915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.07915","snapshot_observed_at":"2026-07-03T11:28:04.249589Z","title":"Mmicl: Empowering vision-language model with multi-modal in-context learning","venue":null,"work_id":"f306f0d3-c35b-4063-b422-c6beae03c3f8","year":2023},"citing_paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T09:34:20.560870Z"},"links":{"cited_paper":"/paper/2309.07915","citing_paper":"/paper/2606.12744"},"observation_digest":"sha256:cf592d03541c3e7c4cf3c9748f82f7029d430d048e6c80d2d9a5dd40bdfad603","observation_id":"8d9b819c-2ffe-4f6f-a328-8344868c714b","resolution":{"observed_at":"2026-07-03T11:28:04.251441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.12744","last_updated":"2026-06-10T23:14:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T10:26:12.213388Z","submitted_at":"2026-06-10T23:14:45Z","title":"GRIP: Feedback-Guided Prompt Retrieval for Large Multimodal Models"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":3,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2606.12744."}