{"as_of":"2026-08-11T22:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e61b07c15dd22dc463cce8926ae6184d1ecfb267c2d4c553732706eb08131a0b","coverage":[{"denominator":88,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:18:36.313017Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.15652/citation-record","integrity":"/paper/2412.15652/integrity","json":"/paper/2412.15652/citation-record.json","paper":"/paper/2412.15652"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:18:29.542848Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.542848Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:7f4f44c2ba6d71010b00150dd1af5b58fa4838aab3eab37665e176230891df97","observation_id":"59bd9bd6-65cd-4446-9081-f6f2ae5b8239","resolution":{"observed_at":"2026-08-11T11:18:29.542848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08844","last_updated":"2023-07-11T18:29:12Z","snapshot_observed_at":"2026-07-06T15:27:25.253387Z","submitted_at":"2023-05-15T17:57:16Z","title":"RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model Outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08844","snapshot_observed_at":"2026-08-11T11:18:29.690792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.690792Z"},"links":{"cited_paper":"/paper/2305.08844","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:55954d959b724e31e7de1ece6d1e7539b82ad5de1efd80ecf9f69f0da2dba438","observation_id":"502c660b-9abc-472c-9b00-c8827d543e98","resolution":{"observed_at":"2026-08-11T11:18:29.690792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20689","last_updated":"2024-03-29T07:17:39Z","snapshot_observed_at":"2026-08-07T10:31:33.290602Z","submitted_at":"2023-10-31T17:52:22Z","title":"Learning From Mistakes Makes LLM Better Reasoner","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20689","snapshot_observed_at":"2026-08-11T11:18:29.751918Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.751918Z"},"links":{"cited_paper":"/paper/2310.20689","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f1314654f3313169506568d4d57280ca1521b3110358770e598ed5fd8aefa24e","observation_id":"96ead836-13cc-4f9e-b32a-2527001a4bcd","resolution":{"observed_at":"2026-08-11T11:18:29.751918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04120","last_updated":"2024-03-07T00:32:47Z","snapshot_observed_at":"2026-08-11T20:27:56.675380Z","submitted_at":"2024-03-07T00:32:47Z","title":"A data-centric approach to class-specific bias in image data augmentation","version":1},"cited_work":{"arxiv_id":"2403.04120","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04120","snapshot_observed_at":"2026-08-11T11:18:37.580450Z","title":"A data-centric approach to class-specific bias in image data augmentation","venue":"cs.CV","work_id":"a4f8049c-3007-4026-bd34-a083a18e039f","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:29.843914Z"},"links":{"cited_paper":"/paper/2403.04120","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:1f0da032fa2a6a333266bd7ceafa92644e995a14bab3d9d8dd8e42d5c55537f9","observation_id":"0751aa38-db9f-4b68-8ac1-fd6eed36c4a2","resolution":{"observed_at":"2026-08-11T11:18:37.657401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T11:18:30.035097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.035097Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:cb9c3b0fda627e0f79f401a6ec61407bed577cc9812ae75c8c5131331acbe09a","observation_id":"a537fea8-3bcd-4c35-bb28-bc6793c00b75","resolution":{"observed_at":"2026-08-11T11:18:30.035097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.126725Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.126725Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:52c5574d1e8d89455fc69c359fd5fbeaa6aa32f3470f304e795500a0bee8ec1e","observation_id":"83832f5c-672c-42d1-b762-99f1440b02fd","resolution":{"observed_at":"2026-08-11T11:18:30.126725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.194422Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.194422Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:12b62148888f363641c6f004640ec6dae5275e8ed9558cef9096d07be0f5b4cc","observation_id":"be5263dc-ade1-46bf-8b33-383cc1f09a26","resolution":{"observed_at":"2026-08-11T11:18:30.194422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T11:18:30.260883Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.260883Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:258bcca5a9c4b561a132bb50c29a1b4cc0d7201b99946cbc64c5b844574bda0d","observation_id":"f87f42a2-bbc4-4aa5-832a-e658dacf63b7","resolution":{"observed_at":"2026-08-11T11:18:30.260883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:30.401004Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.401004Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:5a3b4fd6e286c18ca0d884a0f29d579b62ba229e0b2432954d3a989143440a65","observation_id":"7f4f4d10-6883-4859-a4f7-a641f1f87555","resolution":{"observed_at":"2026-08-11T11:18:30.401004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18628","last_updated":"2024-01-26T10:02:57Z","snapshot_observed_at":"2026-07-06T16:39:52.551576Z","submitted_at":"2023-10-28T07:54:39Z","title":"Personalised Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation","version":2},"cited_work":{"arxiv_id":"2310.18628","doi":"10.48550/arxiv.2310.18628","metadata_source":"pith","pith_arxiv_id":"2310.18628","snapshot_observed_at":"2026-08-11T12:16:16.480190Z","title":"Personalised Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation","venue":"cs.CL","work_id":"e7678e4e-19d7-4e73-9eea-92906cbeb5d0","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.538449Z"},"links":{"cited_paper":"/paper/2310.18628","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b5f90db1058ddba3a1334ac8c05dd5a122c937d8fbcbe987c8823b584a987dbf","observation_id":"61ab7e39-3c4a-4dca-927c-98c837056d55","resolution":{"observed_at":"2026-08-11T11:18:36.602286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-10T22:03:25.770697Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-11T11:18:30.647818Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.647818Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:83b945618b171f63f02d9611c3d12f18d0cdf49e87e46640e6556d766f80fe18","observation_id":"b66a871e-6c68-424e-b3e8-f8c95c44b5c5","resolution":{"observed_at":"2026-08-11T11:18:30.647818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14430","last_updated":"2023-07-26T18:01:49Z","snapshot_observed_at":"2026-08-02T22:31:42.480177Z","submitted_at":"2023-07-26T18:01:49Z","title":"Skill-it! A Data-Driven Skills Framework for Understanding and Training Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14430","snapshot_observed_at":"2026-08-11T11:18:30.753092Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.753092Z"},"links":{"cited_paper":"/paper/2307.14430","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a2ad92410899bf8953f47308f0c20bb1d2fb39074b98116b69c5a4b1c5d5d080","observation_id":"7ef5cc08-1c9c-4864-ae67-de92eaa2b551","resolution":{"observed_at":"2026-08-11T11:18:30.753092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13007","last_updated":"2023-03-20T11:39:47Z","snapshot_observed_at":"2026-08-10T18:54:22.431568Z","submitted_at":"2023-02-25T06:58:16Z","title":"AugGPT: Leveraging ChatGPT for Text Data Augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13007","snapshot_observed_at":"2026-08-11T11:18:30.866871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.866871Z"},"links":{"cited_paper":"/paper/2302.13007","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:46d226aa87d27c0c60d9d8fdb39564c15d854707c66e68bcd269b59ee7f21977","observation_id":"498992c3-92bf-4017-a872-b752d3c0ae29","resolution":{"observed_at":"2026-08-11T11:18:30.866871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12736","last_updated":"2024-07-17T08:13:02Z","snapshot_observed_at":"2026-08-11T20:27:27.356759Z","submitted_at":"2024-03-19T13:53:37Z","title":"Towards Multimodal In-Context Learning for Vision & Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12736","snapshot_observed_at":"2026-08-11T11:18:30.950663Z","title":"Jehanzeb Mirza, Wei Lin, Amit Alfassy, Assaf Arbelle, Shimon Ullman, and Leonid Karlinsky","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:30.950663Z"},"links":{"cited_paper":"/paper/2403.12736","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e1d30bde0651c8b11810328f37bf71f904361daa13b82e3c5d84d78b61065bfc","observation_id":"47077c04-7d8b-41be-b03f-26ad4c5d2011","resolution":{"observed_at":"2026-08-11T11:18:30.950663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.061376Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.061376Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:7e482609e7186e4978e984b0a2c24bf1d26a032a17cece3e836b9c08c39bc505","observation_id":"33e1170a-a280-48c7-9f1f-fcc96bc684a9","resolution":{"observed_at":"2026-08-11T11:18:31.061376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.121160Z","title":"A tale of tails: Model collapse as a change of scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.121160Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c7601bc0ac855a0ca08c47ae549f5718083e1bb04359b8189d0836793d375b38","observation_id":"2d452891-5ae7-4c43-881e-2d47e1d6387b","resolution":{"observed_at":"2026-08-11T11:18:31.121160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.230845Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.230845Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:943dd86ffe3df0db2101783952629609454027e4da57c271de8193a3a5b34f8b","observation_id":"3611be02-f771-480b-b890-619ce7aa6d04","resolution":{"observed_at":"2026-08-11T11:18:31.230845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.265214Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.265214Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f6a8f28488dfbe44aad0839561b7c1e9d4ffe663aab25aa7a07da2273b23dc56","observation_id":"6437eeee-f8bc-4cfd-96a4-3fea8fbbbb42","resolution":{"observed_at":"2026-08-11T11:18:31.265214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-08-02T02:53:18.136026Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-08-11T11:18:31.287010Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.287010Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:40c9e78daeb18493225d13c73cb3cb0ed7bb1053e5447f7fbca3eeee931df893","observation_id":"7b7b0fb6-453b-4150-86e5-47d18e3c116d","resolution":{"observed_at":"2026-08-11T11:18:31.287010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.291669Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.291669Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0e97f83bf7438cd812df1bc6b6ac90f5aa7e2fd1c94cfb5cbe778a5b3873b72d","observation_id":"16dc6b49-b0b5-441d-9674-97f733be16a6","resolution":{"observed_at":"2026-08-11T11:18:31.291669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15091","last_updated":"2023-06-26T22:14:04Z","snapshot_observed_at":"2026-07-06T15:47:03.002949Z","submitted_at":"2023-06-26T22:14:04Z","title":"Understanding In-Context Learning via Supportive Pretraining Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15091","snapshot_observed_at":"2026-08-11T11:18:31.296716Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.296716Z"},"links":{"cited_paper":"/paper/2306.15091","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:80003fb2e3ce66c196fa8b2f6f5b59ae39d282e7c76f810f7e08b336ed9eba48","observation_id":"00c74465-8c88-4db0-9a06-cd0e9bb178db","resolution":{"observed_at":"2026-08-11T11:18:31.296716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:31.301027Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.301027Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:1329f872c0b034b4305cc6cee2d9b372aa7650c04a52db5caa9a56664f0148c7","observation_id":"74419b3e-2fae-4afb-b04a-c1f1bdd93512","resolution":{"observed_at":"2026-08-11T11:18:31.301027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.577255Z","title":null,"venue":null,"work_id":"c73cda57-256a-4f3f-829d-88619f8efd24","year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.319732Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:6b4b242e7878f18bedb7ce3d4799d6f40aedeba7c64a9f497e04c8cab7cf3930","observation_id":"4627a671-36ce-4381-9862-c03137eb95c3","resolution":{"observed_at":"2026-08-11T11:18:38.583025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09798","last_updated":"2024-10-04T21:51:47Z","snapshot_observed_at":"2026-07-06T18:15:03.339204Z","submitted_at":"2024-05-16T04:02:43Z","title":"Many-Shot In-Context Learning in Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09798","snapshot_observed_at":"2026-08-11T11:18:31.447699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.447699Z"},"links":{"cited_paper":"/paper/2405.09798","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b4695d9753fb188a970e9c035a787efd64e6d00f1c2014ccf5631a5e939e83b4","observation_id":"5ab54576-f894-4307-a2c7-413cd260af69","resolution":{"observed_at":"2026-08-11T11:18:31.447699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00123","last_updated":"2021-06-11T22:08:29Z","snapshot_observed_at":"2026-08-11T00:57:42.629538Z","submitted_at":"2021-02-27T04:09:32Z","title":"GRAD-MATCH: Gradient Matching based Data Subset Selection for Efficient Deep Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00123","snapshot_observed_at":"2026-08-11T11:18:31.563340Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.563340Z"},"links":{"cited_paper":"/paper/2103.00123","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b065c2b55bbaaa76b3adfa6934592e2e071f1a166fb79c66e7634ac5a459eee8","observation_id":"57d0fb07-0774-4556-98a0-8a598d34227c","resolution":{"observed_at":"2026-08-11T11:18:31.563340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00904","last_updated":"2018-06-06T06:46:02Z","snapshot_observed_at":"2026-08-01T16:21:27.255811Z","submitted_at":"2018-01-03T05:49:37Z","title":"ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks","version":4},"cited_work":{"arxiv_id":"1801.00904","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.00904","snapshot_observed_at":"2026-08-11T11:18:37.226659Z","title":"ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks","venue":"cs.CV","work_id":"ee7c2f94-a243-4115-b90d-e5077e95be00","year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.639194Z"},"links":{"cited_paper":"/paper/1801.00904","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c4d73993239a3296e581f519b8bd4ae57a526d40c409171972e63a28c69eb327","observation_id":"c7ce0d31-5872-4009-8c5f-b14de9bdd018","resolution":{"observed_at":"2026-08-11T11:18:37.292004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.557340Z","title":null,"venue":null,"work_id":"4ad01399-a8c1-40ef-80a1-7ed800723db4","year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.707056Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ea7a092991184a7afb06bf4bc5c4e56f355e1b344f7b3bfd8f273b3197acc82c","observation_id":"d50475c8-da21-4411-a91b-59fc7130e643","resolution":{"observed_at":"2026-08-11T11:18:38.562295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00288","last_updated":"2023-11-01T04:40:05Z","snapshot_observed_at":"2026-07-06T16:41:31.021679Z","submitted_at":"2023-11-01T04:40:05Z","title":"Active Instruction Tuning: Improving Cross-Task Generalization by Training on Prompt Sensitive Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00288","snapshot_observed_at":"2026-08-11T11:18:31.770888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.770888Z"},"links":{"cited_paper":"/paper/2311.00288","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b3735012ae4d7169b260aca3de9c2c8121fcf4231747d17f7958024e030aeb9b","observation_id":"ad1bb8dd-a419-49d5-a052-79b6907e913d","resolution":{"observed_at":"2026-08-11T11:18:31.770888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16418","last_updated":"2024-10-17T01:57:27Z","snapshot_observed_at":"2026-07-06T18:05:25.418545Z","submitted_at":"2024-04-25T08:49:47Z","title":"Instruction Matters: A Simple yet Effective Task Selection for Optimized Instruction Tuning of Specific Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16418","snapshot_observed_at":"2026-08-11T11:18:31.820458Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.820458Z"},"links":{"cited_paper":"/paper/2404.16418","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ac839df399966262d638971e4d8b9d41920dc4829fb002cac23404ad50eb65f4","observation_id":"674b7145-a253-4d67-ad88-29d0f103c647","resolution":{"observed_at":"2026-08-11T11:18:31.820458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15042","last_updated":"2024-07-13T07:36:49Z","snapshot_observed_at":"2026-08-01T19:54:30.948652Z","submitted_at":"2024-03-22T08:57:07Z","title":"LLM2LLM: Boosting LLMs with Novel Iterative Data Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15042","snapshot_observed_at":"2026-08-11T11:18:31.875753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.875753Z"},"links":{"cited_paper":"/paper/2403.15042","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:77dd281394963ba6b4da614660236592243f87734e330b75039e7ba5b0557c9f","observation_id":"54d4abf3-4a7f-4b46-a4b2-07ccf9c00379","resolution":{"observed_at":"2026-08-11T11:18:31.875753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.541064Z","title":null,"venue":null,"work_id":"81199510-bc42-47ca-aec2-d8e685741df6","year":2011},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:31.963976Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a13b3f81935efd9ece095951edd7a523480aca2727afff1da7aa624cdf775cc4","observation_id":"bf8a7d50-caed-418a-89e5-0f66658d4704","resolution":{"observed_at":"2026-08-11T11:18:38.547263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-11T11:18:32.014466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.014466Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:17f34d028f77aecfa5837a4667bfb33300ca81440212598dce60e8e0e15fbc21","observation_id":"9e03463c-dc7a-4dfc-9543-94655fca8ffc","resolution":{"observed_at":"2026-08-11T11:18:32.014466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:32.125233Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.125233Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a121a9cc1ef754544be2fbf2aaab901225197a4973f8dd5896e2b6febda8b52b","observation_id":"ea85da49-a6c1-461a-96fb-766bb839cd40","resolution":{"observed_at":"2026-08-11T11:18:32.125233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-06T08:24:00.729497Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-11T11:18:32.254372Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.254372Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ebcca1cb8c30a59e60e9fcd00c6a4398e281027254b13f2da00665ef8093ee23","observation_id":"65dee9d3-2a82-4d66-97b0-c95bde10bdf5","resolution":{"observed_at":"2026-08-11T11:18:32.254372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03610","last_updated":"2024-02-02T15:46:42Z","snapshot_observed_at":"2026-07-06T15:23:49.202914Z","submitted_at":"2023-05-05T15:16:07Z","title":"The Role of Data Curation in Image Captioning","version":2},"cited_work":{"arxiv_id":"2305.03610","doi":"10.48550/arxiv.2305.03610","metadata_source":"pith","pith_arxiv_id":"2305.03610","snapshot_observed_at":"2026-08-11T12:16:16.480190Z","title":"The Role of Data Curation in Image Captioning","venue":"cs.CV","work_id":"6657d25c-8157-4dd1-9dd6-c1e37403c453","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.378381Z"},"links":{"cited_paper":"/paper/2305.03610","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4119075f0fbd1e5b0a8f8fa3a4e7da87d1bb29e36cb678ea0ece65c207a58132","observation_id":"4f503afc-a847-4058-a9a4-818126d23a1c","resolution":{"observed_at":"2026-08-11T11:18:36.475525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.889","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.447929Z","title":null,"venue":null,"work_id":"6b845fd4-e45c-48ea-9e9a-4d5ec1e9355b","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.424353Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ebf6f1e9473aef00ee40c76c6113f382977a0a5d7d97b119d83b63c1c540a8cb","observation_id":"6f95edcf-8072-428a-945b-a44e34ee6e7a","resolution":{"observed_at":"2026-08-11T11:18:36.453831Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.424084Z","title":null,"venue":null,"work_id":"7f1d6090-e237-4224-8bac-bf809a9bc3d9","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.429065Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ff72cee68d189ad8788c991bd189ccb3e6868456e890aaacc2e5557a59cd5642","observation_id":"0ce65bbd-4d53-4002-8db4-da54b469b4fe","resolution":{"observed_at":"2026-08-11T11:18:38.507370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:32.435145Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.435145Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:53e64e0a63998597c6d1fd7af0725eb4c605163423cc868c9b081c77bae40862","observation_id":"6b5e5e7c-cd16-487b-a36c-edc45859f66a","resolution":{"observed_at":"2026-08-11T11:18:32.435145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.215868Z","title":null,"venue":null,"work_id":"901b1840-b1de-4ca8-8e06-89169a834d70","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.588553Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0327fc80ec5a269b65b01866873074c30b63c3880a189764b45dcc79652490be","observation_id":"d662c3bc-46d6-4950-9c37-62ea3c205996","resolution":{"observed_at":"2026-08-11T11:18:38.309312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16705","last_updated":"2025-01-15T08:20:19Z","snapshot_observed_at":"2026-08-11T15:15:39.054115Z","submitted_at":"2024-02-26T16:21:53Z","title":"SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16705","snapshot_observed_at":"2026-08-11T11:18:32.818346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.818346Z"},"links":{"cited_paper":"/paper/2402.16705","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:f301aee48dc0b913b780051bae0a8578a05f616462e18b5ab8faf8ee42bdf03f","observation_id":"2ce0241e-971f-40ff-93c8-87339c26f392","resolution":{"observed_at":"2026-08-11T11:18:32.818346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-11T11:18:32.955524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:32.955524Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:17a75df7987a5229ff6ef83d90a56c9d7f71facdfc6ce3e718b3b53489092b35","observation_id":"216ab578-24bf-42b6-95ce-3b6c81033c6e","resolution":{"observed_at":"2026-08-11T11:18:32.955524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09559","last_updated":"2024-10-10T14:16:13Z","snapshot_observed_at":"2026-08-10T22:11:17.939670Z","submitted_at":"2024-03-14T16:47:25Z","title":"Less is More: High-value Data Selection for Visual Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09559","snapshot_observed_at":"2026-08-11T11:18:33.040213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.040213Z"},"links":{"cited_paper":"/paper/2403.09559","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:67eafae807be9005512ff22c67cf2d1d1b459391ec23f625cb1c2d3a6af51fab","observation_id":"9fb622e7-b2d1-4e35-99ea-02a9b116020e","resolution":{"observed_at":"2026-08-11T11:18:33.040213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.130713Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.130713Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9216f2b9a98436a68da12e02e096ee90019e508f7f45981794d64d4c4b787e62","observation_id":"b09ded32-d979-4951-80d3-10af61a35e73","resolution":{"observed_at":"2026-08-11T11:18:33.130713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.222134Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.222134Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c11caca2454037639ed8bdeedabf1a3854fc46f430c2f979051fbc60d358a289","observation_id":"667dd2e7-2fb0-4e3d-90d6-b3d9f8b0d8e7","resolution":{"observed_at":"2026-08-11T11:18:33.222134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.183623Z","title":null,"venue":null,"work_id":"9ac9ffd4-5654-42b4-8438-b43fab30ee52","year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.321274Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a8b7442415a911b76f0a0930181eb24ae97e5be9edb3d3fc4b6fe3a224fb0e94","observation_id":"15e65d40-99cb-4c92-a3e5-226078ac0763","resolution":{"observed_at":"2026-08-11T11:18:38.188161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.00183","last_updated":"2017-11-29T20:57:09Z","snapshot_observed_at":"2026-07-06T05:49:21.582343Z","submitted_at":"2017-07-01T18:13:17Z","title":"Teacher-Student Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.00183","snapshot_observed_at":"2026-08-11T11:18:33.449700Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.449700Z"},"links":{"cited_paper":"/paper/1707.00183","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c36cba55c349564d66f97cdd3d0c485b23e849de696b287adc0d14d07d5fd3b8","observation_id":"1b2cf0f5-bd7f-4514-bc62-085f04d82d14","resolution":{"observed_at":"2026-08-11T11:18:33.449700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.172316Z","title":null,"venue":null,"work_id":"ee483fe8-702a-48ea-9508-3f2f6d789887","year":2020},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.527172Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4cc0cedc4c1e3a015a23f5c079a24a24b346d11e552ea119a646be43ab0725a5","observation_id":"afeae7be-cc70-4b9a-bd36-59c49d5e88aa","resolution":{"observed_at":"2026-08-11T11:18:38.175783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18334","last_updated":"2024-09-11T16:28:29Z","snapshot_observed_at":"2026-08-04T21:38:01.483476Z","submitted_at":"2024-02-28T13:54:57Z","title":"Learning to Generate Instruction Tuning Datasets for Zero-Shot Task Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18334","snapshot_observed_at":"2026-08-11T11:18:33.595166Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.595166Z"},"links":{"cited_paper":"/paper/2402.18334","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:70aa8ed76bbfeb9ef13c4feade14d6175df218d080029b81d978fb3ba0ca5063","observation_id":"60719554-ca92-453e-9c60-d13603a36822","resolution":{"observed_at":"2026-08-11T11:18:33.595166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.155436Z","title":null,"venue":null,"work_id":"bfa55cff-5b64-4750-a023-4d1d7f2e4b1f","year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.648636Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:01f9220447faa8b982cfa9682e1765a28cc2bfff32b6308d88d538eafb21e2fb","observation_id":"c548d4c3-fae7-407a-b2c9-c55d68c1b059","resolution":{"observed_at":"2026-08-11T11:18:38.159969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1601.00617","last_updated":"2016-06-12T20:09:06Z","snapshot_observed_at":"2026-07-06T04:41:47.106282Z","submitted_at":"2016-01-04T19:38:18Z","title":"Coresets and Sketches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1601.00617","snapshot_observed_at":"2026-08-11T11:18:33.697699Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.697699Z"},"links":{"cited_paper":"/paper/1601.00617","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:1cbae911418366a016acd463981ab5985d5a1a1bd266d4b4608a86959b45bfe4","observation_id":"bc69375c-5a82-4067-9198-c21c2f917e67","resolution":{"observed_at":"2026-08-11T11:18:33.697699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14999","last_updated":"2023-11-02T02:40:48Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:36:14Z","title":"The Art of SOCRATIC QUESTIONING: Recursive Thinking with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14999","snapshot_observed_at":"2026-08-11T11:18:33.773378Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.773378Z"},"links":{"cited_paper":"/paper/2305.14999","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4c0040d33eabdd8a91bbdbaabd8233c406439b7d089a2b95bf2810d404c6bbce","observation_id":"6344f884-17ee-4a77-bd79-99baa3e92330","resolution":{"observed_at":"2026-08-11T11:18:33.773378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:33.816260Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.816260Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a26420cf89cbf18dc958c09700589c37c495a51d9296d3dd13dfc97cec147f67","observation_id":"fc988ede-1ba8-458c-a6f8-59b10331de5b","resolution":{"observed_at":"2026-08-11T11:18:33.816260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.124777Z","title":null,"venue":null,"work_id":"fe13b180-5e7f-485f-9c73-450cf15e4a08","year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:33.991364Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:0a6e8501b189870390070b7015191c02831af59b2423c0cef07c799320a296b7","observation_id":"b4538710-a778-4376-95b3-5b86f4cf3338","resolution":{"observed_at":"2026-08-11T11:18:38.130890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-11T11:18:34.078033Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.078033Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e583a133b794fa7d531b88befef9252aa2356edbfaa41d31bb963f4709f5248a","observation_id":"2059d5aa-660a-4ec1-81e8-3a7aa4de4aa5","resolution":{"observed_at":"2026-08-11T11:18:34.078033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.251790Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.251790Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:35ac8107c56c476a677325e3096f32aaa74c452571af4a27f398bea96285f814","observation_id":"f694ba2e-dbe8-49f4-8ca6-6613b0d14394","resolution":{"observed_at":"2026-08-11T11:18:34.251790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.379138Z","title":null,"venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.379138Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a83b415693c4b5639e433bdf17c0a006254067f8dcbb139a93c412ed8860caff","observation_id":"aa3a9087-e05f-464e-9873-f54db7c09751","resolution":{"observed_at":"2026-08-11T11:18:34.379138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00489","last_updated":"2018-06-01T10:17:23Z","snapshot_observed_at":"2026-07-06T05:53:39.440274Z","submitted_at":"2017-08-01T19:50:53Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00489","snapshot_observed_at":"2026-08-11T11:18:34.483548Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.483548Z"},"links":{"cited_paper":"/paper/1708.00489","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:2d79d74ba3e1e06cbb903573702a1cdec357c614010c2ff999ee4e00014f3bd3","observation_id":"435ba5c0-0d0c-410f-a4d0-eb1cc2c08cdc","resolution":{"observed_at":"2026-08-11T11:18:34.483548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15896","last_updated":"2024-12-06T00:41:15Z","snapshot_observed_at":"2026-08-10T07:04:01.076978Z","submitted_at":"2024-02-24T20:15:31Z","title":"Multimodal Instruction Tuning with Conditional Mixture of LoRA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15896","snapshot_observed_at":"2026-08-11T11:18:34.569431Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.569431Z"},"links":{"cited_paper":"/paper/2402.15896","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9c5f595aaf4300d5ebea7e6a3fc4b0bc835e9b70614a17e03f9a6aaf6aa04e64","observation_id":"3a7c75a5-909e-4ade-9978-2d2220e070d3","resolution":{"observed_at":"2026-08-11T11:18:34.569431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-08-11T11:18:34.697632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.697632Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:21fb9b333b186dc29e802fba0d7d593ad762b223b304e1d7ad7d258aa2fe658b","observation_id":"3bf44a97-f29c-4d18-aa5a-540dc383d378","resolution":{"observed_at":"2026-08-11T11:18:34.697632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:34.785450Z","title":"less is more","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.785450Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:1988ecd1d458a134e9ac8969697b28c7d47722ad4b2d7ab88b25e21a01967e0f","observation_id":"bcfe6a0c-0fd5-46e9-8af0-c428284e72f8","resolution":{"observed_at":"2026-08-11T11:18:34.785450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05159","last_updated":"2019-11-15T17:08:30Z","snapshot_observed_at":"2026-08-01T06:33:25.731787Z","submitted_at":"2018-12-12T21:24:15Z","title":"An Empirical Study of Example Forgetting during Deep Neural Network Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05159","snapshot_observed_at":"2026-08-11T11:18:34.885180Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.885180Z"},"links":{"cited_paper":"/paper/1812.05159","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ee83f6f0902ab1acd0135ed1524ffe0aa3e76d14c398129b882f1bef6a2d3ed6","observation_id":"f5c4d211-200e-4f3e-b219-436def517b71","resolution":{"observed_at":"2026-08-11T11:18:34.885180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:38.039187Z","title":null,"venue":null,"work_id":"f942eeed-d188-4fba-9f3a-140ddc01e04c","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:34.971723Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b7a207b897fa6686ee41c005d56c4288d75fe03edad3ca329f01c9a7187737e5","observation_id":"2a25a334-7bcd-4438-a130-1635d1cd73f4","resolution":{"observed_at":"2026-08-11T11:18:38.083369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.887015Z","title":null,"venue":null,"work_id":"ce479737-1a72-4375-bd68-c6f8211ea264","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.048004Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:eb1e4c846a41f341596b878cb885bad37373e2b735dfb8d2a3b31a611ad1cc3b","observation_id":"b5020b83-286b-467c-982c-236f76503507","resolution":{"observed_at":"2026-08-11T11:18:37.933640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T11:18:35.125284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.125284Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:7dc806e1ef734a6456920cf246584ee81c7e2d74197d32dd2fe2de390da305ad","observation_id":"a0d322c3-7ddf-488a-92d3-30cc829093b1","resolution":{"observed_at":"2026-08-11T11:18:35.125284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08729","last_updated":"2024-05-14T16:15:31Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:15:31Z","title":"Targeted Augmentation for Low-Resource Event Extraction","version":1},"cited_work":{"arxiv_id":"2405.08729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.08729","snapshot_observed_at":"2026-08-11T11:18:36.831877Z","title":"Targeted Augmentation for Low-Resource Event Extraction","venue":"cs.CL","work_id":"4b38405e-e525-4d9a-a2e7-87ab5fa957da","year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.195201Z"},"links":{"cited_paper":"/paper/2405.08729","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:a37f948dc752f93dc7e548768eecd056efa04b8cbc9d8cec47335d5f8dd940ec","observation_id":"dd4af343-80ad-429e-9290-ec39c01783b8","resolution":{"observed_at":"2026-08-11T11:18:36.875301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.270768Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.270768Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:cf1e3f866a90929eeb08541ad23a09c5422255b2897700c568038c6eb59e1bd8","observation_id":"12a41e6b-f95f-4888-aab3-327106820520","resolution":{"observed_at":"2026-08-11T11:18:35.270768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T11:18:35.357071Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.357071Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:78069691f1b9c3d740edfecd7cd6a96493ef84c2ec27409d3c257bf5476e516e","observation_id":"ce47fc5a-8e0d-4388-a1f8-7ece4d3a7a3a","resolution":{"observed_at":"2026-08-11T11:18:35.357071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-11T11:18:35.574328Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.574328Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:1fdc13051359f36e69d390bbde6f0f8af07decaf4914eb9ba6ae03f94b984f08","observation_id":"d907da62-6237-4122-bedf-aa6fbfd84cc7","resolution":{"observed_at":"2026-08-11T11:18:35.574328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.605471Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.605471Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:8f6cd4109799289abb363028be8e050dfabeb53a9e2db7db2101442441a6bfea","observation_id":"6534863e-8749-4266-9e39-a0c25fb2a161","resolution":{"observed_at":"2026-08-11T11:18:35.605471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:18:35.618509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.618509Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:eb797f172bd1d800f8ac09b44954fca040f546efb810089de5ec20d28d250048","observation_id":"c249a302-567d-49ea-a5f7-c1bb3654e406","resolution":{"observed_at":"2026-08-11T11:18:35.618509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.855489Z","title":null,"venue":null,"work_id":"7093218e-d94a-4400-9135-a46f3e19ec15","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.623284Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:c4062b5b0c18bba9cad4426809dcf79127cd72c0f2c16ce2da4f49bbd88bda8b","observation_id":"5b5803ed-e612-4788-adc5-db6412a8fda5","resolution":{"observed_at":"2026-08-11T11:18:37.859840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09336","last_updated":"2024-10-25T04:28:06Z","snapshot_observed_at":"2026-08-04T13:55:09.184742Z","submitted_at":"2023-11-15T19:52:11Z","title":"LLMRefine: Pinpointing and Refining Large Language Models via Fine-Grained Actionable Feedback","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09336","snapshot_observed_at":"2026-08-11T11:18:35.661984Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.661984Z"},"links":{"cited_paper":"/paper/2311.09336","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:b48fec644558434227ae94a81cee6ad98da8a8e04dc1102472a1056acc41d5e5","observation_id":"00868247-cc74-4295-8907-727268ca5f79","resolution":{"observed_at":"2026-08-11T11:18:35.661984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11690","last_updated":"2024-02-18T19:38:44Z","snapshot_observed_at":"2026-08-10T03:16:47.204688Z","submitted_at":"2024-02-18T19:38:44Z","title":"Vision-Flan: Scaling Human-Labeled Tasks in Visual Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11690","snapshot_observed_at":"2026-08-11T11:18:35.752639Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.752639Z"},"links":{"cited_paper":"/paper/2402.11690","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:64d050a67a089d0aca427bbea8920fae6e7024a5a3c43da8b390d8666a9a2d14","observation_id":"91456423-fd33-4212-b3bb-c03357759183","resolution":{"observed_at":"2026-08-11T11:18:35.752639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.839702Z","title":null,"venue":null,"work_id":"58179095-ebb5-4d98-a291-cc034d394d34","year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.814140Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:885f9c07c4327c1166e500983bb9bfb6ffbb051bba943447a2440ae9d74ba9a0","observation_id":"4a576643-f4d7-4392-9e30-84e5d858675d","resolution":{"observed_at":"2026-08-11T11:18:37.844906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-11T11:18:35.819567Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.819567Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:8d3235490d91204bb36cbab347d6956ef195d69663a5c33a349e41a181af5ba2","observation_id":"b12bfbe8-7a8c-43a0-a180-5215ad5abdc9","resolution":{"observed_at":"2026-08-11T11:18:35.819567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04684","last_updated":"2025-06-20T16:50:07Z","snapshot_observed_at":"2026-07-06T16:58:36.087327Z","submitted_at":"2023-12-07T20:36:10Z","title":"LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04684","snapshot_observed_at":"2026-08-11T11:18:35.824564Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.824564Z"},"links":{"cited_paper":"/paper/2312.04684","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:43e2fc99732348c885693b57afe93ffb53862d9bb194f2cb81a2e19a8b863215","observation_id":"79b86308-ce03-4b75-b3ec-1a751303a4e9","resolution":{"observed_at":"2026-08-11T11:18:35.824564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15746","last_updated":"2023-10-24T11:40:34Z","snapshot_observed_at":"2026-08-11T15:56:10.119184Z","submitted_at":"2023-10-24T11:40:34Z","title":"Failures Pave the Way: Enhancing Large Language Models through Tuning-free Rule Accumulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15746","snapshot_observed_at":"2026-08-11T11:18:35.830611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.830611Z"},"links":{"cited_paper":"/paper/2310.15746","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:86ac8643dd872d54ca612a9b56c4f6c502cc294e1a152abccd2c6facf13f6fb9","observation_id":"53543478-6a96-4a27-bf01-ae481adfb4ab","resolution":{"observed_at":"2026-08-11T11:18:35.830611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14725","last_updated":"2025-06-10T23:03:39Z","snapshot_observed_at":"2026-08-10T17:23:59.740634Z","submitted_at":"2023-05-24T05:01:48Z","title":"AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14725","snapshot_observed_at":"2026-08-11T11:18:35.835904Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.835904Z"},"links":{"cited_paper":"/paper/2305.14725","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:bc8178808949243d49a2cf6b9c505006dd05332edc371116177d493f9f443c5f","observation_id":"868fcbe3-7a17-4c72-bf83-bd406355b332","resolution":{"observed_at":"2026-08-11T11:18:35.835904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:35.911096Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.911096Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:687b3e3d25369c678ac6940dd3b1c5fbf69e4573bafe21d27505eb2725a7e451","observation_id":"3c5f6611-d028-4253-976f-2c6e394e6f0b","resolution":{"observed_at":"2026-08-11T11:18:35.911096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-11T11:18:36.009995Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.009995Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:717abd19848cfbd04acdbd86c4abd4d30c1557da829cea534042e631981f9b7e","observation_id":"dfdf7c73-b0c0-4137-9256-02c6d12a1a47","resolution":{"observed_at":"2026-08-11T11:18:36.009995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16502","snapshot_observed_at":"2026-08-11T11:18:36.136897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.136897Z"},"links":{"cited_paper":"/paper/2311.16502","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:ef1ce45ec4f2546d01a54c8d545eb6292fd6513c1d7c2adb66d96e537dfbc943","observation_id":"f4c5ccf7-664d-4e9d-b1c0-7496d4af746b","resolution":{"observed_at":"2026-08-11T11:18:36.136897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:37.816136Z","title":null,"venue":null,"work_id":"6ba4c2cf-2b3e-49e9-9329-65db656e11ab","year":2019},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.143521Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:e80f2ac67087564483f120a9061bed7b292c3fef24ac7016ff90632ea76db89c","observation_id":"5d057f1d-9e55-4c6c-a8ee-f70cb651424e","resolution":{"observed_at":"2026-08-11T11:18:37.820821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12874","last_updated":"2024-08-12T00:38:22Z","snapshot_observed_at":"2026-08-08T16:13:07.352678Z","submitted_at":"2024-07-16T04:41:58Z","title":"SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12874","snapshot_observed_at":"2026-08-11T11:18:36.149022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.149022Z"},"links":{"cited_paper":"/paper/2407.12874","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:3f93b80892979d3c29085f900c8d8788ac877902a389b189952d9059823ea775","observation_id":"24c92789-2acb-4a7f-a46b-009bd64377b1","resolution":{"observed_at":"2026-08-11T11:18:36.149022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07915","last_updated":"2024-03-20T16:17:02Z","snapshot_observed_at":"2026-07-06T16:18:37.399390Z","submitted_at":"2023-09-14T17:59:17Z","title":"MMICL: Empowering Vision-language Model with Multi-Modal In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07915","snapshot_observed_at":"2026-08-11T11:18:36.156440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.156440Z"},"links":{"cited_paper":"/paper/2309.07915","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:aec2f4585f7e6a48413b94abaa136c1f21ed7c7f2cd8fdb731af54105a4fb2af","observation_id":"b0b96954-b851-409c-8d63-955f851ffe3e","resolution":{"observed_at":"2026-08-11T11:18:36.156440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.184245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.184245Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:4b9b6f948ec0d4ad3c439947c6d17f1925fb58e5df5a9b9830849455e0588ba9","observation_id":"701e0841-de9c-4727-9d8f-89b27a75bf17","resolution":{"observed_at":"2026-08-11T11:18:36.184245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.277215Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.277215Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:913c040f525d4a91d9bb519659430c7c94fd16b7adf4a5f255c5e5545201407f","observation_id":"01cd7e82-280f-4a01-a65a-27d8ffd404a3","resolution":{"observed_at":"2026-08-11T11:18:36.277215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.307821Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.307821Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:fea61f5e865cbbd1e419cf4ef73f5e69d92a0b70225d07b371dfd4a3b4749847","observation_id":"52e73df0-8696-4416-bcbd-103a50a328c9","resolution":{"observed_at":"2026-08-11T11:18:36.307821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:18:36.313017Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:36.313017Z"},"links":{"citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:9177a26b4dc8f8df5a6d44bfd725ed9c0fe5aae60295101700fd0d251f84a8dd","observation_id":"2785296a-3c9c-4646-986c-4d1da57a320d","resolution":{"observed_at":"2026-08-11T11:18:36.313017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T20:27:57.151575Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning"},"reference_resolution":{"displayed":88,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":88},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2412.15652."}