{"as_of":"2026-08-08T18:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f97642dc94542e64ee4c98bfedf51c0f1e8e8d9677484920fe1e714ca2701c3","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:43:59.481781Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T09:14:16.463173Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:4ce32fbe3de66962c69715e670e934c7027623cf357f648ca494cb8c8629a0d5","observation_id":"fde93e06-3f15-492a-85ab-da365e81ff90","resolution":{"observed_at":"2026-05-24T09:14:16.466194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2305.03726","last_updated":"2025-07-28T05:33:36Z","snapshot_observed_at":"2026-07-06T15:23:52.761222Z","submitted_at":"2023-05-05T17:59:46Z","title":"Otter: A Multi-Modal Model with In-Context Instruction Tuning","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-15T02:43:47.775691Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2305.03726"},"observation_digest":"sha256:1d17d4f02c53adb7f811aff9fbbfd681f812eac748dae5b54070bbc7f261b197","observation_id":"629f4b41-8689-4908-939a-3d0eb2628467","resolution":{"observed_at":"2026-05-15T02:43:47.887076Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T02:13:52.097263Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2305.06500"},"observation_digest":"sha256:82167226ab1943dcbc93c9d2313b0215cd8fd13c7ec8e91d7f2ef1b01da44017","observation_id":"e63c9893-e889-401c-b263-54d1317a6dfc","resolution":{"observed_at":"2026-05-13T02:13:52.162310Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T20:25:33.854923Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2306.13394"},"observation_digest":"sha256:ab27069149765a8075a6528a7205299de2faa2d6a1cbd493eb2bb868202d6452","observation_id":"f346baeb-1a5e-4080-89a4-ace0b5551339","resolution":{"observed_at":"2026-05-10T20:25:34.250884Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-16T02:56:41.658658Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2306.13549"},"observation_digest":"sha256:391a4539b852da0bc47b00d4de736bcc0b2402e4bf8a896d3e97d762224a6608","observation_id":"50137cd8-ac54-4bdc-a85e-125f94bb35cd","resolution":{"observed_at":"2026-05-16T02:56:42.675095Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2212.10773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qinyuan Ye, Bill Yuchen Lin, and Xiang Ren","venue":null,"work_id":"e55ac875-6538-4b8f-8400-fb64b49c0056","year":2022},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":280,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:cf422bbe06b79d5ffff8a89a416e761ceadf79f6833b1698a0338eb8e138a35d","observation_id":"1f6c1be1-0112-4b96-998d-b0f793db6cd3","resolution":{"observed_at":"2026-05-19T20:28:39.244930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-07T22:43:59.481781Z","title":"Multiinstruct: Improving multi-modal zero-shot learning via instruction tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09093","last_updated":"2025-02-13T09:04:28Z","snapshot_observed_at":"2026-08-08T00:11:22.694041Z","submitted_at":"2025-02-13T09:04:28Z","title":"From Visuals to Vocabulary: Establishing Equivalence Between Image and Text Token Through Autoregressive Pre-training in MLLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T22:43:59.481781Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2502.09093"},"observation_digest":"sha256:9e1dfa68b81473fc16ec2d83eda24672c63601ea6378a090df8e4faec4a74677","observation_id":"72e38b62-b111-41b5-ae2a-b7cc87228188","resolution":{"observed_at":"2026-08-07T22:43:59.481781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-07T14:37:53.282556Z","title":"Multiinstruct: Im- proving multi-modal zero-shot learning via instruction tun- ing.arXiv preprint arXiv:2212.10773, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18115","last_updated":"2025-05-23T17:14:12Z","snapshot_observed_at":"2026-08-08T00:41:58.877205Z","submitted_at":"2025-05-23T17:14:12Z","title":"Instructify: Demystifying Metadata to Visual Instruction Tuning Data Conversion","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:37:53.282556Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2505.18115"},"observation_digest":"sha256:0b17672f47d692e0ccd8777ff84fee73b3d9c1a2a8db2a0c62ba4e3fa28ee6ce","observation_id":"7b2e6457-62fd-42fb-a0e8-3d9c75c8c7c7","resolution":{"observed_at":"2026-08-07T14:37:53.282556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-07T12:11:52.785933Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00304","last_updated":"2025-05-30T23:22:44Z","snapshot_observed_at":"2026-08-08T03:25:28.974092Z","submitted_at":"2025-05-30T23:22:44Z","title":"Can LLMs Understand Unvoiced Speech? Exploring EMG-to-Text Conversion with LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:11:52.785933Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2506.00304"},"observation_digest":"sha256:0b237e0ae870e349ef712de8c4ff24ae56cac00af5c52b1ae11d08600d502719","observation_id":"5185a701-f321-4b12-839f-2bc92edb1fb1","resolution":{"observed_at":"2026-08-07T12:11:52.785933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10773","snapshot_observed_at":"2026-08-05T10:23:59.148488Z","title":"arXiv preprint arXiv:2212.10773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03890","last_updated":"2026-08-04T16:23:39Z","snapshot_observed_at":"2026-08-07T23:12:37.136740Z","submitted_at":"2026-08-04T16:23:39Z","title":"CARE-X: Towards Clinically Useful Radiology VLMs with Auxiliary Supervision, Reward-Aligned Learning, and Tool-Augmented Measurement","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-08-05T10:23:59.148488Z"},"links":{"cited_paper":"/paper/2212.10773","citing_paper":"/paper/2608.03890"},"observation_digest":"sha256:696c8fe98d4211f01e4b3e622b666c6ebb6c39b295d1279623eee09c85ffd886","observation_id":"f9340508-6582-4b6f-8286-651ed35a8bdc","resolution":{"observed_at":"2026-08-05T10:23:59.148488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2212.10773/citation-record","integrity":"/paper/2212.10773/integrity","json":"/paper/2212.10773/citation-record.json","paper":"/paper/2212.10773"},"outbound":[],"paper":{"arxiv_id":"2212.10773","last_updated":"2023-06-10T18:33:21Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T14:33:20.852718Z","submitted_at":"2022-12-21T05:17:06Z","title":"MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2212.10773."}