{"as_of":"2026-08-15T10:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d626ed7906a6e5771cfa3008a0b90c8ac48a058873e39548efc431141fe4d12d","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:14:56.957808Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:08:49.205080Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T04:08:53.251034Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.05939","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05939","snapshot_observed_at":"2026-08-07T04:08:53.251034Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","venue":"cs.CV","work_id":"07a6030b-2fec-41cf-b5b8-2505c94f2440","year":2024},"citing_paper":{"arxiv_id":"2506.11515","last_updated":"2025-06-13T07:16:41Z","snapshot_observed_at":"2026-08-14T02:40:24.668658Z","submitted_at":"2025-06-13T07:16:41Z","title":"Manager: Aggregating Insights from Unimodal Experts in Two-Tower VLMs and MLLMs","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-07T04:08:49.205080Z"},"links":{"cited_paper":"/paper/2412.05939","citing_paper":"/paper/2506.11515"},"observation_digest":"sha256:fa9b9db86095d22cc6631400203ff9976eadb5eb164e02e6f1e686770497eae6","observation_id":"a2673b7b-bbbd-415f-820a-73268831873c","resolution":{"observed_at":"2026-08-07T04:08:53.344399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05939/citation-record","integrity":"/paper/2412.05939/integrity","json":"/paper/2412.05939/citation-record.json","paper":"/paper/2412.05939"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.998517Z","title":"For V3Det, we remove object labels with frequency less than 3","venue":null,"work_id":"b643bc88-d85e-45ae-86a0-d60937c18cad","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.626495Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:5c49680950228509f163f9a82e6bb2a870dc716e21be921e543ed44fdf683b80","observation_id":"86f25a70-1968-4825-9dae-671de663f430","resolution":{"observed_at":"2026-08-11T20:14:58.002749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.983801Z","title":"For Open Images, we also remove the attribute and relationship annotations corresponding to these illegal objects","venue":null,"work_id":"f778c6d1-e2f9-446e-8575-1a20c1911e0c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.632723Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c620acc869b58a41886da203b190c1e42bd0ef5fafc8c871c0202731bd8d9f06","observation_id":"a5cad1f9-2016-4227-a1f4-9f34a0e70bbc","resolution":{"observed_at":"2026-08-11T20:14:57.988782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.964198Z","title":null,"venue":null,"work_id":"a2c18d50-92b2-4642-a79b-7a445c94a77b","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.638144Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:8b36c18b1431cef8c8b5030cf17c1ee78c48ffe07e2c9da74a588f8f33a07229","observation_id":"f9b63835-85f7-4e18-920c-2878327796c7","resolution":{"observed_at":"2026-08-11T20:14:57.974477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.903259Z","title":null,"venue":null,"work_id":"388c8d50-65a7-4bc7-8cbe-2efccb373acb","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.655461Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:4c698c0eaf4c4bc5d33d233d38bec852d569b61c614521bb9831d1b7cad09935","observation_id":"e0b271e5-88d5-4254-9a0a-9dc682c5aaca","resolution":{"observed_at":"2026-08-11T20:14:57.908428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02992","last_updated":"2024-04-26T01:24:57Z","snapshot_observed_at":"2026-08-14T08:27:28.609458Z","submitted_at":"2023-10-04T17:28:44Z","title":"Kosmos-G: Generating Images in Context with Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02992","snapshot_observed_at":"2026-08-11T20:14:56.594042Z","title":"Zhiliang Peng, Li Dong, Hangbo Bao, Qixiang Ye, and Furu Wei","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.594042Z"},"links":{"cited_paper":"/paper/2310.02992","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:07e2cdb1003b3ba54bf6babaa3fd2beb9975ac283967bf1a9a73c6573f8914ef","observation_id":"0155ab72-192d-4ae9-bf5c-69e738d3b83b","resolution":{"observed_at":"2026-08-11T20:14:56.594042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-12T21:25:32.312122Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-11T20:14:56.599821Z","title":"Lewei Yao, Jianhua Han, Youpeng Wen, Xiaodan Liang, Dan Xu, Wei Zhang, Zhenguo Li, Chunjing Xu, and Hang Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.599821Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e666ddc1440f0acd6252daba497d73d1b70470952e9ebbec9092e956a40d6f65","observation_id":"45c5c501-d04e-4eed-9241-6db4752e7282","resolution":{"observed_at":"2026-08-11T20:14:56.599821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09251","last_updated":"2023-12-14T18:59:43Z","snapshot_observed_at":"2026-08-14T17:39:36.185216Z","submitted_at":"2023-12-14T18:59:43Z","title":"VL-GPT: A Generative Pre-trained Transformer for Vision and Language Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09251","snapshot_observed_at":"2026-08-11T20:14:56.605430Z","title":"Jinguo Zhu, Xiaohan Ding, Yixiao Ge, Yuying Ge, Sijie Zhao, Hengshuang Zhao, Xiaohua Wang, and Ying Shan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.605430Z"},"links":{"cited_paper":"/paper/2312.09251","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:429ab87d249b8b529ab721420f7d6d789b76c6d6dac71282f448b33c17efad98","observation_id":"a92aea54-cee4-49cf-a20e-bbf5f78850c7","resolution":{"observed_at":"2026-08-11T20:14:56.605430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.041789Z","title":"Instance Location, Instance Interaction, Visual Reasoning","venue":null,"work_id":"f5a8cb6a-fbcd-4529-8c7d-ae653c112e0d","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.610955Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:dde4585707ad4207996a696d95c1f03860c291b35a28b45fc570d5fef13d62a9","observation_id":"4221501a-1918-4bea-8614-57970eebe879","resolution":{"observed_at":"2026-08-11T20:14:58.046685Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.011570Z","title":"batter” → “batter (ballplayer)","venue":null,"work_id":"9c6cc48d-83be-4cda-a8fe-38323f4084fb","year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.621196Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:54d214c02b05b9a8af818b426cc1895ca6f65d41040309fccfa948768b33029b","observation_id":"ac2d4aa7-6bb6-479f-bea7-641b89a52f69","resolution":{"observed_at":"2026-08-11T20:14:58.016480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.948858Z","title":null,"venue":null,"work_id":"4da57dec-f1a1-4759-a3e3-98186847e4ac","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.642335Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ad3a8071bc09f84e70e67f75b7bb5e16ee4e88362ec3b490d412e24841b856f5","observation_id":"c0873608-b736-45ac-9afd-fb45da685f55","resolution":{"observed_at":"2026-08-11T20:14:57.953908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.934451Z","title":"We also remove objects that have illegal coordinates or exceed the image range","venue":null,"work_id":"ce86eb6c-2748-4864-9d65-8c47e488379c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.646214Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:563d2dcd5f14122418d2c8e29048de314561d90df483b15001f654d4b15617db","observation_id":"c5a1cfe8-9b7e-4f10-a233-42a0a8ddadce","resolution":{"observed_at":"2026-08-11T20:14:57.939375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.919268Z","title":"batter (baseball player)","venue":null,"work_id":"0feba96c-1744-489d-b1b5-587bd09ea1b2","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.650250Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e0f912e9592f8a4d16c126cfcd6152c13acde565810c5edd888281d39de9b6fc","observation_id":"c7945383-35f1-401b-b4da-ad271d5fc579","resolution":{"observed_at":"2026-08-11T20:14:57.924134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.888199Z","title":"Secondly, we count the frequency of each label and remove the relationship/attribute whose frequency is less than 5 or is empty","venue":null,"work_id":"81be0e3f-3c90-4420-9627-bff06fdebace","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.660626Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:7396b11cdb10be6b6dda3c6c7c75fa774b87610d0639beec97c730b4d3168e4b","observation_id":"8d579735-5c71-4d73-84fc-8c55deca54ee","resolution":{"observed_at":"2026-08-11T20:14:57.893528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.873584Z","title":"For unreasonable labels, we remove them and the corresponding object, attribute, relationship annotations","venue":null,"work_id":"c5401946-65bf-4d85-87ca-7bc137c18373","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.665028Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:87c89a465a4e7d2e6ee2fb38e4e6eeffac7f63830b706625704595f3003c5bb2","observation_id":"f226edde-00bf-43a5-aff0-97bc67061d68","resolution":{"observed_at":"2026-08-11T20:14:57.878193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.859328Z","title":"For images in Visual Genome with a flickr id but no coco id, we match them with images from flickr30k and discard the matched images","venue":null,"work_id":"959c750d-e81b-4ec0-94f9-446865bcadcc","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.669674Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1a7ec0e00549ace6178aa7549fcb9269d54b3e1fd863915b2b247d33211b0994","observation_id":"721bb45c-afd5-4a19-aff7-7a214836a14a","resolution":{"observed_at":"2026-08-11T20:14:57.863808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.845283Z","title":null,"venue":null,"work_id":"af26bf20-54f4-45f2-9323-b4385e660435","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.674257Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:06959e108b0adda6d59b9538e77dc5ccb196ab8fb10b6cc2673ff2cc1a0cfef2","observation_id":"7e644ff2-037f-45e2-aab5-90bd5ef6d20b","resolution":{"observed_at":"2026-08-11T20:14:57.850058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.830509Z","title":null,"venue":null,"work_id":"ed785c50-1cde-4279-9660-884b41462a65","year":2021},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.678937Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:b85957cec393e9e7df9e9fab21a7a787bb5c2bc448e679f60e8373cf577ac8cc","observation_id":"b269db73-6e28-47a0-8c7f-f8e7e69c1a18","resolution":{"observed_at":"2026-08-11T20:14:57.835356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.817027Z","title":null,"venue":null,"work_id":"4595d4ba-a7e5-46f0-a71b-6a4206bcfb7f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.683239Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ba8937822729614e9ba7cb453f0140f109aac4f6727869a2551a384f10a91e8c","observation_id":"09ea4dcf-48be-4e8f-a650-148acc8c3fbc","resolution":{"observed_at":"2026-08-11T20:14:57.821104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.801965Z","title":"If no caption is selected, we select the caption with the highest similarity score","venue":null,"work_id":"07884757-d72c-4d29-a265-ff76384e30fd","year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.688145Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:2d7d4a7c7f0ef45d06c0334e655a907d8727325ac55ee9d4d2022fb0daeb138b","observation_id":"8a654fef-8175-49e6-8b7a-aec90030e681","resolution":{"observed_at":"2026-08-11T20:14:57.806754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.787650Z","title":null,"venue":null,"work_id":"2fbe4fd3-ae14-4988-8d9c-0846e7228b47","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.693243Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:a9270088839c3cac8078cbbbddd61292aeba95693560f99e7a1cba8013d0e9cc","observation_id":"06726344-e681-4c39-93f0-09151dad2b41","resolution":{"observed_at":"2026-08-11T20:14:57.792486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.773514Z","title":"Then we remove the descriptions with a probability of 0.5 to prevent model overfitting which might be caused by description repetitions","venue":null,"work_id":"7c5b72d1-6c89-4bd1-b4fb-d0b7b71bc00e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.698176Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:efa6ead8810429e2b48af7aea3aac8d3963623f81d6cba54e99f7870888b35a8","observation_id":"a0564405-1a01-46bb-853f-e2c80319cc88","resolution":{"observed_at":"2026-08-11T20:14:57.778372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.758586Z","title":"Secondly, we replace the positions corresponding to [IMG] using the corresponding visual token sequence with [IMG] and [/IMG] inserted before and after it","venue":null,"work_id":"2a0bc1d1-d910-4164-811a-4dbc649b11b0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.702653Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c29e98d2b871cc5bdbb0d35bab4e1354667cb1f87fb3abe14bb90253e6a3b929","observation_id":"43fd7009-d5be-4af5-97a4-1059c595e0fe","resolution":{"observed_at":"2026-08-11T20:14:57.763406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.745000Z","title":"Detail caption instruction","venue":null,"work_id":"edef17df-0b70-4b45-ad53-2eb1fc18670e","year":2011},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.707352Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:f7f07cda95ec8ffd3679053d33d7bb73ea07ce4920d339d431b88ef1e2023bf8","observation_id":"3de25e1a-7e59-4147-9c2f-b1c700c67a68","resolution":{"observed_at":"2026-08-11T20:14:57.749184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.616054Z","title":"It resembles a large pig in shape, with a short, prehensile trunk, small eyes, and pointed ears","venue":null,"work_id":"cf2beee6-11f1-482f-ba07-4eb5e24ec5a5","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.749625Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:171e90123c85a78d96ff573dcb1832d692519c0945eedda867bf0e52fdd4fbad","observation_id":"b691cb9d-7568-48f6-b98e-4aa16fd688c0","resolution":{"observed_at":"2026-08-11T20:14:57.620847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.480789Z","title":null,"venue":null,"work_id":"76951b49-75b4-4df2-a2df-a98a1b11582f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.786990Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:6808a6a023e302ec5acccb4090d85ae993f28562a1eed13ae59d931c6f2f9732","observation_id":"0519d2f5-0252-4ab0-a65f-d3e0211374c9","resolution":{"observed_at":"2026-08-11T20:14:57.486201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.464907Z","title":null,"venue":null,"work_id":"2760666d-1c2a-4124-9c31-4e2f8cb9607a","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.791904Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:82da97ecf7202a293ac10f4749f97769255203d7307d58c1eff731e2a87e96b6","observation_id":"2d961eb4-017f-44ab-a950-fcad9217b560","resolution":{"observed_at":"2026-08-11T20:14:57.469457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.354401Z","title":"Invalid","venue":null,"work_id":"38707dab-7402-4ad2-a515-4668e0d171ec","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.827982Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c3d282d2ddc53df0c2f5b996ac276f715f07a2b3ab0d812965ea68e9ba5445e6","observation_id":"a51a9a2f-4dcd-4008-8ed2-79b2804f6a91","resolution":{"observed_at":"2026-08-11T20:14:57.358898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.731727Z","title":null,"venue":null,"work_id":"0dc1c48b-f807-4edd-95cc-c3fe27c1462e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.832495Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:71c0ed4cd853e034390b4fd9bfafef57f1182b3a95df93279a823de01eb5e8f6","observation_id":"affb92a0-1eff-4e38-8e0f-e2cc83875be5","resolution":{"observed_at":"2026-08-11T20:14:57.736201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.718632Z","title":"bank\" can be","venue":null,"work_id":"53d8c52c-30b8-4329-8a7f-983b7324e67e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.837073Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:cd694e33d75ef62adbdcbe3097108b544d500f3398fca91b8e6db95a221581b8","observation_id":"75b02bc5-aa7e-47dc-b5d7-cad946c8eb48","resolution":{"observed_at":"2026-08-11T20:14:57.722923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.704628Z","title":null,"venue":null,"work_id":"a4c82212-b447-44d6-9c26-29c94d2594a1","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.841342Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ecee8861f846e4cf84a6557c397603c0b6d400078aae347c4cdb7a5fe5f0f219","observation_id":"a0339240-6c81-40bc-87cd-de5c3b242f34","resolution":{"observed_at":"2026-08-11T20:14:57.709287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.690113Z","title":null,"venue":null,"work_id":"dd52899e-0c97-43ba-b2e7-3e90837b0d09","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.845632Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:cdbb666349bffdeb4ad8bd1cdf673f164eb64e732f34a14449802709829c3814","observation_id":"281220d6-3bd4-4e0d-a4bb-9feb09e8a820","resolution":{"observed_at":"2026-08-11T20:14:57.694632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.674302Z","title":null,"venue":null,"work_id":"25c8fb09-97f1-4ad6-8056-df1b3e53f6bd","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.850173Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:a8c6013c8ef22c0a95039ab80cb818ff95f8dd7a1bbb27d9a5298f95c5290831","observation_id":"68c69e42-74df-48b6-9991-fb999ac6bdfc","resolution":{"observed_at":"2026-08-11T20:14:57.679370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.659693Z","title":null,"venue":null,"work_id":"d69e7e7f-7d21-4085-aa7e-98f887b89837","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.854197Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ada9c2b66357768baaaec55adee9b92ddbc3a1e31e6f9a1f28e61f79c4f6f815","observation_id":"d650eeb7-eff4-49bc-a673-aa397f412c06","resolution":{"observed_at":"2026-08-11T20:14:57.664201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.645270Z","title":null,"venue":null,"work_id":"576be1b2-4563-4134-9757-b84515674d34","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.858331Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:dee3069e86b3a20fd605ad409144b1aeca1b6bec9584263c42f82804ab1ac2d9","observation_id":"ce8b98ca-f938-4d59-94da-9b3563f19a93","resolution":{"observed_at":"2026-08-11T20:14:57.649787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.630087Z","title":null,"venue":null,"work_id":"b8d00e02-6c4b-4005-9223-f9686c193d01","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.863353Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:d71d87e2b18a4f1e12ec79136d3528bb875c436c9a961f2ff991b3d6c6371463","observation_id":"e3faae6e-4259-4b79-8b79-bd6341123dac","resolution":{"observed_at":"2026-08-11T20:14:57.634479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.340156Z","title":"It resembles a large pig in shape, with a short, prehensile trunk, small eyes, and pointed ears","venue":null,"work_id":"93fbff44-a165-4529-bbb1-3ef46850015d","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.867494Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:5241a71db06bd7a8cadd94d3db3707cdb402dd5b1b2a82abd6999a71d134cf67","observation_id":"57503e9a-58a7-45fe-9b9d-1c111516f92e","resolution":{"observed_at":"2026-08-11T20:14:57.344589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.325469Z","title":"You should disregard such noisy related object category labels","venue":null,"work_id":"143818cc-7205-4f0e-95ce-2cb97526d9e0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.872755Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:8e4ed51c90b6d920aeba0586cf876df9f220b75fd8cbd87a27bc30d10dcaabb1","observation_id":"a50e25e3-dbd5-4daf-8b7b-7d60b8ac0865","resolution":{"observed_at":"2026-08-11T20:14:57.330356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.309708Z","title":"Invalid","venue":null,"work_id":"6802aaf9-5909-40dd-86cc-ae42a3b44ab7","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.877645Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:daa3be3c001c037c5bfeabc0d3d79b528e0a5350cf5b9c536a90f1e6057fb230","observation_id":"4e59bed0-60a3-47be-8066-2563ae115bbe","resolution":{"observed_at":"2026-08-11T20:14:57.315244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.601002Z","title":null,"venue":null,"work_id":"cc9bc94d-97d2-4c6a-8577-4ad4858fb295","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.881599Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:4c4299d41f4bd1729c5645a8d57297c72f45a0449e676d898d224a2f94974f36","observation_id":"1bcbf797-8b54-41ad-aa3c-f275ccc6c8c5","resolution":{"observed_at":"2026-08-11T20:14:57.605866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.584866Z","title":"awake\" is an adjective meaning","venue":null,"work_id":"1fad0272-e295-435c-a270-18b6078d7a80","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.885537Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:f6c5bf0351edde7d8406f664a5304cf0965af5f9ae0afe49f55082b58c502924","observation_id":"944e42b5-1637-4941-ad15-4f07377809b9","resolution":{"observed_at":"2026-08-11T20:14:57.589464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.571372Z","title":null,"venue":null,"work_id":"d5693d49-45cf-4b49-a336-83d2285531b9","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.889297Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1037a5ce97e9931b121bec3ea1d6f1b0d6615c7cfc1da479709fa6d22399fcab","observation_id":"81bbfac1-3456-4fec-a690-53007260ab16","resolution":{"observed_at":"2026-08-11T20:14:57.575617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.556227Z","title":"This could include color, texture, size, sense, function, or any other aspect that is significant for the attribute","venue":null,"work_id":"505d26d5-73e3-4bec-9995-4b87b375c048","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.893166Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:08b7ec445aa0fc194c23475b16e403fc6c741665d9812960bfb7419506e0077c","observation_id":"5e620f1d-68cb-497d-8c49-8a682df32f14","resolution":{"observed_at":"2026-08-11T20:14:57.561034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.527202Z","title":null,"venue":null,"work_id":"093b354b-d381-4ca7-a583-f1a803c09313","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.900725Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:a3405d59f282c4213fad7bf3053d561d4831e609ff874b7d60f75a7a4a4b2fdf","observation_id":"0e570504-a0c5-42d7-a12e-e03e1e8f00d4","resolution":{"observed_at":"2026-08-11T20:14:57.532071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.510785Z","title":null,"venue":null,"work_id":"5cb7f16a-0159-41a2-bbf5-1737946d890c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.904521Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ad5ba9059baae3851d2f3e3e5ee0da717ddb00d10ae48684c385bf720ce93bf7","observation_id":"655bf87d-0e9c-4998-b3ef-2405c4ffd2bf","resolution":{"observed_at":"2026-08-11T20:14:57.516606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.495950Z","title":null,"venue":null,"work_id":"4f100f67-622f-4731-bdb0-de2612255d21","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.908169Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:9163ee531c13c36a79aece66d83d3bfdaede3f378dd4d0089232046ae24310d2","observation_id":"ac8ec7ac-92ae-474e-a315-d06c74cd9b71","resolution":{"observed_at":"2026-08-11T20:14:57.501350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.292904Z","title":null,"venue":null,"work_id":"ec017d6a-0921-46de-8b9c-176db11e56e4","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.912235Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:627fb3d47b0ed0dab4c992209cdc61feeba1132372b6e9a45f5057151a6d1326","observation_id":"5d88c803-46d2-4798-a5d0-5573a947c182","resolution":{"observed_at":"2026-08-11T20:14:57.298316Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.276092Z","title":"You should disregard such noisy related subject-object pairs","venue":null,"work_id":"6ba40736-9741-450f-a2a4-7cb4166e362f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.916513Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c8fb885c426f6e7670da040178f743128e1d8ac37e82f320bd62e326100b7b15","observation_id":"a355aaf7-9168-4951-a55a-2eed8ba73a3d","resolution":{"observed_at":"2026-08-11T20:14:57.282372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.260961Z","title":"Invalid","venue":null,"work_id":"7bf26c8e-ca9f-4fe9-9bb8-d748954fa408","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.920376Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:fa5d91170e617c289931384470e7e2bad8812b2d77963921a41c909c6a9dac97","observation_id":"81f6b493-0395-430a-ac4a-19a4eb9ab7bd","resolution":{"observed_at":"2026-08-11T20:14:57.265631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.245138Z","title":null,"venue":null,"work_id":"b7a148a3-1177-4317-b1c7-ad2cbeb1416c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.924681Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:989229be31e2590fc2f5893fdc93d73b6c9fbaf23d0586e7e8b416b74a5f9283","observation_id":"cd1b12ae-76e7-44cf-94d1-bac08b549f42","resolution":{"observed_at":"2026-08-11T20:14:57.250378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.449501Z","title":"truck\" is a verb meaning","venue":null,"work_id":"71a7f080-1e62-421b-b124-84f5153b23f0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.928934Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:241068703ad5ad6e65722a1c7e76f62cfec0a629eae1c2f095f7243eec30a471","observation_id":"b05feb79-3c19-48c9-8e92-48675d611573","resolution":{"observed_at":"2026-08-11T20:14:57.454668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.433857Z","title":null,"venue":null,"work_id":"6ce23561-6ce9-4f0b-8cb9-8cfec234d135","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.932845Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c0f87853a266addd764d9f278b658dc38415620011b14db6af67edacc348a8c6","observation_id":"92c49432-a71a-4b07-86f6-45f57dfa5bca","resolution":{"observed_at":"2026-08-11T20:14:57.439859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.418205Z","title":null,"venue":null,"work_id":"a7bd567c-33ea-421d-98e7-b2efe45077e3","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.936754Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:135c8d423da8bca2a105fab1b8f916658015536fc48f5b4a1e71112cedf82fa5","observation_id":"4e06afea-dec1-444e-968a-31315f7b6077","resolution":{"observed_at":"2026-08-11T20:14:57.423276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.541770Z","title":null,"venue":null,"work_id":"c00077cf-ac6f-4e97-888f-4e94113f1b32","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.940735Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:de186677211d9b8d133b19bac9b0385d9b87681f0dd51a5ada55159ac5fcb6c5","observation_id":"05b88217-8654-4797-8dac-4d9ecc3f690a","resolution":{"observed_at":"2026-08-11T20:14:57.546531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.402769Z","title":null,"venue":null,"work_id":"bdcb5c07-aa00-4b79-a2f7-468bd68b13c3","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.944496Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:4763f2e498d1e886187e665c80d5bde0a90e5c86a2b7511a1a3c6ad8f274c004","observation_id":"787e0036-dc03-4bd0-a464-17a8b200dc51","resolution":{"observed_at":"2026-08-11T20:14:57.407577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.386891Z","title":null,"venue":null,"work_id":"86963d62-0b64-423d-b026-f2a13869cbbf","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.948642Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:579904889eab9a4b322fa83d53e2b804600944b4cc463fe8dbbf5ab66f570fb6","observation_id":"65c93dfd-705a-4ada-8311-0dd09b613d2c","resolution":{"observed_at":"2026-08-11T20:14:57.392523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.370535Z","title":null,"venue":null,"work_id":"1a338057-d82a-4b2a-a3cb-8b5fbe64f6b9","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.953924Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:6d7c332729d8a2ecd2a1605497840cd095858e3423cb59f34e18b4572f7f662f","observation_id":"581a4a09-43f8-4b62-be63-e3023a6cdd1f","resolution":{"observed_at":"2026-08-11T20:14:57.376384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.229154Z","title":null,"venue":null,"work_id":"61ab2d4e-fd92-4d3b-949b-bfe29e247fe4","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.957808Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:4b14df6c6c289a8fcc1f3e7848cf39273bc5b2d03c0dca64f23d46451e2ed0f6","observation_id":"46f9acb5-0418-4f93-b16d-991c0803011f","resolution":{"observed_at":"2026-08-11T20:14:57.234613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.026151Z","title":"batter” → “batter (ballplayer)","venue":null,"work_id":"54ad6621-23ff-4973-9223-611fc266f539","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.616212Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:f23337a8ae99f65336b4ef661be73b1ad4f4b57e388316337aae2a7a6eb1ffcd","observation_id":"2f2a07b9-944d-48f7-a44b-67673b7d04d3","resolution":{"observed_at":"2026-08-11T20:14:58.031740Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-11T20:14:56.578719Z","title":"Jonathan Ho, Ajay Jain, and Pieter Abbeel","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.578719Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:8f767113f85c8e90e55152aad62222d166cb15853c627ad3fb356252ed6c6148","observation_id":"bfcab0fe-e17e-4378-bde6-f566bc15f339","resolution":{"observed_at":"2026-08-11T20:14:56.578719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09611","last_updated":"2024-04-18T18:51:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-14T17:51:32Z","title":"MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09611","snapshot_observed_at":"2026-08-11T20:14:56.588481Z","title":"URL https://openreview.net/pdf?id=E01k9048soZ","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.588481Z"},"links":{"cited_paper":"/paper/2403.09611","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:009b457161fd15b17062852f6651c582398eead1f9cb57143eef1dc6ab9d66f0","observation_id":"0818035c-79c4-4ac0-9e41-2f9af1ac53ef","resolution":{"observed_at":"2026-08-11T20:14:56.588481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-11T20:14:56.572962Z","title":"doi: 10.18653/v1/2024.acl-long.446","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.572962Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:d6a0d72b43202311b144ca56c1dd6cd8272f1c5f5955b158859151a73fa08d50","observation_id":"0f3705c9-8c74-4031-8864-94d81dbc2805","resolution":{"observed_at":"2026-08-11T20:14:56.572962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:56.583099Z","title":"doi: 10.1109/CVPR.2019.00686","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":6709,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.583099Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:d3457fbb7cb451faecf8ca3190824658580443f77723eab882b3b6af785ca436","observation_id":"c98f3d26-ca9a-4f3d-bff0-47e10caeb27a","resolution":{"observed_at":"2026-08-11T20:14:56.583099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T14:09:46.259879Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2412.05939."}