{"as_of":"2026-08-19T09:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:44d7b54f8a3d6cd17942e9817808b9f14143e68606dbbb4dc008127e27abc90d","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:01:53.257864Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:51:02.054133Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T11:13:02.866955Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03927","snapshot_observed_at":"2026-08-07T22:51:02.054133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09051","last_updated":"2025-02-13T08:05:44Z","snapshot_observed_at":"2026-08-16T11:45:49.640236Z","submitted_at":"2025-02-13T08:05:44Z","title":"AIDE: Agentically Improve Visual Language Model with Domain Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T22:51:02.054133Z"},"links":{"cited_paper":"/paper/2412.03927","citing_paper":"/paper/2502.09051"},"observation_digest":"sha256:8dbd90399d8fdb1eae434b0d26c5a47fea1f870fa1312473ac6ae8d3a40d38fe","observation_id":"288263e2-4415-4cd8-973d-2d77755e6549","resolution":{"observed_at":"2026-08-07T22:51:02.054133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2412.03927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03927","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Megacoin: Enhancing medium-grained color perception for vision-language models","venue":null,"work_id":"9a24e2bc-44e2-4f05-b0a9-4e0bebea9cba","year":2024},"citing_paper":{"arxiv_id":"2506.09082","last_updated":"2026-05-03T04:37:38Z","snapshot_observed_at":"2026-08-18T09:58:59.618504Z","submitted_at":"2025-06-10T05:43:34Z","title":"AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T11:12:41.130806Z"},"links":{"cited_paper":"/paper/2412.03927","citing_paper":"/paper/2506.09082"},"observation_digest":"sha256:d42b7ea2a78bf801b1c6ae1e107305c64d83220f40fc29607a8589f831153aec","observation_id":"dd796da5-a3e7-4af0-afcd-154ddd1da6c1","resolution":{"observed_at":"2026-05-19T11:13:02.869014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03927/citation-record","integrity":"/paper/2412.03927/integrity","json":"/paper/2412.03927/citation-record.json","paper":"/paper/2412.03927"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T22:01:52.979328Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:52.979328Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:67ea870ad1cf62dd2073546d6bde5bd2e83263a916c4fb37a56fe260cc9c71a1","observation_id":"e73f74d0-b785-40ba-9b88-4c9db2fe5aa5","resolution":{"observed_at":"2026-08-11T22:01:52.979328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:52.989589Z","title":"Vqa: Visual question answering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:52.989589Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:07e1cc370cffda7d15042d7be76b326acb38f80266be1eded66d5ba6e7508434","observation_id":"9cf6613d-11c8-4c85-b91a-854f9726d22f","resolution":{"observed_at":"2026-08-11T22:01:52.989589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-08-16T03:32:37.688772Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-08-11T22:01:52.996660Z","title":"Invariant risk minimization","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:52.996660Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:8bcacc1335c734a21deaa665aa73b69f6a5e3413671b72815a24c37b5d661596","observation_id":"425ab362-8b3f-4960-bd79-60b8621fe0ab","resolution":{"observed_at":"2026-08-11T22:01:52.996660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10340","last_updated":"2020-04-21T23:25:13Z","snapshot_observed_at":"2026-08-16T22:14:43.224904Z","submitted_at":"2020-04-21T23:25:13Z","title":"The iWildCam 2020 Competition Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10340","snapshot_observed_at":"2026-08-11T22:01:53.004327Z","title":"The iwildcam 2020 competition dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.004327Z"},"links":{"cited_paper":"/paper/2004.10340","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:32f99c835397c8a9ae1894a1f6a16bc47bbba725146ac159c7732e38ed7af494","observation_id":"4dbf04fe-2eba-468b-b868-4f30e9b057cc","resolution":{"observed_at":"2026-08-11T22:01:53.004327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08650","last_updated":"2025-02-13T08:06:42Z","snapshot_observed_at":"2026-08-16T16:08:03.462933Z","submitted_at":"2022-12-16T18:51:41Z","title":"ColorSense: A Study on Color Vision in Machine Visual Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08650","snapshot_observed_at":"2026-08-11T22:01:53.010760Z","title":"On human visual contrast sensitivity and machine vision robustness: A comparative study","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.010760Z"},"links":{"cited_paper":"/paper/2212.08650","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:6220303fd9c30f7390f7f3d6a422d326f2b839551bafac82aece842a45b0f95a","observation_id":"c94df8e9-9368-450a-9805-e27fd0b60a94","resolution":{"observed_at":"2026-08-11T22:01:53.010760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.420435Z","title":"Better may not be fairer: A study on subgroup discrepancy in image classification","venue":null,"work_id":"3defad07-3b15-4cad-9fcc-447c86187c41","year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.017592Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:8583debd93fbfd37fd51e8d302500fb7a406bfb0ce2bbadd8f271b78cbb05164","observation_id":"9e7e28a8-3540-4a27-bf53-65cdd5ca8722","resolution":{"observed_at":"2026-08-11T22:01:54.430097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.398797Z","title":"Probable domain generalization via quantile risk minimization","venue":null,"work_id":"d8ec616a-d089-4332-9293-05b8c4a73c7b","year":2022},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.022931Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:0f714b471177dd410619fadfc44429ec1825b861064415291bbe1ff57d1a201f","observation_id":"23fd4988-4699-4589-acaf-6a53ba76602e","resolution":{"observed_at":"2026-08-11T22:01:54.406045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.373200Z","title":"Mme: A compre- hensive evaluation benchmark for multimodal large language models, 2024","venue":null,"work_id":"efe76111-9338-46cd-9711-9b9082b7c322","year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.028869Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:df5afd935938d5ae8b7be807549d5689a448303dfcbb3b7509ce27e244fb2ed0","observation_id":"343aed6e-8af6-44cf-9774-6d486f7f75b1","resolution":{"observed_at":"2026-08-11T22:01:54.380349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.345752Z","title":"Car colour and risk of car crash injury: population based case control study","venue":null,"work_id":"e202e642-afce-42c0-9a87-8b56a93abfa8","year":2003},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.034175Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:7e3ad2837d2b00cb534e83bc55ae04110605b3453223a981b0d9dc6dae6ac640","observation_id":"e3633eb1-1723-4db4-b386-0c0ec4d54c22","resolution":{"observed_at":"2026-08-11T22:01:54.354120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.320017Z","title":"In search of lost do- main generalization, 2020","venue":null,"work_id":"8408f974-b1e9-43d8-b004-e3fa563f6163","year":2020},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.039243Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:fdc84eb6a9051002320b87c2684eedb454d99771913636940ffd60481d99d261","observation_id":"b25ecf3a-e6ae-43df-899b-f2ce028d9e45","resolution":{"observed_at":"2026-08-11T22:01:54.329338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11530","last_updated":"2024-07-22T09:54:40Z","snapshot_observed_at":"2026-08-16T14:17:37.981310Z","submitted_at":"2024-02-18T10:09:10Z","title":"Efficient Multimodal Learning from Data-centric Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11530","snapshot_observed_at":"2026-08-11T22:01:53.047847Z","title":"Efficient multi- modal learning from data-centric perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.047847Z"},"links":{"cited_paper":"/paper/2402.11530","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:dee3151a7731385f30e7bc0105aa5003757afce857f490ef3d930aaf284db6d9","observation_id":"4a2795e1-08c3-4929-849b-af1536e38e24","resolution":{"observed_at":"2026-08-11T22:01:53.047847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.287290Z","title":"Benchmarking neu- ral network robustness to common corruptions and perturba- tions","venue":null,"work_id":"f173c389-4db4-4b51-9567-fb17e02d88ef","year":2019},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.053851Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:6e5d56962c20388a49fa323429d226c0acaef7f3580c769ddb4356842b715dce","observation_id":"9de9b261-60b8-46c9-893a-4299fe1e22c2","resolution":{"observed_at":"2026-08-11T22:01:54.299023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T22:01:53.060026Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.060026Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:72c69df9098fc522e05ef33fe1368d0fc5ffc361eb2110b80a4d9664f32c5787","observation_id":"50f51838-2e43-40c8-b558-9492ce8bfb59","resolution":{"observed_at":"2026-08-11T22:01:53.060026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.262377Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":"d0e4ef26-b879-4bf2-a185-94808f95f263","year":2019},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.075701Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:33263ed78b06fd3762238b2adfd2cef6b7ad41af3d5eedfd487980a9d8e739b7","observation_id":"89cca13f-e2d0-4a11-8c40-163406ac45bb","resolution":{"observed_at":"2026-08-11T22:01:54.271853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.238041Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning","venue":null,"work_id":"23ff5541-95f8-4d68-b94b-98ec6fd13b66","year":2017},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.084007Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:a84fa9514c3582bd7c5e5f9375cb007f558b7ec8771c4cfd717ab88f23e0ec57","observation_id":"a975d886-6e08-4c1b-8814-8457658c35ca","resolution":{"observed_at":"2026-08-11T22:01:54.245012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.090083Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.090083Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:b37109caa3e12ce9dc5fa79920c2e658e3b7274a56824de0957ee10fd09f6d83","observation_id":"fb63d161-f474-44ac-9c03-11ee594301fe","resolution":{"observed_at":"2026-08-11T22:01:53.090083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.096254Z","title":"Selfreg: Self-supervised contrastive regu- larization for domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.096254Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:515be09dc41c3f78b3f3aa4d3ada71df8a63ec858e6caf81ad792062ab614bb9","observation_id":"2cafec16-8eac-47a9-abad-acfd88023021","resolution":{"observed_at":"2026-08-11T22:01:53.096254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.170801Z","title":"Out-of-distribution general- ization via risk extrapolation (rex)","venue":null,"work_id":"9c92ef9c-5226-4f80-9668-812a49f14965","year":2021},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.102031Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:30b1bdf96f4607bbdc7acb739b32e7b745a532d46e007cf8d4b5357efa3ad805","observation_id":"56eae539-b899-4f6c-b3cf-dbf619ecd21c","resolution":{"observed_at":"2026-08-11T22:01:54.179070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.130627Z","title":"Sharegpt-4o, 2024","venue":null,"work_id":"39c5c60e-c27e-4792-b763-9d234f760710","year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.107142Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:cfa9341d328234feb46768c2371366a71290143b0dc04771efce2e6d9341f0a2","observation_id":"df19e9af-261b-47a5-b9ab-ef73510828f0","resolution":{"observed_at":"2026-08-11T22:01:54.141695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.093843Z","title":"Domain generalization with adversarial feature learning","venue":null,"work_id":"19bc313b-f401-42a4-a6c1-730c982663e3","year":2018},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.112946Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:f46886a0b409361ee44f1f0a4638e8679cf77254026f917c73a2e7ed1aec0bd7","observation_id":"d6d50cb2-3665-4ec0-aeb0-2e14c0cacfb3","resolution":{"observed_at":"2026-08-11T22:01:54.108357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06523","last_updated":"2022-02-14T07:40:03Z","snapshot_observed_at":"2026-08-16T18:46:25.514581Z","submitted_at":"2022-02-14T07:40:03Z","title":"MetaShift: A Dataset of Datasets for Evaluating Contextual Distribution Shifts and Training Conflicts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.06523","snapshot_observed_at":"2026-08-11T22:01:53.118957Z","title":"Metashift: A dataset of datasets for evaluating contextual distribution shifts and training conflicts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.118957Z"},"links":{"cited_paper":"/paper/2202.06523","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:440bd5e7dd3975b92c12736631bfdf77ace2a70030a61fc0a38347726a9b8af0","observation_id":"178708c8-5280-4dfd-b2b1-9b6360e4575b","resolution":{"observed_at":"2026-08-11T22:01:53.118957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.124414Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.124414Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:d7597de10b91c35bda618abc1e06d991cf623a9c69a00709b6784e721cee4d4f","observation_id":"8494f5e3-4eff-4a54-a0ec-b3c16bfcffdb","resolution":{"observed_at":"2026-08-11T22:01:53.124414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-15T23:41:03.981699Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-11T22:01:53.129691Z","title":"Aligning large multi-modal model with robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.129691Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:f58cf87df87de9c8bc9273d22f81a19d3bd0e48254b0b8ec2b668b945c3b07d4","observation_id":"6c71ab8f-b354-4da8-b9f6-80117dc1975f","resolution":{"observed_at":"2026-08-11T22:01:53.129691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10774","last_updated":"2024-04-15T15:48:48Z","snapshot_observed_at":"2026-08-16T14:42:53.337710Z","submitted_at":"2023-11-15T23:36:42Z","title":"MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10774","snapshot_observed_at":"2026-08-11T22:01:53.135498Z","title":"Mmc: Advancing multimodal chart understand- ing with large-scale instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.135498Z"},"links":{"cited_paper":"/paper/2311.10774","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:f2b687eff1cce9e810edb95bf81f83a2a0d54ef943ecf185d0d662b002caa623","observation_id":"dfee1dae-bfe6-4991-bcf0-689c415c5f87","resolution":{"observed_at":"2026-08-11T22:01:53.135498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.141282Z","title":"Visual instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.141282Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:3a8769956fd88ac82d0d99a99dd017ec10bff1b1da0ec465bab09bfc98c0ef27","observation_id":"667cd767-dee5-4882-8e9a-7a8e844a475a","resolution":{"observed_at":"2026-08-11T22:01:53.141282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:54.027186Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"73e46aa4-36a2-4fda-809b-e8a86c7aa1cf","year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.146150Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:2d31f5334d8711d2f5c6c1a486b84eb2fd1d4d7b5beb5b5094afe896412db0b4","observation_id":"d257f257-13cc-464c-83fa-f2a7c450474c","resolution":{"observed_at":"2026-08-11T22:01:54.033926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.997699Z","title":"Mmbench: Is your multi-modal model an all-around player? In European Conference on Computer Vision, pages 216–233","venue":null,"work_id":"e90c4c2e-8767-4c2b-aa77-d6824ed33d51","year":2025},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.151612Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:2cf10ccdd1636c39c6d64308156474158e2b32032fab486cc692978bb0bcc8c2","observation_id":"334d2947-7131-41fb-b0da-94110f46f0e8","resolution":{"observed_at":"2026-08-11T22:01:54.005951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.157825Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.157825Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:3021538643e9f9f5c44659bfa83b6ada26fcf95451af9b253599e10fb349ecac","observation_id":"150535f9-8a2e-490a-b1dc-3705e571c0ab","resolution":{"observed_at":"2026-08-11T22:01:53.157825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.163672Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.163672Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:36cf076fb438e5c6b294a68c0c25edd67662955d95e78b96e05d6e34ca1164b2","observation_id":"eb6076c6-5471-4126-b43f-6e60ac503894","resolution":{"observed_at":"2026-08-11T22:01:53.163672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.930399Z","title":"Mathvista: Evaluating mathemat- ical reasoning of foundation models in visual contexts, 2024","venue":null,"work_id":"34c27373-8fac-405a-86bf-ec28bc72026e","year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.169760Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:7a67edfb3d980b5c4a54b2c0d81aa226373ac3229d6944b0c96c09add757f47f","observation_id":"561d0b57-a670-4ce4-86eb-5cbefd833d1f","resolution":{"observed_at":"2026-08-11T22:01:53.938076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05470","last_updated":"2023-06-12T14:04:53Z","snapshot_observed_at":"2026-08-17T16:16:47.167064Z","submitted_at":"2023-03-09T18:22:12Z","title":"Spawrious: A Benchmark for Fine Control of Spurious Correlation Biases","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05470","snapshot_observed_at":"2026-08-11T22:01:53.175769Z","title":"Spawrious: A benchmark for fine control of spurious correlation biases","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.175769Z"},"links":{"cited_paper":"/paper/2303.05470","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:1fa488daae33639eb2bc450bbfa667763e3d90aed70b376b91af636c452839b8","observation_id":"75e50d34-d157-40ba-a75d-40866cb42157","resolution":{"observed_at":"2026-08-11T22:01:53.175769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.182574Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.182574Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:2d80b5c2ba97026cd785665d2de47a8df3b1811860c878a81d608390652b6536","observation_id":"518e3f45-e900-40db-8e53-7a479a07a79c","resolution":{"observed_at":"2026-08-11T22:01:53.182574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14846","last_updated":"2024-03-18T03:09:57Z","snapshot_observed_at":"2026-08-16T14:24:15.290194Z","submitted_at":"2024-01-26T13:27:15Z","title":"Understanding Domain Generalization: A Noise Robustness Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14846","snapshot_observed_at":"2026-08-11T22:01:53.187550Z","title":"Understanding do- main generalization: A noise robustness perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.187550Z"},"links":{"cited_paper":"/paper/2401.14846","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:297c928567632d4d005e76279ecbd2d3bb62046a9a6c0dcc3dba06ebcbd74e9c","observation_id":"ee7cd1e2-e8fb-4f5a-b806-0e0b00819ee0","resolution":{"observed_at":"2026-08-11T22:01:53.187550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.194404Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.194404Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:ad171b2fb45396625b207c1f5f4103c5417d2b5e05a8e6adfbb673cbdab80ad1","observation_id":"cf08ee7b-853f-4abe-876f-98ece4165729","resolution":{"observed_at":"2026-08-11T22:01:53.194404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08731","last_updated":"2020-04-02T05:40:29Z","snapshot_observed_at":"2026-08-17T18:58:45.514336Z","submitted_at":"2019-11-20T06:43:41Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08731","snapshot_observed_at":"2026-08-11T22:01:53.200634Z","title":"Distributionally robust neural networks for group shifts: On the importance of regularization for worst- case generalization","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.200634Z"},"links":{"cited_paper":"/paper/1911.08731","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:58fb2b1a6a4dfa4af0036980ab7261269ab1d13a83cdda560426ee05c7299079","observation_id":"a4484963-c44d-414a-b0c0-7a3de5ee470f","resolution":{"observed_at":"2026-08-11T22:01:53.200634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.207328Z","title":"Towards vqa models that can read","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.207328Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:db4d2d1d11ed2851007f1212b51a7be5d8c5bb455afcc83e4c06f27a6631d000","observation_id":"5df9977d-10b2-4c4a-aca8-a8271e0f0e5f","resolution":{"observed_at":"2026-08-11T22:01:53.207328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.855126Z","title":"Deep coral: Correlation alignment for deep domain adaptation","venue":null,"work_id":"657465bf-f343-4da8-8288-4e1f4d49388d","year":2016},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.213322Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:a6635ffb6711375af7c9a3c0ee2a147606fc5f9d0ca7ca4878973cd44c6e4139","observation_id":"f8884eb8-3e15-47f4-8306-c83d925be573","resolution":{"observed_at":"2026-08-11T22:01:53.861387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.822663Z","title":"Principles of risk minimization for learn- ing theory","venue":null,"work_id":"eb4b0fcd-31e6-4a61-849e-706c253ce6eb","year":1991},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.220252Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:9f9995f245af00f2ef2acd5881dea6bef0fc156df0599bee4a90d4cc5ae9a9cb","observation_id":"e163cef9-b5ff-4688-a293-d848d5f4f5c4","resolution":{"observed_at":"2026-08-11T22:01:53.839877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.784933Z","title":"Change is hard: A closer look at subpopulation shift, 2023","venue":null,"work_id":"5b6fcfc8-a6c4-4480-86e7-97de43ba1113","year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.225511Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:9033bf8c80c289fce4583a589fe0409f44dc86d52b55527c4c88fa03c05d3782","observation_id":"ce8af3ae-bde9-4d8b-a390-061a378749e2","resolution":{"observed_at":"2026-08-11T22:01:53.799064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-11T22:01:53.231887Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.231887Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:cdf1c2bcb9659abe1def2ba900b7e43fc9e7ef4c1aa4f979b07c2aee88ec0d01","observation_id":"73d3d605-254b-495c-a279-db70adbce144","resolution":{"observed_at":"2026-08-11T22:01:53.231887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.749694Z","title":"Nico++: Towards better benchmarking for domain generalization","venue":null,"work_id":"2e9b9694-4777-473b-8e52-066ab5d838ab","year":2023},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.238211Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:abb1fea351bd84f65bce9f6ce5999f95e086efdb94d237611c84dc309689d80e","observation_id":"aaddabb6-4e9e-4ee9-a7d4-73a1f5d4603b","resolution":{"observed_at":"2026-08-11T22:01:53.758749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.713928Z","title":"13, 11 and 12","venue":null,"work_id":"f556ee80-80b5-435d-8072-ea0df1e68462","year":1957},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.243234Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:63efcba9a9b22ff3de4f504f2347e1641e702c58b9780adf0bef795a682d68c8","observation_id":"b6349e10-0649-44dd-8ac0-1792a49efe73","resolution":{"observed_at":"2026-08-11T22:01:53.719742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.689198Z","title":null,"venue":null,"work_id":"eeb2c283-c705-411f-a9ff-8da0c7a66017","year":null},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.250427Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:12ef3fdd4053f2b318795862c2ff1603d1127d95685321a09da825680e886eb4","observation_id":"1d041651-2c7a-4c3b-b5f6-eb40cfb0acae","resolution":{"observed_at":"2026-08-11T22:01:53.696456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:01:53.660798Z","title":null,"venue":null,"work_id":"4ec366e9-d3ff-4c9e-aacb-0c4c630e1e43","year":null},"citing_paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:01:53.257864Z"},"links":{"citing_paper":"/paper/2412.03927"},"observation_digest":"sha256:93f153395ea0adab04dbe7195958bf736d1dafbf47fb785173ebff771346bed2","observation_id":"86684b33-1423-42a2-826e-5cf1207af073","resolution":{"observed_at":"2026-08-11T22:01:53.669945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03927","last_updated":"2024-12-05T07:06:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T20:31:20.953533Z","submitted_at":"2024-12-05T07:06:17Z","title":"MegaCOIN: Enhancing Medium-Grained Color Perception for Vision-Language Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2412.03927."}