{"as_of":"2026-08-09T06:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:578e384d3ab7115110c21e467603f726880806f69d326e6cb019d8070043ce9d","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:07.338777Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T22:38:33.963054Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:44:01.550820Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.19474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19474","snapshot_observed_at":"2026-06-29T22:44:01.550820Z","title":null,"venue":null,"work_id":"06d0112a-5a2c-4451-8a53-5c26b9222066","year":2025},"citing_paper":{"arxiv_id":"2605.25377","last_updated":"2026-05-25T03:05:04Z","snapshot_observed_at":"2026-07-06T23:35:21.734804Z","submitted_at":"2026-05-25T03:05:04Z","title":"Adversarial Orthogonal Disentanglement for LVLM Hallucination Mitigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T22:38:33.963054Z"},"links":{"cited_paper":"/paper/2505.19474","citing_paper":"/paper/2605.25377"},"observation_digest":"sha256:4af2dddd1b17487722dfff5dcb62bf47115bbac3037f385894828635fe248cb9","observation_id":"43347af8-07a4-4acb-884b-5f9e72f63f50","resolution":{"observed_at":"2026-06-29T22:44:01.552618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19474/citation-record","integrity":"/paper/2505.19474/integrity","json":"/paper/2505.19474/citation-record.json","paper":"/paper/2505.19474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:57.911238Z","title":"Vqa: Visual question answering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:57.911238Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:cee57bfa4f4e3f28fbb7c82bdeca8faf786b8c0f4916b7c4617244bf82ebf097","observation_id":"014a6b4e-5543-4ca1-b076-21b0c270a20b","resolution":{"observed_at":"2026-08-07T14:17:57.911238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.793654Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":"7b9a8b34-21d5-4abd-83f5-93b7a15f7dd7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.010741Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2b7ccb3de2ec3b4169c08235d8ad12241d86a292dbd288bf867c466bf71c898b","observation_id":"10842e3c-6d3a-4439-b75b-b3045ac97e33","resolution":{"observed_at":"2026-08-07T14:18:17.864780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T14:17:58.221526Z","title":"Hallucination of multimodal large language models: A survey.ArXiv, abs/2404.18930, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.221526Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d54d55966d22f1a1d48e4091d2a7106fdc7b3be0ef771eff1ebc7b688f691804","observation_id":"165fadfc-068b-4381-9f8b-f0418c780c06","resolution":{"observed_at":"2026-08-07T14:17:58.221526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.564900Z","title":"Causal feature learning: an overview.Behav- iormetrika, 44:137–164, 2017","venue":null,"work_id":"75f85792-df87-466d-96b1-0eb316768ce0","year":2017},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.385633Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:18e8e88cd7e76ac89304cce5bb4aa64ea1816fb887e38213539d134f9389b04d","observation_id":"f23aa11e-ea2d-4a04-bcb2-280671559ec8","resolution":{"observed_at":"2026-08-07T14:18:17.675881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-07T14:17:58.499296Z","title":"Shikra: Unleash- ing multimodal llm’s referential dialogue magic.ArXiv, abs/2306.15195, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.499296Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f994ccbd54687fe5b3fd834007e3ee6629644dac00229af3c173d418fc2e2cf3","observation_id":"34ac98be-077b-4666-8259-1b97513f6430","resolution":{"observed_at":"2026-08-07T14:17:58.499296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-07T14:17:58.625849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.625849Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:44063e28a418325f937f053f5c28b29e3dbb9fb22dccdd3eda77e39f651d96f4","observation_id":"b655ec47-1d66-4009-aaed-2c680c5fc13b","resolution":{"observed_at":"2026-08-07T14:17:58.625849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.11181","last_updated":"2019-05-02T23:41:47Z","snapshot_observed_at":"2026-07-06T07:10:42.212486Z","submitted_at":"2018-10-26T03:58:26Z","title":"Neural Modular Control for Embodied Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.11181","snapshot_observed_at":"2026-08-07T14:17:58.749892Z","title":"Neural modular control for embodied question answering.ArXiv, abs/1810.11181, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.749892Z"},"links":{"cited_paper":"/paper/1810.11181","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:12e3d445b1214d65f332ab61b1d11cf8a4c513d1d1a788e040f29b800db0e7a1","observation_id":"08463434-275a-44f0-8a15-921f2f369b28","resolution":{"observed_at":"2026-08-07T14:17:58.749892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T14:17:58.895427Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models.ArXiv, abs/2306.13394, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.895427Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:a8833f11676260175a8aaddd53872018cccffe487ef7d6b7a5246e1986533723","observation_id":"b2fbccac-c66d-4628-be79-e878396c9193","resolution":{"observed_at":"2026-08-07T14:17:58.895427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.268759Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering.International Journal of Computer Vision, 127:398 – 414, 2016","venue":null,"work_id":"534864c7-f191-4c59-851f-c09bb6f70524","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.038400Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4d4ce51cf9a64bde5097b09623bd91ef029df6c41396116b3c220f78c7fad907","observation_id":"c9e7988c-42e5-43fa-b732-83a94c0e3604","resolution":{"observed_at":"2026-08-07T14:18:17.377920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.031408Z","title":null,"venue":null,"work_id":"3411a38c-1def-445b-b230-94cad25feaf8","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.189959Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:fab8e37dc547686e1dadaa8cae36806eb082e219053e0243f6ae2ea5939acc0c","observation_id":"4c0e50e2-16d7-4d1d-abe8-98e1c48e207f","resolution":{"observed_at":"2026-08-07T14:18:17.149581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.809270Z","title":"Unbiased classification through bias-contrastive and bias-balanced learning","venue":null,"work_id":"aa16a190-6311-44fe-bedd-5bf814076131","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.352255Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c8119d5c42cc4fc257d6f2ca42e0f01104f17241f72a6312cb680a18c1abb9a3","observation_id":"743e38ca-d838-4589-a5b6-fac6d159fec8","resolution":{"observed_at":"2026-08-07T14:18:16.884156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02301","last_updated":"2023-11-24T07:07:03Z","snapshot_observed_at":"2026-08-03T03:23:08.919296Z","submitted_at":"2023-09-05T15:06:37Z","title":"CIEM: Contrastive Instruction Evaluation Method for Better Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02301","snapshot_observed_at":"2026-08-07T14:17:59.471288Z","title":"Ciem: Contrastive instruction eval- uation method for better instruction tuning.ArXiv, abs/2309.02301, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.471288Z"},"links":{"cited_paper":"/paper/2309.02301","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d288c648f64d8c05d7f6dcae406bd1862928348cd78571e1a167930813f9279f","observation_id":"6f844add-5e84-4dbf-966b-b0ddcb69709e","resolution":{"observed_at":"2026-08-07T14:17:59.471288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.599580Z","title":null,"venue":null,"work_id":"7c0a328c-7dd4-4c4c-a0c0-3aa094230720","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.606631Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:800d43d1dc9946a9deb59fddcaf658b1431b6eda780f2aee79da3b58e01b8343","observation_id":"1b550aec-47b5-4911-bf1f-78e635313428","resolution":{"observed_at":"2026-08-07T14:18:16.685909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.421895Z","title":"Hudson and Christopher D","venue":null,"work_id":"ccac9c10-817c-466e-8c10-c72889f7ef3f","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.786528Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2da9471a5e3d8c7c2823989d73f5ea71e83a9393fc7ad8c25e1980991183d393","observation_id":"371ec215-5d3f-4af2-9653-411bd6ef6134","resolution":{"observed_at":"2026-08-07T14:18:16.494678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:59.923714Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.923714Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:96b7793b52029507d10ebf00ab5d0a21fb6a9f62f2ba1fa8f9a96298a0d54478","observation_id":"6b824612-57b4-4b5d-97b2-6a50423c7b47","resolution":{"observed_at":"2026-08-07T14:17:59.923714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.180468Z","title":"Introducing idefics: An open reproduction of state-of-the-art visual language model","venue":null,"work_id":"afda4e63-4955-432d-9b10-1c6e30e26395","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.095956Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:5255007df21ea38bbf08c533e7c6f8336c6835590b4ceb988745d8cd08acec20","observation_id":"23edb86b-9426-4220-910f-9df8a7b8e2f2","resolution":{"observed_at":"2026-08-07T14:18:16.267082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.915860Z","title":"Vcoder: Versatile vision encoders for multimodal large language models.2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 27992–28002, 2023","venue":null,"work_id":"f275463d-defb-4c5b-b97e-346873e20e3a","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.231087Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:88ca9a63d23d97cfe1725895885c69565abc92d6e73e3f3367077dd17af19b18","observation_id":"b199e25a-bed3-414e-b672-dba534049efa","resolution":{"observed_at":"2026-08-07T14:18:16.062074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.714450Z","title":"Causal inference meets deep learning: A comprehensive survey.Research, 7, 2024","venue":null,"work_id":"f8941ab0-96b5-4981-9f11-36e7749bc4f1","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.334616Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:62b48a9af498cc674589824c2cc58937326ed53b7de9dc33420630cb93c01ea4","observation_id":"08d6b5e4-04de-42e6-b611-c6b08f6e1937","resolution":{"observed_at":"2026-08-07T14:18:15.820195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.523460Z","title":"Unbiased learning-to-rank with biased feedback.Proceedings of the Tenth ACM International Conference on Web Search and Data Mining, 2016","venue":null,"work_id":"2439b844-5c07-4913-b0bb-5da9aa98a24e","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.483452Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f9567cf18502c0eb72a2b4b1affa7bc5dee2f7bee6ef704b4f49000de66f942b","observation_id":"7c7091d6-4d2d-46bd-a51a-954f60465837","resolution":{"observed_at":"2026-08-07T14:18:15.592963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:00.636529Z","title":"Deep visual-semantic alignments for generating image descriptions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.636529Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:70a11e1baf64e68bf8918cd96bf10b0f26d3eb052171182d43b38732e5524a1e","observation_id":"6ec84d65-83d9-479c-a740-01987c29c820","resolution":{"observed_at":"2026-08-07T14:18:00.636529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.330717Z","title":"Learning not to learn: Training deep neural networks with biased data.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 9004–9012, 2018","venue":null,"work_id":"d8bf21dc-e015-4a6f-a66d-d24ad3473d12","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.758308Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:005196adcfac2ce10f527138a716c06b781e910b1cea7da01725d2910665493c","observation_id":"374a87b5-da22-49ce-9e0c-32b9bc6c8c25","resolution":{"observed_at":"2026-08-07T14:18:15.414896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.097336Z","title":"Sophia Koepke, Cordelia Schmid, and Zeynep Akata","venue":null,"work_id":"d72a4094-a293-4ebc-ae01-4014c7e28ab7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.933381Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7bee649d391d931934fadfe5f38bd922939cfc634ab8c1e420514900afc893ab","observation_id":"15cc1d48-831d-4b2b-815f-8922bf6ca451","resolution":{"observed_at":"2026-08-07T14:18:15.204904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T14:18:01.073175Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.073175Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c73a828c59c3737d0a7ff7ca17caac6052e35a4114953d0075b486ce0ac762a9","observation_id":"8017d1f0-3ddf-4639-928e-61290230a9f3","resolution":{"observed_at":"2026-08-07T14:18:01.073175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.722480Z","title":"Shamma, Michael S","venue":null,"work_id":"5f4b1dfb-6d8e-494e-9d85-3bb0c46d7ec8","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.333009Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:5828672d6ab905a855b9edd1d4d3afae229d7839c6f29b4a6a4176daac996e91","observation_id":"057b404f-ab45-4d77-a9ce-4786f8262b62","resolution":{"observed_at":"2026-08-07T14:18:14.795871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.579991Z","title":"V olcano: Mitigating multimodal hal- lucination through self-feedback guided revision","venue":null,"work_id":"4134d29d-d695-472d-9270-15bd3ade19b7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.512276Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:5058bbbce0474ed2559d40ab3989571726cb55cb09a4216c30271e514b0a4f12","observation_id":"88185505-8ad4-4524-8633-415616b4eaba","resolution":{"observed_at":"2026-08-07T14:18:14.624966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.349526Z","title":null,"venue":null,"work_id":"aed1119b-0cc6-48b5-bad1-ce9e82e5d53d","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.654660Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:73ce7fe3b52c231ee7fa3a6879b3adcf3261ae44b74dfbcd3354983e4f1a9dfc","observation_id":"7659c444-2a8f-4bfb-bdff-119f9446e7ba","resolution":{"observed_at":"2026-08-07T14:18:14.451860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.129278Z","title":null,"venue":null,"work_id":"1611339b-763f-4cd8-802a-017139721831","year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.793027Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:54555d577e71b602af242a5f814d3c5da06f68b33a88a4db9a5c303597cc004d","observation_id":"6ae6f190-5140-4792-902b-f0acf5125dc7","resolution":{"observed_at":"2026-08-07T14:18:14.227695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.987510Z","title":null,"venue":null,"work_id":"b99cf5a1-aaa5-4a06-a1d1-e6bf89d9524a","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.909532Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4c1e3dcaa2ff5a63c60d948aec7ef3f1268094291eaba3c8dadc6bff789694e2","observation_id":"bd09b2c2-edf5-4bdd-8762-fa1094b9ac36","resolution":{"observed_at":"2026-08-07T14:18:14.038951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.771139Z","title":"Towards deconfounded image-text matching with causal inference.Proceedings of the 31st ACM International Conference on Multimedia, 2023","venue":null,"work_id":"59355056-3933-4140-bacf-96635c72ebdd","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.026813Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0760ecc7aed7b87c382b77e4ac806cd276762df9cbf935a599442d1cea23e223","observation_id":"fec8f324-f7ed-4747-838f-b80befc809d8","resolution":{"observed_at":"2026-08-07T14:18:13.877823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.585053Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"292a60d9-ed98-4254-bfe4-af611141ff5b","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.119604Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f3b729e7d30bb416a4b5743732e70deab45e8a9c8cb093e110081f8ad8e6fa11","observation_id":"24454eb6-d078-405a-b4d0-26cb107c77ce","resolution":{"observed_at":"2026-08-07T14:18:13.663560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.387017Z","title":null,"venue":null,"work_id":"4e3d0e2d-44c9-4541-89aa-75e5d365e68c","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.216921Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:151e3ce87f90f93391656cfdf7740e8372bf8b695f4b81deb24914119a6ddca7","observation_id":"2e2e3bee-a71e-4ca4-af16-0469f0d9b3ca","resolution":{"observed_at":"2026-08-07T14:18:13.475187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.241634Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C","venue":null,"work_id":"0d31c4b4-a3f4-4446-be41-5b328c0e9a3a","year":2014},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.336970Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f9a1cb0b158d5b20efcdd367540db265b90f6117c95db5ea043254903f69e6c3","observation_id":"54b96082-8efe-4679-822c-235ba30b0b2b","resolution":{"observed_at":"2026-08-07T14:18:13.292514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.043941Z","title":"Show, deconfound and tell: Image captioning with causal inference.2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 18020–18029, 2022","venue":null,"work_id":"81e95f7a-47bf-47c6-ba39-534aff98059c","year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.439173Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0555189dac0be4744803ad1acecc1b462a67bc70c99446e590a6a8363f1dbcf5","observation_id":"eb905292-61e0-4dab-b002-2e2cddee5023","resolution":{"observed_at":"2026-08-07T14:18:13.146836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.932932Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":"cfe1a991-108d-4049-b166-8835fb9fa7d9","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.569384Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:32d9b5517ca6a0194b730aead8e6bdfa1578ba80b6ef790057faaff69f27aa36","observation_id":"a1c74763-284a-4a2e-8092-48a08a69eeca","resolution":{"observed_at":"2026-08-07T14:18:12.977450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T14:18:02.648285Z","title":"A survey on hallucination in large vision-language models.ArXiv, abs/2402.00253,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.648285Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:a8865663126cc90fb137260905aa90cef8c253c938081c9c5ac65b15a984afcf","observation_id":"8983dbec-8768-4db9-ba5e-b0e487b5f1a6","resolution":{"observed_at":"2026-08-07T14:18:02.648285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.567734Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"d2a4c76e-ea80-4fac-b1ff-62e08069e7db","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.899244Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7e66be73fd1a11e139ef3c29b3cb1c1230513b4f4190e1d81e418f359493a24b","observation_id":"941f5dd5-4539-49b9-a280-cf10f8299786","resolution":{"observed_at":"2026-08-07T14:18:12.676120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T14:18:03.192413Z","title":"Visual instruction tuning.ArXiv, abs/2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.192413Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:1dfe0fce2d0c2650bf0cfab69cce533ea3ac3e70a5b240a953667d0c91475594","observation_id":"5e7a841c-fdb8-4c1f-a050-953bc72af9d7","resolution":{"observed_at":"2026-08-07T14:18:03.192413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.228254Z","title":"Mmbench: Is your multi-modal model an all-around player? InEuropean Conference on Computer Vision, 2023","venue":null,"work_id":"92e14725-45dc-4656-b337-60aaa08a7523","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.317090Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:95c256f14abf043607bca41850d8f920c327f0233d3db2ed312fd093f25ec0bc","observation_id":"0d077064-b255-47b8-ac09-99c7c253a416","resolution":{"observed_at":"2026-08-07T14:18:12.302595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.055679Z","title":"Discovering causal signals in images.2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pages 58–66, 2016","venue":null,"work_id":"ba866f28-5d9c-4b55-a05b-e775c0062d0a","year":2017},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.453521Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:52295c1bff4d97c2f95b39ebd8f33a486a6af9239fd45de343f73e9c4711d220","observation_id":"b7588ef9-9cb8-436b-a37c-800b87776e0a","resolution":{"observed_at":"2026-08-07T14:18:12.118295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09513","last_updated":"2022-10-17T07:46:47Z","snapshot_observed_at":"2026-08-02T03:10:19.073297Z","submitted_at":"2022-09-20T07:04:24Z","title":"Learn to Explain: Multimodal Reasoning via Thought Chains for Science Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09513","snapshot_observed_at":"2026-08-07T14:18:03.561844Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.561844Z"},"links":{"cited_paper":"/paper/2209.09513","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d5aca37232bfc969345978b74c27cf5878d7888b09926cd9693881ecf03434e5","observation_id":"523091e8-a24f-4750-ae8b-f8182bb2be3b","resolution":{"observed_at":"2026-08-07T14:18:03.561844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.861163Z","title":"The deep regression bayesian network and its applications: Proba- bilistic deep learning for computer vision.IEEE Signal Processing Magazine, 35:101–111, 2018","venue":null,"work_id":"557c59a0-e3d2-4e97-84ac-43e6c21aab23","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.681270Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2f95bf4558fedb5e6da3daa94f1e5bc30d53254a8c296ce58af794a0b9073e08","observation_id":"302123be-ccd8-441d-95c2-aa4eaeb76a51","resolution":{"observed_at":"2026-08-07T14:18:11.947909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.688185Z","title":"Counterfactual vqa: A cause-effect look at language bias.2021 IEEE/CVF Conference on Computer Vision and Pattern Recog- nition (CVPR), pages 12695–12705, 2020","venue":null,"work_id":"f664f60c-c305-4b7f-a34a-9f23be58d0aa","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.808113Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:b1072cc585ca1f52a3dda3e89ada7a012ce60d2fdbc53660399bfde0f274f75c","observation_id":"006add3d-a315-4f53-a516-c8a0a11441ad","resolution":{"observed_at":"2026-08-07T14:18:11.777390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:03.907896Z","title":"Basic books, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.907896Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:be80522c011d4d63577988beda2d39fe554e50f77990a2fb2d708b4544fbf171","observation_id":"5ecf661f-6ea1-435b-926d-75e954dee91a","resolution":{"observed_at":"2026-08-07T14:18:03.907896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.551603Z","title":"Two causal principles for improving visual dialog.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 10857–10866, 2019","venue":null,"work_id":"6f95bbb4-4026-4621-8108-4e7030378d58","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.004376Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:b30acb51222e64189e04752be10db8227be4c8c8abe31139b306c33be202fc29","observation_id":"8dfdcc2a-a1fe-4914-a4c7-dc3190657254","resolution":{"observed_at":"2026-08-07T14:18:11.617036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.406807Z","title":"Object hallucination in image captioning","venue":null,"work_id":"e87a3d57-9c22-4227-ae89-3c12334172b4","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.087000Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:28a1135df4a30a340763f0c3042aadf7cf6a7fd19b6dbee4de00b77932e100e8","observation_id":"d55702c7-ff6b-4c49-a756-de8213488948","resolution":{"observed_at":"2026-08-07T14:18:11.469998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15998","last_updated":"2025-03-02T23:41:37Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:59:31Z","title":"Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15998","snapshot_observed_at":"2026-08-07T14:18:04.245081Z","title":"Eagle: Exploring the design space for multimodal llms with mixture of encoders.ArXiv, abs/2408.15998, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.245081Z"},"links":{"cited_paper":"/paper/2408.15998","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:08fdda0dfbfa3d581a600e5a3eaa217a590c557ee067a32f00568071587d31ca","observation_id":"3bbb0d25-af3a-423d-8185-218fc55a05ac","resolution":{"observed_at":"2026-08-07T14:18:04.245081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.241251Z","title":"Towards vqa models that can read.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 8309–8318, 2019","venue":null,"work_id":"e4f1a512-fc67-42cd-9420-361fbd62231e","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.364659Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:1ee6a71d1007e536a19cf566a8b81b67fa67c6624b1876a8eb86733d0a992932","observation_id":"8bb3660c-308d-4a13-8354-25b943a7e2e1","resolution":{"observed_at":"2026-08-07T14:18:11.302421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.047926Z","title":"Heikkila, and Li Liu","venue":null,"work_id":"e3bfcf69-8f18-40ec-abea-0de1112348c6","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.470123Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:150215e68a77bb8823d4b23fce7b619a47dd7d1a1287202e5b9c7a446f634059","observation_id":"65608bd0-3c4c-4d26-8627-33705a2fcae3","resolution":{"observed_at":"2026-08-07T14:18:11.130832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T14:18:04.556684Z","title":"Aligning large multimodal models with factually augmented rlhf.ArXiv, abs/2309.14525, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.556684Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:171efb396343e7bae71495c92f23c7494249d6c8769c4c5fc469be90d7b4d97d","observation_id":"edac3404-1493-48f5-80d1-2653097f8606","resolution":{"observed_at":"2026-08-07T14:18:04.556684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.878150Z","title":"Unbiased scene graph generation from biased training.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 3713–3722, 2020","venue":null,"work_id":"0237554f-0313-4495-8696-f0b072dfc569","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.696834Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:77ffb742b9365867bff55a849f97692546bed191270707e4d3587f887a61fb19","observation_id":"f1f9e1e8-9e64-434b-a8e2-fa11d12d3a42","resolution":{"observed_at":"2026-08-07T14:18:10.936087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.691412Z","title":null,"venue":null,"work_id":"735c560b-fc07-4044-8e5d-ef5a5a49385c","year":2008},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.828456Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:13acd88962675298323582c23baad215d4d244ea757dfaa9acd9419149c4e54b","observation_id":"919477ab-3f62-44cc-977e-1c958d98f2c6","resolution":{"observed_at":"2026-08-07T14:18:10.780403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.513794Z","title":"Vigc: Visual instruction generation and correction","venue":null,"work_id":"595a2ce4-c4b5-4f83-b7ac-84cd3511f01f","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.944643Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:fed067e2142bcfd2a572a1aa37783e1961313ea64618ec96eb1a27683ee75684","observation_id":"745b2ab8-e68d-4476-b6fd-ab9083935f9b","resolution":{"observed_at":"2026-08-07T14:18:10.604240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.361840Z","title":"Visual commonsense r-cnn.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 10757–10767, 2020","venue":null,"work_id":"7c5c0d8b-02c1-4acd-8663-9c691361ed5c","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.074887Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:65e69a2d9c3d31f7c5551883bf7ced78a2e67b32cf1682464fac97876654fe4d","observation_id":"46414d78-f54d-4b3b-be4d-1f5f1f83e100","resolution":{"observed_at":"2026-08-07T14:18:10.410650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09691","last_updated":"2024-11-14T18:57:07Z","snapshot_observed_at":"2026-08-05T04:29:40.575401Z","submitted_at":"2024-11-14T18:57:07Z","title":"Advancing Fine-Grained Visual Understanding with Multi-Scale Alignment in Multi-Modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09691","snapshot_observed_at":"2026-08-07T14:18:05.180098Z","title":"Advancing fine-grained visual understanding with multi-scale alignment in multi- modal models.ArXiv, abs/2411.09691, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.180098Z"},"links":{"cited_paper":"/paper/2411.09691","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:368fab8b07e45bae9dec3002148a63c35c4cda7c691f7dc8bd5871fedc814b4a","observation_id":"a8223c6f-90d4-4f43-8f1e-5880c854b88c","resolution":{"observed_at":"2026-08-07T14:18:05.180098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-08-08T12:24:47.968940Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-07T14:18:05.285816Z","title":"Mitigating hallucinations in large vision-language models with instruction contrastive decoding.ArXiv, abs/2403.18715, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.285816Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:eaf538ed5a40af29dc91a29b0ba2a4136c9e8023a6ba827bc40d9b0bb60df9b0","observation_id":"d1959433-08a9-49a0-93d0-1a067cdbb920","resolution":{"observed_at":"2026-08-07T14:18:05.285816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20081","last_updated":"2024-05-31T07:40:04Z","snapshot_observed_at":"2026-07-06T18:22:44.129954Z","submitted_at":"2024-05-30T14:11:27Z","title":"NoiseBoost: Alleviating Hallucination with Noise Perturbation for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20081","snapshot_observed_at":"2026-08-07T14:18:05.380471Z","title":"Noiseboost: Alleviating hallucination with noise perturbation for multimodal large language models.ArXiv, abs/2405.20081, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.380471Z"},"links":{"cited_paper":"/paper/2405.20081","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4b7bb48f5cd443f9db0206b5a9d901291884351eabd8d7c45d3eefd8f8d6b101","observation_id":"fa113eba-7ed1-415b-8f0d-49af9320eeb5","resolution":{"observed_at":"2026-08-07T14:18:05.380471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.193749Z","title":"Courville, Ruslan Salakhutdinov, Richard S","venue":null,"work_id":"e3dc7f85-dfb9-49ad-a8f5-74f789765094","year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.525323Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0e93d782905f7dd031aa5a20774b6f9f7ff4044c7cc27500dd673241689ebbac","observation_id":"253f180e-74c8-4f1e-ad21-5d10357f2318","resolution":{"observed_at":"2026-08-07T14:18:10.277841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.006823Z","title":"Deconfounded image captioning: A causal retrospect","venue":null,"work_id":"7b8668ce-fd73-470b-9b4d-628c69c183c0","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.638942Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d8053b1c04c81a14d50935c63864865abaf091b77ac442335ed2ac3cccb38a70","observation_id":"20d51a02-14c0-45ff-8692-a18202018126","resolution":{"observed_at":"2026-08-07T14:18:10.087615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.813609Z","title":"Causal attention for vision-language tasks.2021 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 9842–9852, 2021","venue":null,"work_id":"5f6a8ba3-9a96-48ce-94be-bc0521177955","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.745609Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d3f4c237500a3a793ca0730b196e38fc87cafe4e90f2252def4bdc5b72d02b86","observation_id":"71dbf5a5-7195-4ddb-bfb1-09dabccc5f90","resolution":{"observed_at":"2026-08-07T14:18:09.901506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.617368Z","title":"A survey on causal inference.ACM Transactions on Knowledge Discovery from Data (TKDD), 15:1 – 46, 2020","venue":null,"work_id":"7dedb898-0938-41da-b0b1-09f52887b36b","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.901162Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:002acaf8d34799ec2e93efe5cd558c9f564be142bcd2d8cfa5136d465bac9835","observation_id":"7575dd97-3d66-4c89-bb73-6b0f483b71fe","resolution":{"observed_at":"2026-08-07T14:18:09.718877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.285166Z","title":"Woodpecker: Hallucination correction for multimodal large language models.Sci","venue":null,"work_id":"e70db1ff-2c43-43cd-9009-38e4df4cd1ba","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.067611Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2bc919e0568f3226ec494f43ac764bfdf74613618180d2f3d3d6d91ce4579d4f","observation_id":"41f45e62-096e-4bac-b892-b359a868553e","resolution":{"observed_at":"2026-08-07T14:18:09.490957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-08-07T14:18:06.180366Z","title":"Ferret: Refer and ground anything anywhere at any granularity.ArXiv, abs/2310.07704, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.180366Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2f76ed83526580b76b01f7d2c418b9f053c06cb85749b8fb7b0b50339b70907f","observation_id":"224f1f59-cb6d-497f-bdf7-87ef6f198797","resolution":{"observed_at":"2026-08-07T14:18:06.180366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T14:18:06.339518Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities.ArXiv, abs/2308.02490,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.339518Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:cb03d8e07c6abadd0c2a9abebbba6bc5c07b94410afbfa1d045ff0d0ba99ddd3","observation_id":"80659cfb-199e-4c0f-9523-42f07edff6c6","resolution":{"observed_at":"2026-08-07T14:18:06.339518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13000","last_updated":"2020-12-04T06:51:09Z","snapshot_observed_at":"2026-08-04T07:05:41.524273Z","submitted_at":"2020-09-28T01:16:54Z","title":"Interventional Few-Shot Learning","version":2},"cited_work":{"arxiv_id":"2009.13000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.13000","snapshot_observed_at":"2026-08-07T14:18:07.525887Z","title":"Interventional Few-Shot Learning","venue":"cs.LG","work_id":"d3d9c1b3-1510-4811-b444-3698d9e48506","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.631806Z"},"links":{"cited_paper":"/paper/2009.13000","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:736183a9c32565412959b12051e61dcc1a3b2e3a9a0e3990c9ba01aa9f185108","observation_id":"c82cd4c3-1388-4a71-b80b-5dcc43ae2439","resolution":{"observed_at":"2026-08-07T14:18:07.619481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.808087Z","title":"Halle-control: Controlling object hallucination in large multimodal models","venue":null,"work_id":"e084b9db-c29f-435c-a6d6-7929ecd23817","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.759675Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:03627b1667d50aa9edfc168ebba97138c47b6b4fe9230eb2e0bcb0a876da849a","observation_id":"5e3c6167-066a-43bc-ab62-1856b4a4871d","resolution":{"observed_at":"2026-08-07T14:18:08.887598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-07T14:18:06.855970Z","title":"Analyzing and mitigating object hallucination in large vision-language models.ArXiv, abs/2310.00754, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.855970Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:ac1a1149cd30970637675138735eaa6ab56be276be06a7aef3b07c31c95d0abc","observation_id":"f5f9ddb8-4be1-4c37-b9d3-3b73313b8254","resolution":{"observed_at":"2026-08-07T14:18:06.855970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.017422Z","title":null,"venue":null,"work_id":"29895a08-086f-4111-9ada-fc33d9c932d4","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.505004Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:9ae0e38b28b06230ce491a8ca4d7be41ecb5d2df6772198fbf578112a3f5e14f","observation_id":"79e8e05a-e626-4d00-9df2-dd4a61db20ba","resolution":{"observed_at":"2026-08-07T14:18:09.114842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.645984Z","title":"dining table","venue":null,"work_id":"9e3c4144-6272-4a84-a6c1-fa70b1acca57","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.028689Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:ad3e2d8cc43a77131f8f51faa5c6216100cc8a8ecc4190c8245db0f1b1ec7405","observation_id":"f0f35041-5b4b-4063-bf88-62415a9fb8ee","resolution":{"observed_at":"2026-08-07T14:18:08.731952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T14:18:06.946545Z","title":"Minigpt-4: Enhancing vision- language understanding with advanced large language models.ArXiv, abs/2304.10592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.946545Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:463b913b8eb0e94645724527506064ee7af92b73ac3519916e2cf1661fb523bd","observation_id":"bde4ca91-50f9-43c9-a11c-74f6db19fcf9","resolution":{"observed_at":"2026-08-07T14:18:06.946545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.424420Z","title":"7 and 8)","venue":null,"work_id":"582fb6b5-1833-4d71-b3ab-4e95f42052f1","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.102654Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4cd52bcf8bd8d890605bce3f16a555c5f8e519309b1478db64e7f40ea5e6bd21","observation_id":"1ff641f8-205a-4537-af09-3406dcfcdb44","resolution":{"observed_at":"2026-08-07T14:18:08.514660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.238147Z","title":"9 and 10)","venue":null,"work_id":"f5f4514a-e3de-4617-9511-17220b516b90","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.201470Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:6ec252fb4a94521c3c5603d100c579f3b1e250079088d9e705e90676d83e6cff","observation_id":"8e766066-1fec-4c4a-80cb-c71c96755af1","resolution":{"observed_at":"2026-08-07T14:18:08.321787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.082630Z","title":"dining table","venue":null,"work_id":"220cab86-2512-48a4-b1bd-8d61dc373a9c","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.338777Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:edddacd0062a081f7f26cce6b671387d916a7904950de78bf217f28bb6201d35","observation_id":"9a6cbe8e-50bc-4de3-aff2-ea4f16e4dafa","resolution":{"observed_at":"2026-08-07T14:18:08.137272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.898708Z","title":null,"venue":null,"work_id":"3af1caf0-a7cb-40d3-b689-d9269bb18525","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.204453Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:08be6e68b63fedf328a66099e611beee89260df5763ce3f18c06a060bc92f8e1","observation_id":"e1ddd20d-6f33-40ec-93c3-69b60b169d17","resolution":{"observed_at":"2026-08-07T14:18:14.972036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.401787Z","title":null,"venue":null,"work_id":"b0ed9304-ad71-4748-9824-421c68e5107e","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.035939Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c3ff751659c7d0add4a1d5d393f3c52b7cd04b834e8031bceee877f7b526a651","observation_id":"04c88184-dc78-4217-8d50-78eaaf56251e","resolution":{"observed_at":"2026-08-07T14:18:12.451967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.780052Z","title":null,"venue":null,"work_id":"35b96f0e-3f6a-49b0-93cd-eeca7a551f59","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.773634Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:1c76fb8fc93fd973512c0ce3e9877cf6ae74c7690f3175952fac1ffc414ae615","observation_id":"5b8ed909-166b-43ac-949f-6d80c4f720eb","resolution":{"observed_at":"2026-08-07T14:18:12.861978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T14:11:17.524525Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2505.19474."}