{"as_of":"2026-08-05T02:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:376222c76ff0e634784ad1e38dbab185a8aa2c4d0ed1e3b3ce0df5606a9ada48","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T22:46:52.791128Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:10:37.730186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"reference_index":169,"source":"pdf_text","source_observed_at":"2026-05-16T02:56:41.658658Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2306.13549"},"observation_digest":"sha256:87ebc98c5fc83c974128a262dfd12d88cc3f25fdf486da6ab42675b61719f0de","observation_id":"12a33575-69f3-4cfc-905a-55cc96663a79","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:3bba91c59e882dc04f091f2666dcb2775d8b6ea46e6ac4ede55d7308dc62f640","observation_id":"c27ee66f-29c2-4088-bbde-04bbeab14081","resolution":{"observed_at":"2026-05-18T14:25:59.593245Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2402.11411","last_updated":"2024-02-18T00:56:16Z","snapshot_observed_at":"2026-07-06T17:31:41.687799Z","submitted_at":"2024-02-18T00:56:16Z","title":"Aligning Modalities in Vision Large Language Models via Preference Fine-tuning","version":1},"reference_index":185,"source":"arxiv_source","source_observed_at":"2026-05-17T10:58:53.215887Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2402.11411"},"observation_digest":"sha256:dc5ef702630a4c6920e6c35f9a72b40f14f55f5c5429a8911e9a6c584dae14eb","observation_id":"6408f0e9-81a9-440a-a9ed-403e9e70afa2","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"reference_index":125,"source":"pdf_text","source_observed_at":"2026-05-13T13:43:11.024069Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2402.17177"},"observation_digest":"sha256:e51f0b4bfd865c8e16935fe0d85ed1d54a0b876edad11390682d60d01b383292","observation_id":"c55949c9-ddf0-47b7-bd62-05077bb2615a","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":232,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:bd9289e9f93ee7121e5ce66cb8de61478c768b5ef3dc38937a2c3943f74b23d1","observation_id":"b70f87ed-7493-4dd3-9e1a-0c01efcc4591","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2406.10185","last_updated":"2026-04-27T07:59:24Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:14:22Z","title":"Detecting and Evaluating Medical Hallucinations in Large Vision Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T23:55:57.103971Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2406.10185"},"observation_digest":"sha256:dbf8688d6263c4fe9523bfd76f188110b2f87f941e3198688c46b80002f5a142","observation_id":"b62590a0-b430-4b0a-809c-9ad4d80a2856","resolution":{"observed_at":"2026-05-23T23:58:39.550431Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2505.21472","last_updated":"2025-08-11T19:24:13Z","snapshot_observed_at":"2026-07-06T21:31:35.572708Z","submitted_at":"2025-05-27T17:45:21Z","title":"Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T12:48:44.324236Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2505.21472"},"observation_digest":"sha256:2a2110e4d600c4b0ccd6d4a41b52e24052d18b1d5a07bdeb1245909b23c28910","observation_id":"304ec3fb-c118-4fe2-bc8a-bff1bae95a40","resolution":{"observed_at":"2026-05-19T12:52:18.026496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2506.09522","last_updated":"2026-05-13T05:18:27Z","snapshot_observed_at":"2026-07-06T21:40:17.050453Z","submitted_at":"2025-06-11T08:46:55Z","title":"Revisit What You See: Revealing Visual Semantics in Vision Tokens to Guide LVLM Decoding","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T09:42:14.171289Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2506.09522"},"observation_digest":"sha256:1238362080bb2b66e7a8bde445e74f3188285436249341842866591c18425e81","observation_id":"2ab75414-6c3d-4247-be0b-5dd8739a5608","resolution":{"observed_at":"2026-05-19T09:43:02.147639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2507.12455","last_updated":"2026-05-22T04:17:50Z","snapshot_observed_at":"2026-08-02T08:13:56.451097Z","submitted_at":"2025-07-16T17:55:43Z","title":"Mitigating Object Hallucinations via Sentence-Level Early Intervention","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-25T08:31:24.173135Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2507.12455"},"observation_digest":"sha256:9b5771f03ebaaf8ea150fb6a66b4f4180197764f1e9254652248a18f72ec378d","observation_id":"e8134b94-25cf-44e9-b758-18da95ff0d53","resolution":{"observed_at":"2026-05-25T08:35:32.781261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.12357","last_updated":"2026-04-14T06:47:47Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T06:47:47Z","title":"ReflectCAP: Detailed Image Captioning with Reflective Memory","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T16:11:10.598413Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.12357"},"observation_digest":"sha256:3b063283b9ca493268f7166edbaae32c1ff8b7c755a3eb7374538acbdbd53414","observation_id":"52783e8d-7aaf-4406-8310-ae9667e45054","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.12582","last_updated":"2026-04-14T11:05:42Z","snapshot_observed_at":"2026-07-06T23:00:46.620106Z","submitted_at":"2026-04-14T11:05:42Z","title":"Relaxing Anchor-Frame Dominance for Mitigating Hallucinations in Video Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T14:54:52.710686Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.12582"},"observation_digest":"sha256:b04734895a4291d6840cb270c47c6ea3eae3059174377a127f7e2f2716f20076","observation_id":"59cf94a8-23cd-4087-b434-5852c620b0b0","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.19412","last_updated":"2026-04-21T12:40:07Z","snapshot_observed_at":"2026-08-02T23:16:52.957486Z","submitted_at":"2026-04-21T12:40:07Z","title":"VCE: A zero-cost hallucination mitigation method of LVLMs via visual contrastive editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T03:16:45.483553Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.19412"},"observation_digest":"sha256:8a83352ba012172aaa8f6f610b4212a14d2fb818f46743b4851055b7f0d0ff10","observation_id":"eaf5175a-dd19-4417-855e-80bd8f25d913","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.20366","last_updated":"2026-04-22T09:02:17Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T09:02:17Z","title":"Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation","version":1},"reference_index":149,"source":"arxiv_source","source_observed_at":"2026-05-10T00:33:39.960170Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.20366"},"observation_digest":"sha256:fb8d0f55854c5f9c82ba0c03204a5d14b6fbbfa71242b9a4b4b0e050dca74ea9","observation_id":"465f47d0-7456-4215-a7ab-8b329ee9e2ef","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-05T01:23:35.142266Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":255,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:9eee18adfd578ba0833eefe9391b8070e027501bb3d81a4de08b2d9dd5f13657","observation_id":"9d93e0e1-e126-46ba-b8fd-5b9481e984a4","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2604.22822","last_updated":"2026-04-18T06:54:02Z","snapshot_observed_at":"2026-07-06T23:09:10.050398Z","submitted_at":"2026-04-18T06:54:02Z","title":"DO-Bench: An Attributable Benchmark for Diagnosing Object Hallucination in Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T06:34:29.555022Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2604.22822"},"observation_digest":"sha256:71bf94d12979b9feea5750e89271ba1db10895a3443db01dad3d6713f51dc3d8","observation_id":"79b2eb0f-bb18-4446-9fbc-45bd067069f1","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.01766","last_updated":"2026-05-03T07:58:02Z","snapshot_observed_at":"2026-07-31T08:00:39.590873Z","submitted_at":"2026-05-03T07:58:02Z","title":"Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T15:27:23.591345Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.01766"},"observation_digest":"sha256:a7843e9f141721f88daae68476d2774d9fed39e4a6bdf3b1da04ba585eb8ab1f","observation_id":"a8b712a4-fdaa-42f7-8aae-f1ba9b5dc2bc","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.04641","last_updated":"2026-07-29T07:14:27Z","snapshot_observed_at":"2026-08-02T23:57:54.502941Z","submitted_at":"2026-05-06T08:32:30Z","title":"CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-08T18:05:38.705480Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.04641"},"observation_digest":"sha256:4cb37ed4353e5daeb5d1a53674d5018f1d0c0c9ae749facf02798d0b42b7250b","observation_id":"2f9f8d5d-e933-4e4c-8abd-e85c30c869c0","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.04874","last_updated":"2026-05-06T13:08:12Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T13:08:12Z","title":"Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T17:00:36.574362Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.04874"},"observation_digest":"sha256:eeaaebc135509fc0221c11fff0bffd1140e2969719241bfa54ec53572088f272","observation_id":"c3d03907-702c-4a2b-961e-f8f06b93ae40","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.09443","last_updated":"2026-05-10T09:40:43Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T09:40:43Z","title":"Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T04:49:56.954433Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.09443"},"observation_digest":"sha256:3d392273409418f3f8f93f61ea5bd5c97035cdc537e92e6c23566056693e44a6","observation_id":"63dacef3-5747-4d5b-bdab-46ab6a543752","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.11330","last_updated":"2026-05-11T23:33:58Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T23:33:58Z","title":"Rethinking Evaluation for LLM Hallucination Detection: A Desiderata, A New RAG-based Benchmark, New Insights","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T01:34:43.464899Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.11330"},"observation_digest":"sha256:f1d35e7450d3ccb224664f2746a8da46987ab84b2c29c42fd0520c4c76bbcd35","observation_id":"752cd7ec-3817-4378-94b6-f3efa5dae527","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.12485","last_updated":"2026-05-18T04:19:54Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:58:22Z","title":"Letting the neural code speak: Automated characterization of monkey visual neurons through human language","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-13T02:12:00.335761Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.12485"},"observation_digest":"sha256:ceaab6bdb04acb84f759e44706808f5d976eabc842bd348aa3c9e09fa9823323","observation_id":"52be22a2-bfa9-41ed-8d60-0c846e99abbd","resolution":{"observed_at":"2026-05-17T22:46:52.958092Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.12485","last_updated":"2026-05-18T04:19:54Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:58:22Z","title":"Letting the neural code speak: Automated characterization of monkey visual neurons through human language","version":2},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-20T21:17:53.615009Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.12485"},"observation_digest":"sha256:e96d70115a8e1dc6b44ab425ca8626bf20bb71bd5c8d10cf53f0ca29eecebf62","observation_id":"ad7c3f35-668d-4bcb-840b-19346b7feea6","resolution":{"observed_at":"2026-05-20T21:19:02.994029Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.21300","last_updated":"2026-05-20T15:29:20Z","snapshot_observed_at":"2026-07-06T23:31:46.877766Z","submitted_at":"2026-05-20T15:29:20Z","title":"Reducing Object Hallucination in LVLMs via Emphasizing Image-negative Tokens","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T05:07:12.965100Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.21300"},"observation_digest":"sha256:35ee7e4bef120e43272940cb2539253803c8872b46b1605b2997b4990398dcaa","observation_id":"7cd5ffe4-4454-46eb-9968-79e4b4a85ac5","resolution":{"observed_at":"2026-05-21T05:09:38.501436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2605.27993","last_updated":"2026-05-27T05:33:06Z","snapshot_observed_at":"2026-08-02T18:16:52.435185Z","submitted_at":"2026-05-27T05:33:06Z","title":"Rethinking Visual Neglect: Steering via Context-Preference for MLLM Hallucination Mitigation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T13:29:33.614965Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2605.27993"},"observation_digest":"sha256:d233e9e595d28156dcf94e3cf95ebd75a45f899cce9bc69b0b881e2a7050ae0e","observation_id":"2aac6f14-38bd-4cb7-b13d-c93879c47179","resolution":{"observed_at":"2026-06-29T13:33:28.079362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2606.23206","last_updated":"2026-06-22T11:51:51Z","snapshot_observed_at":"2026-08-01T21:25:09.156943Z","submitted_at":"2026-06-22T11:51:51Z","title":"CFPO: Counterfactual Policy Optimization for Multimodal Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T09:09:09.716984Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2606.23206"},"observation_digest":"sha256:3188be002b93e0803cfc213b8179a4bd08d5f6ffe467a67fa0cb27368583939b","observation_id":"81a24a2b-6d3f-4470-8c24-0b1f5c5cc3f4","resolution":{"observed_at":"2026-07-04T10:09:44.505727Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2606.27596","last_updated":"2026-06-25T22:55:46Z","snapshot_observed_at":"2026-08-02T11:25:40.949648Z","submitted_at":"2026-06-25T22:55:46Z","title":"Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:13.657975Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2606.27596"},"observation_digest":"sha256:035727a5075df0d76f9b7889c96619cc5bc22e76652db2d589a473b46e85c689","observation_id":"ca1d5699-7564-491a-91a7-b184304ccbed","resolution":{"observed_at":"2026-07-01T19:06:02.550019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-30T06:13:11.013395Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:df9cc33c62e15646fb1f7fd9d18691163419daa025d7299fdefea8782fcc2ca0","observation_id":"5f1abeed-5e40-484b-84de-791a5855d9a4","resolution":{"observed_at":"2026-06-30T06:14:18.773228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2310.00754","doi":"10.48550/arxiv.2310.00754","metadata_source":"pith","pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","venue":"cs.LG","work_id":"9ea022ac-7a9b-4e2c-bdbf-e9dd84774c3c","year":2023},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-01T07:01:26.911110Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:a7bfc1c09d56dacb98ddfdf5488a3517bb40ee0a901a86fccf83abf13cd82532","observation_id":"ec7b2aea-081f-4252-87f6-3bf6591d5cf3","resolution":{"observed_at":"2026-07-01T07:05:28.696611Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-11T21:15:25.010442Z","title":"Analyzing and mitigating object hallucination in large vision-language models.arXiv preprint arXiv:2310.00754, 2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04163","last_updated":"2026-07-05T08:07:51Z","snapshot_observed_at":"2026-08-03T03:39:28.000436Z","submitted_at":"2026-07-05T08:07:51Z","title":"SeeMe: Mitigating Hallucinations in Large Vision-Language Models through Effective Visual Token Engineering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T21:15:25.010442Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2607.04163"},"observation_digest":"sha256:a79958257d7d19828fdfdb5052b53708d5aa82ebdada929c3bce46c0cd0e6cda","observation_id":"2066eb10-ace4-4c3c-abf2-95c0f4d1aaf8","resolution":{"observed_at":"2026-07-11T21:15:25.010442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-01T13:10:37.730186Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22716","last_updated":"2026-07-21T15:52:30Z","snapshot_observed_at":"2026-08-01T13:10:35.695248Z","submitted_at":"2026-07-21T15:52:30Z","title":"Visual Token Compression Enhances Robustness of MLLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T13:10:37.730186Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2607.22716"},"observation_digest":"sha256:4c8d8c853302a36358107e15e4a813e531b35e48438a10c28219c0d3b363fdeb","observation_id":"0497efb9-b8ea-44f1-ac72-9a7631306261","resolution":{"observed_at":"2026-08-01T13:10:37.730186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-01T03:19:37.974613Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23213","last_updated":"2026-07-25T14:04:55Z","snapshot_observed_at":"2026-08-01T03:19:29.226320Z","submitted_at":"2026-07-25T14:04:55Z","title":"A Taxonomy of Confabulations and the Perception-Reality Gap in LLM-Assisted Immersive Scene Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T03:19:37.974613Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2607.23213"},"observation_digest":"sha256:71ea1b426bbfeb9a0815581606c5db6ef64586ac15a4a7998647b4f9577eaea6","observation_id":"aa02346c-9560-4809-bf91-3294a5637047","resolution":{"observed_at":"2026-08-01T03:19:37.974613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-07-31T23:32:08.978975Z","title":"arXiv preprint arXiv:2310.00754 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23944","last_updated":"2026-07-27T02:40:49Z","snapshot_observed_at":"2026-08-04T17:56:14.053354Z","submitted_at":"2026-07-27T02:40:49Z","title":"DICA: Dual-Indicator Guided Contrastive Alignment in Multimodal Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-31T23:32:08.978975Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2607.23944"},"observation_digest":"sha256:c79e3cf5f14242f02c4dcaba19a282a52abb2b82fe4d88ffe97545b05bd11f10","observation_id":"a8968e34-e0f8-445a-ad8b-7da358ac7a98","resolution":{"observed_at":"2026-07-31T23:32:08.978975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.00754/citation-record","integrity":"/paper/2310.00754/integrity","json":"/paper/2310.00754/citation-record.json","paper":"/paper/2310.00754"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spice: Semantic propo- sitional image caption evaluation","venue":null,"work_id":"d8bdc1f3-0501-47d7-bf83-5a51413210ef","year":2016},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:73ff42980c708def26afbffa360bcc12e93a5da75a341462a01da615aaf43419","observation_id":"ac2f5925-80a1-44b4-ba0c-9fb73d6a59c6","resolution":{"observed_at":"2026-05-17T22:46:52.957150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are few-shot learners","venue":null,"work_id":"677093e0-2019-45af-8c52-d9b33dec7e3d","year":1901},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:662b3e11f1beb80305c9a12ba985bf6af9967a856a38dbf10186bf710f812da8","observation_id":"b76deb28-c29f-47fb-847a-12d8345ba2d7","resolution":{"observed_at":"2026-05-17T22:46:52.913074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":"2204.02311","doi":"10.48550/arxiv.2204.02311","metadata_source":"pith","pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-07-10T12:07:03.432645Z","title":"PaLM: Scaling Language Modeling with Pathways","venue":"cs.CL","work_id":"a94f3ef7-2c49-4445-93fe-6ec16aafd966","year":2022},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:6e1c11a24e7c27cced311ace325097d04860ce162a277ae2ffcc503b92a9e1d5","observation_id":"0626c54b-afdc-414c-8aa1-d9f4fb2bd2e5","resolution":{"observed_at":"2026-05-17T22:46:52.881611Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hi- erarchical image database","venue":null,"work_id":"92fd5d54-2aba-4ce2-9641-8dea59b064ff","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:8303ff82ff5ea599685f8bd837f563972b66678046396c8a313c5c47c677a25d","observation_id":"8e3cbca3-e2e4-4948-aa48-63f41b8fbc72","resolution":{"observed_at":"2026-05-17T22:46:52.916155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.01806","last_updated":"2017-06-14T01:00:18Z","snapshot_observed_at":"2026-07-06T05:29:01.228177Z","submitted_at":"2017-02-06T22:08:46Z","title":"Beam Search Strategies for Neural Machine Translation","version":2},"cited_work":{"arxiv_id":"1702.01806","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.01806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beam Search Strategies for Neural Machine Translation","venue":"cs.CL","work_id":"00b2d35f-c6ed-4c4d-bbf1-93f0a15d12c9","year":2017},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/1702.01806","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:917ba6778d93051c09498bcff0aa0dd576fa22b524f5149f50ffb99abb000ede","observation_id":"0c2d021f-74d0-4cc9-927b-3b84cb082e4c","resolution":{"observed_at":"2026-05-17T22:46:52.894064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":"2306.13394","doi":"10.48550/arxiv.2306.13394","metadata_source":"pith","pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-07-10T13:27:05.561984Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":"cs.CV","work_id":"806d2e73-71b3-4d56-87e0-39d571cc15d6","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:db1dc51b75d6e04da792c6ef7f0ca1e753ed786868458272b458584dd9f6c56d","observation_id":"7e1e473a-42e7-4dc2-adb2-e451ebeae8b7","resolution":{"observed_at":"2026-05-17T22:46:52.852162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06394","last_updated":"2024-02-11T08:38:07Z","snapshot_observed_at":"2026-07-06T16:05:27.901845Z","submitted_at":"2023-08-11T21:35:20Z","title":"Detecting and Preventing Hallucinations in Large Vision Language Models","version":3},"cited_work":{"arxiv_id":"2308.06394","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.06394","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2308.06394 , year=","venue":null,"work_id":"0a8f3afc-fe73-4c85-9d6e-217568430f4f","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2308.06394","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:4b2a0c0e80ab6c28414908d3c8c1de4ce35c563baaa5622de8a2b4230d0fafb6","observation_id":"a1559b26-52ec-4964-ab3f-1493c732d9b2","resolution":{"observed_at":"2026-05-17T22:46:52.857789Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09751","last_updated":"2020-02-14T21:56:30Z","snapshot_observed_at":"2026-07-06T07:47:32.745963Z","submitted_at":"2019-04-22T07:17:18Z","title":"The Curious Case of Neural Text Degeneration","version":2},"cited_work":{"arxiv_id":"1904.09751","doi":"10.48550/arxiv.1904.09751","metadata_source":"pith","pith_arxiv_id":"1904.09751","snapshot_observed_at":"2026-07-11T02:27:47.673937Z","title":"The Curious Case of Neural Text Degeneration","venue":"cs.CL","work_id":"1ef2ec4a-db7b-42b2-9416-0f1bb628c3c8","year":2019},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/1904.09751","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:605f7bb15fc371a4de15d2dd7a7fe4cfc9a9c8c8967f3ccb92ea0b171499aa0d","observation_id":"c1b7524b-56f1-45dc-a421-2d4ed7ceb471","resolution":{"observed_at":"2026-05-17T22:46:52.863247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-19T15:54:15.356125+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T15:54:15.356125+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04920","last_updated":"2023-04-11T01:17:11Z","snapshot_observed_at":"2026-07-06T15:14:13.670044Z","submitted_at":"2023-04-11T01:17:11Z","title":"Advancing Medical Imaging with Language Models: A Journey from N-grams to ChatGPT","version":1},"cited_work":{"arxiv_id":"2304.04920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.04920","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advancing medical imaging with language mod- els: A journey from n-grams to chatgpt","venue":null,"work_id":"e6d1345d-f408-4b2a-8095-ca287d652c84","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2304.04920","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:254b9a7c6a6d0e60dffd7544f130e7fd0cdb4eba918565c932b6d89447619d6d","observation_id":"9b8567d6-a993-46fa-a22f-178ffed58782","resolution":{"observed_at":"2026-05-17T22:46:52.868492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03726","last_updated":"2025-07-28T05:33:36Z","snapshot_observed_at":"2026-07-06T15:23:52.761222Z","submitted_at":"2023-05-05T17:59:46Z","title":"Otter: A Multi-Modal Model with In-Context Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2305.03726","doi":"10.48550/arxiv.2305.03726","metadata_source":"pith","pith_arxiv_id":"2305.03726","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Otter: A Multi-Modal Model with In-Context Instruction Tuning","venue":"cs.CV","work_id":"33cb3a7a-6091-48db-a246-802bbb055f43","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2305.03726","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:654019a19c0f7f5eb64a143b7c6fbf1e7100a73fa81a2570b624d874f60bba5b","observation_id":"addd1ec6-8c7b-45fc-ab79-f80d2ccf3710","resolution":{"observed_at":"2026-05-17T22:46:52.872589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":"2301.12597","doi":"10.48550/arxiv.2301.12597","metadata_source":"pith","pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","venue":"cs.CV","work_id":"63d03f4d-15f4-4583-8286-913c19f02294","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:27ead6f443889e59bc674146a75ac9bea625d9f43272267592387da7f1818f1b","observation_id":"22d6efca-1c69-4f84-b8e1-d67832766b25","resolution":{"observed_at":"2026-05-17T22:46:52.877684Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"fadaebc4-d11e-41e6-ae4c-b3a849caef84","year":2014},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:d5db1c1140a94d389fe8bafd1ff7912fc79b8b6c2f75ddb060b1ca84d80158dd","observation_id":"b502d204-7ad7-4b19-b98a-569f534a9b9b","resolution":{"observed_at":"2026-05-17T22:46:52.919186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-07-06T15:46:40.281717Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":"2306.14565","doi":"10.48550/arxiv.2306.14565","metadata_source":"pith","pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","venue":"cs.CV","work_id":"ba8e8164-e47f-42d6-83ad-696cb57ee79a","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:e721f24e043ad2a013da24aea1a0eb9531ada8b2fb77f26604230219eca52ba8","observation_id":"f483fa57-0941-4c38-9fae-44514d80e097","resolution":{"observed_at":"2026-05-17T22:46:52.885724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09349","last_updated":"2023-06-12T14:07:42Z","snapshot_observed_at":"2026-07-06T15:17:17.518507Z","submitted_at":"2023-04-19T00:08:48Z","title":"LLM as A Robotic Brain: Unifying Egocentric Memory and Control","version":4},"cited_work":{"arxiv_id":"2304.09349","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.09349","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm as a robotic brain: Unifying egocentric memory and control","venue":null,"work_id":"92bfa655-545d-447c-9e69-3083767af5ec","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2304.09349","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:ba619aa7c04816e758e9a7b1eb9a2cdc48ef861b940da9323e80122a58b9b43b","observation_id":"6e769740-9b31-4053-8c05-48e46806c6cb","resolution":{"observed_at":"2026-05-17T22:46:52.889796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object hallucination in image captioning","venue":null,"work_id":"ed19b926-149b-45ff-b096-c50b1ac1caba","year":2018},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:c40ff2cb0488127218c902eca4d09860a066b6d1eff3c7492c7bf4a0b2ede6c6","observation_id":"cac2ace2-de9f-4f13-b8bf-162218557e17","resolution":{"observed_at":"2026-05-17T22:46:52.922257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09299","last_updated":"2023-11-14T05:24:06Z","snapshot_observed_at":"2026-07-06T15:43:03.878575Z","submitted_at":"2023-06-15T17:27:20Z","title":"Can Language Models Teach Weaker Agents? Teacher Explanations Improve Students via Personalization","version":2},"cited_work":{"arxiv_id":"2306.09299","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09299","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can language models teach weaker agents? teacher explanations improve students via theory of mind","venue":null,"work_id":"49a57888-ef36-4889-be25-d1ae77c33d95","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2306.09299","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:84466a7295f136becdd75659dbcc523da6bcd4220c3273758a0d0dedabf89176","observation_id":"661868a5-f1c7-4276-87e0-a2448859dd21","resolution":{"observed_at":"2026-05-17T22:46:52.898772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-11T03:47:48.508181Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:0b44dbacba5995a5675dc1e856b154f8d876cfc8b175fd4dc83c73f93b16b0c5","observation_id":"e0722b23-8a44-4d81-9ddc-8843e4926c5e","resolution":{"observed_at":"2026-05-17T22:46:52.902254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15126","last_updated":"2023-10-10T11:57:26Z","snapshot_observed_at":"2026-08-01T17:12:16.290540Z","submitted_at":"2023-08-29T08:51:24Z","title":"Evaluation and Analysis of Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2308.15126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.15126","snapshot_observed_at":"2026-07-04T13:59:52.187912Z","title":"Evaluation and analysis of hallucination in large vision-language models","venue":null,"work_id":"a9a8ebbd-78c1-4abb-b55e-674002d8c5fe","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2308.15126","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:338d0a180cb83b2a51357bbea3ee84b032845e71fb3b342593d0c6c413e5a862","observation_id":"6f543af6-1061-4b42-8a8b-ea10fae08fdd","resolution":{"observed_at":"2026-05-17T22:46:52.906865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":"2304.14178","doi":"10.48550/arxiv.2304.14178","metadata_source":"pith","pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","venue":"cs.CL","work_id":"74a7deb6-48be-4132-9d35-882cc5870ebd","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:979e08942d9b63d5b49eafbd1707e71a7ebef14d3bafcec6eb9c7bc35c2cfdaf","observation_id":"ce33ff3c-5afd-4b5f-a530-f9ae1e4c4163","resolution":{"observed_at":"2026-05-17T22:46:52.820083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08276","last_updated":"2022-06-01T16:45:09Z","snapshot_observed_at":"2026-07-06T12:08:57.241574Z","submitted_at":"2021-11-16T07:55:26Z","title":"Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts","version":3},"cited_work":{"arxiv_id":"2111.08276","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.08276","snapshot_observed_at":"2026-07-03T17:18:43.859907Z","title":"Multi- grained vision language pre-training: Align- ing texts with visual concepts","venue":null,"work_id":"11faa1ba-da3d-4e14-bf06-cf2aae37b10b","year":2021},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2111.08276","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:3f45b07af5893010f363a3a73f88fd67622ae7cdca57df9d0f261e04f309904f","observation_id":"1f50a754-badd-479f-98f7-5b14e5e086b4","resolution":{"observed_at":"2026-05-17T22:46:52.826787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13534","last_updated":"2023-05-22T23:14:28Z","snapshot_observed_at":"2026-08-05T01:33:50.670644Z","submitted_at":"2023-05-22T23:14:28Z","title":"How Language Model Hallucinations Can Snowball","version":1},"cited_work":{"arxiv_id":"2305.13534","doi":"10.48550/arxiv.2305.13534","metadata_source":"pith","pith_arxiv_id":"2305.13534","snapshot_observed_at":"2026-07-10T08:06:57.890494Z","title":"arXiv preprint arXiv:2305.13534 , year=","venue":"cs.CL","work_id":"4ee77984-1abe-47a6-939b-005aff470c08","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2305.13534","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:afc3297c3f85c53b4445c0d2ef9c184bc547e4f1ad567e930c2230a4172426d1","observation_id":"54106970-5932-4511-a04b-0c803c6fb8dd","resolution":{"observed_at":"2026-05-17T22:46:52.834623Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":"2306.05685","doi":"10.1109/4235.797969","metadata_source":"pith","pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":"cs.CL","work_id":"d0c30cd7-81e1-4159-a87f-f6adca77ff08","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:2d50f33fa135974c4d857b4deac09e5eb545a1ddc6a5fc0ee4350c40446438fa","observation_id":"d6224d4d-b0d8-40d9-9432-72ac74903836","resolution":{"observed_at":"2026-05-17T22:46:52.841020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":"2304.10592","doi":"10.18653/v1/2024.findings-emnlp.692","metadata_source":"pith","pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","venue":"cs.CV","work_id":"a7e3a737-e007-42bc-be89-c4d34c5ee071","year":2023},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:b5e1ba55c4d95b4043ff3907168cbad6833645e8eb2a750c803b427ff5b646ce","observation_id":"52a605b5-ce49-4d07-b67e-e0d2a4ade037","resolution":{"observed_at":"2026-05-17T22:46:52.846811Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T17:23:55.433296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T17:23:55.433296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Experimental Setting for the Uncertainty Analysis","venue":null,"work_id":"3bc7707b-eac5-49dc-9bc2-8ab82e174b36","year":2014},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:00071b524020b9fa526ad41a220b1bf93e27284e63c58994b5786204255e94a9","observation_id":"77f66806-8a00-44de-8e84-b0752fed31a6","resolution":{"observed_at":"2026-05-17T22:46:52.924861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Greedy-Decoding","venue":null,"work_id":"e1bf2fef-0f39-4034-ba86-677830702eb2","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:46afc02edb1b62c14c15a2a0d63f8082b47b72344e547e08344d1077fd160d6a","observation_id":"d82d0843-12d9-47eb-bfb1-9ea8c1712500","resolution":{"observed_at":"2026-05-17T22:46:52.927694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"15 Published as a conference paper at ICLR 2024 Table 8: Prompts for baselines","venue":null,"work_id":"e441d80c-203b-4e09-9edf-a0aa0355c099","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:5b2a44419bff4587145aaf271651f9a06e2f04f84c5173e6ab53e1eb6638e078","observation_id":"3272df5a-7b1a-40ac-a189-20d868fca4b3","resolution":{"observed_at":"2026-05-17T22:46:52.930332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"16 Published as a conference paper at ICLR 2024 Figure 4: Human evaluation annotation interface","venue":null,"work_id":"e6260d49-681b-45b4-8d9f-9b773f8b77f0","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:840a6f4a6d51ee6717d1bc911c96a0a534d8c82e8db83af0c8c32de95cda8fb6","observation_id":"32924fb3-2fda-4417-afdf-b11a8a9890da","resolution":{"observed_at":"2026-05-17T22:46:52.933150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As ˆβk = µ∗ k + 1 nk Pnk i=1 ϵi := µ∗ k + 1√nk Z, we have ⟨µ∗ k, ˆβk⟩ ∥ ˆβk∥ = ∥βk∥2 + 1√nk ⟨µ∗ k, Z⟩ q ∥µ∗ k∥2 + 2√nk ⟨µ∗ k, Z⟩ + 1 nk ∥Z∥2","venue":null,"work_id":"8de7f70a-b4a4-43e2-aaca-34868057cf45","year":2002},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:e614112daaa5bfe273417e1d2de508adfe51b50584e023b0989ea786be036990","observation_id":"4360ae24-4299-4fd2-99d5-80a218759742","resolution":{"observed_at":"2026-05-17T22:46:52.935925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BERTScore measures the similarity between a reference text and a generated text by computing contextualized embeddings using BERT","venue":null,"work_id":"133e7de4-bdc7-4c9e-90cd-31d57eb26bbb","year":2004},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:84b02613281f7a0eacaa1d5030f2ecb7d4b16fc4d67f40d22269495b70c413d3","observation_id":"275d61b0-f3c4-4772-a8e8-27d8cd3b7b0f","resolution":{"observed_at":"2026-05-17T22:46:52.939145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Currently, the CHAIR metric can only be applied to the COCO dataset, which limits its usability beyond that dataset","venue":null,"work_id":"60f768af-fa59-4d4a-9552-e23d7587cfea","year":2021},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:ed7ebaf151a59ead69d39144a29548fecc32497b8fe09e05e035821c6c29ba65","observation_id":"5a430ab1-f325-4281-bead-13fdf1d15288","resolution":{"observed_at":"2026-05-17T22:46:52.941679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ori + Cap","venue":null,"work_id":"a957f0e0-1925-4c30-aaaf-f1a2169bdc42","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:f5bcf5d0b049445f09fc6f0021ea20075133790a008ac208c11ccca9c9432024","observation_id":"7f03c6a1-8223-416a-9180-9814a0a3944f","resolution":{"observed_at":"2026-05-17T22:46:52.944153Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"254d10ec-cd45-4d96-9678-a1cc963ec4ba","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:02a67e9f619fe2c8d6862514229ee9d3b75473a423dd2b16455f1c5c1ad0f2f9","observation_id":"3432d4b4-015c-4a3c-8c30-76546d742ffb","resolution":{"observed_at":"2026-05-17T22:46:52.947086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"912e7b11-3a01-40d0-8f3a-baca8e86b919","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:79dd6ba44859c47d1f3c5df116b6de83a7a90a5823a50cc80ef9f7c0c24264e3","observation_id":"b1273a47-620d-4f01-b0ba-ff037c4ab806","resolution":{"observed_at":"2026-05-17T22:46:52.949478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Original caption","venue":null,"work_id":"d6fdec6a-10ed-4e55-b635-3a280d09b7d9","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:8424c0917eb00bbc57e84ba900e617f2998169a022de514eb4c556f0c40b40c5","observation_id":"755dfe3c-4a5c-4e5d-8be5-98cbebe4cd7e","resolution":{"observed_at":"2026-05-17T22:46:52.951738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"column represents the hallucinated description constructed by GPT-3.5","venue":null,"work_id":"27d76b79-cca4-4431-bb08-e564cfcdf9d9","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:ac39cd5406e89ae54082d4d86d2a6f0f2326963a056f4682596e329b4c2cb998","observation_id":"06ee8eab-9825-4f61-8e17-8ad6e1903403","resolution":{"observed_at":"2026-05-17T22:46:52.954302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Original","venue":null,"work_id":"baf2ef35-79f2-4634-ab29-5fe9f8dc4d2e","year":2024},"citing_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T22:46:52.791128Z"},"links":{"citing_paper":"/paper/2310.00754"},"observation_digest":"sha256:cff9f7c12826ec2fd0f601a5c607e3ca93208c32880441bb77ed28d7b7a635d0","observation_id":"1215b433-a6b9-41c1-b3d5-e6dae2ca8eec","resolution":{"observed_at":"2026-05-17T22:46:52.910135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":2,"verified_exact":15,"verified_fuzzy":15},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 32 inbound Pith citation observations for arXiv:2310.00754."}