{"as_of":"2026-08-07T20:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93a53b436685ddeff424757b8aed9bb5c216582b43151e29770db13ac08736c1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:43:34.855411Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:27:56.151478Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2411.16771","last_updated":"2026-04-23T13:21:19Z","snapshot_observed_at":"2026-08-02T03:20:43.405143Z","submitted_at":"2024-11-25T06:17:23Z","title":"VidHal: Benchmarking Temporal Hallucinations in Vision LLMs","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-23T16:57:12.821916Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2411.16771"},"observation_digest":"sha256:cb761240fdef92eb46fdf922b4bff304ae912f8dcb3f1c2a7e2973fcacde4cd5","observation_id":"953d1368-6587-47f8-a72a-d3308781a7c1","resolution":{"observed_at":"2026-05-23T16:58:12.093330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-07T05:43:34.855411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-07T09:15:50.239988Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.855411Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:f47f006547ac308c949966cc4a49660368460964db9cd3470dab9b38ac7290fc","observation_id":"07f4a18e-c5b7-4a42-880f-b2a1811df3c7","resolution":{"observed_at":"2026-08-07T05:43:34.855411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-07T05:41:39.790898Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07371","last_updated":"2025-06-10T13:33:53Z","snapshot_observed_at":"2026-08-07T10:51:02.440475Z","submitted_at":"2025-06-09T02:42:13Z","title":"ARGUS: Hallucination and Omission Evaluation in Video-LLMs","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:39.790898Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2506.07371"},"observation_digest":"sha256:91afe6e4c7bd89a0e4c3d56c492cef578aea739313d639557fc62a512641d929","observation_id":"d7d201a4-5e4f-4a6d-b11d-e3d890e46e7a","resolution":{"observed_at":"2026-08-07T05:41:39.790898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-06T19:06:15.872778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06523","last_updated":"2025-07-09T03:51:27Z","snapshot_observed_at":"2026-08-07T04:03:28.720884Z","submitted_at":"2025-07-09T03:51:27Z","title":"FIFA: Unified Faithfulness Evaluation Framework for Text-to-Video and Video-to-Text Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:06:15.872778Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2507.06523"},"observation_digest":"sha256:34e138b65d1f40fc569da64ca2169ff838505baf1585f52f693c6befc2596e67","observation_id":"ec42d65f-0f14-4190-a446-33c46f45a37f","resolution":{"observed_at":"2026-08-06T19:06:15.872778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-06T05:29:20.162727Z","title":"Videohal- lucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01781","last_updated":"2025-08-03T14:37:16Z","snapshot_observed_at":"2026-08-06T05:29:07.933755Z","submitted_at":"2025-08-03T14:37:16Z","title":"A comprehensive taxonomy of hallucinations in Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T05:29:20.162727Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2508.01781"},"observation_digest":"sha256:9b02f0a62d72c83c2eb2896ec42a164f8c684e1aab7887cbb945d1d28edc4a15","observation_id":"027c2733-a6de-4e19-b0b2-cc995b089554","resolution":{"observed_at":"2026-08-06T05:29:20.162727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-05T20:28:49.973347Z","title":"Wang et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-07T18:23:08.889281Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:49.973347Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:086e4149fbfa01c00fd2db3a7fc63464e3c74c68eaa6af417495760e23614852","observation_id":"67395221-9853-4575-b4c2-3f03ae334068","resolution":{"observed_at":"2026-08-05T20:28:49.973347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-04T20:32:56.952259Z","title":"arXiv:2406.16338 doi:10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08538","last_updated":"2025-09-11T11:14:00Z","snapshot_observed_at":"2026-08-07T04:48:45.855809Z","submitted_at":"2025-09-10T12:34:07Z","title":"MESH -- Understanding Videos Like Human: Measuring Hallucinations in Large Video Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T20:32:56.952259Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2509.08538"},"observation_digest":"sha256:efda25a78f293428eaed406122051d4edd62a0fbb9a7b11e8bcb2a673b9def24","observation_id":"14760259-ed39-4b68-b20a-974d045ae3cb","resolution":{"observed_at":"2026-08-04T20:32:56.952259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-03T06:36:26.055855Z","title":"Videohallucer: Evaluating intrinsic and extrinsic halluci- nations in large video-language models.arXiv preprint arXiv:2406.16338,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22574","last_updated":"2026-06-05T06:23:47Z","snapshot_observed_at":"2026-08-03T06:36:23.881603Z","submitted_at":"2026-01-30T05:16:12Z","title":"Enhancing Video Representations with Spatiotemporal-Semantic Residual to Mitigate Hallucinations in Video Large Multimodal Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T06:36:26.055855Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2601.22574"},"observation_digest":"sha256:6ed9d3e907232aa0f8eeb7aec5f0d6b7d27415de7c11d5f64b4210480f1720b1","observation_id":"d80fcd96-959f-4a72-9985-1e19fcb2a6e0","resolution":{"observed_at":"2026-08-03T06:36:26.055855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2604.12582","last_updated":"2026-04-14T11:05:42Z","snapshot_observed_at":"2026-07-06T23:00:46.620106Z","submitted_at":"2026-04-14T11:05:42Z","title":"Relaxing Anchor-Frame Dominance for Mitigating Hallucinations in Video Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T14:54:52.710686Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2604.12582"},"observation_digest":"sha256:0819d29ffff656e769e01d602e8a15bb8130194d87006a3c7923ba35e9c2a2f1","observation_id":"c60caf0e-8f36-4278-a306-886a66ec9cd3","resolution":{"observed_at":"2026-05-11T11:26:03.552575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2604.17375","last_updated":"2026-04-19T10:58:40Z","snapshot_observed_at":"2026-08-02T21:21:44.410489Z","submitted_at":"2026-04-19T10:58:40Z","title":"When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T06:41:59.641410Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2604.17375"},"observation_digest":"sha256:05bf82c8b86b28f39e09b9f4d9b31a59ac08ff88da722c39b218e597e7c79b09","observation_id":"dc1ac5f3-e5f9-4bb0-be03-28ec57215932","resolution":{"observed_at":"2026-05-10T06:46:37.525334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2604.17820","last_updated":"2026-04-20T05:19:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T05:19:38Z","title":"Raven: Rethinking Automated Assessment for Scratch Programs via Video-Grounded Evaluation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T04:52:42.032751Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2604.17820"},"observation_digest":"sha256:f36fa6379e1fb58aad9d2484cea15d3b7e294b25a7cdf9e34757438ee882e660","observation_id":"233d9c0f-9cb1-4ffa-b4e5-83eee116964d","resolution":{"observed_at":"2026-05-10T11:10:09.917066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2604.20473","last_updated":"2026-04-22T12:02:24Z","snapshot_observed_at":"2026-07-30T08:45:43.657043Z","submitted_at":"2026-04-22T12:02:24Z","title":"Video-ToC: Video Tree-of-Cue Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T01:20:29.374012Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2604.20473"},"observation_digest":"sha256:b206f177744f11206f2311221354978bced1f6524a6d434a758376d358355160","observation_id":"8ba7f7f4-e5b6-4f15-8692-f2d1bc920c28","resolution":{"observed_at":"2026-05-11T13:36:09.697431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-14T19:27:29.843866Z","title":"https://doi.org/10.48550/arXiv.2406.163382","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.22226","last_updated":"2026-07-13T04:05:34Z","snapshot_observed_at":"2026-07-16T23:18:42.650626Z","submitted_at":"2026-04-24T05:02:03Z","title":"Towards Temporal Compositional Reasoning in Long-Form Sports Videos","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T19:27:29.843866Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2604.22226"},"observation_digest":"sha256:8cdf6b3325386cf95c094cb2dfdc6760e4918c6c7a23f4430d17c1a1799f27ae","observation_id":"647867db-5ae3-4a31-b34e-049a3bf89270","resolution":{"observed_at":"2026-07-14T19:27:29.843866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2605.04515","last_updated":"2026-05-06T05:48:56Z","snapshot_observed_at":"2026-08-06T20:21:26.793848Z","submitted_at":"2026-05-06T05:48:56Z","title":"From Priors to Perception: Grounding Video-LLMs in Physical Reality","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T17:41:23.233366Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2605.04515"},"observation_digest":"sha256:6e89bf9d9ff0987e6c3d457de45f7b32248dd99abab096e45c05926462abd7eb","observation_id":"534d4747-67b5-42ac-b4ed-b35df1bc28f7","resolution":{"observed_at":"2026-05-11T17:21:08.287569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2605.09904","last_updated":"2026-05-12T03:09:23Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:47:59Z","title":"TOC-Bench: A Temporal Object Consistency Benchmark for Video Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T04:13:21.487431Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2605.09904"},"observation_digest":"sha256:eef3f12116338bdec08aa0acfccf0811c26d45b7005e11528b56bdc2a19b661a","observation_id":"e0c4e2a0-238a-45a5-9bf0-b0dd0ba8ad08","resolution":{"observed_at":"2026-05-12T06:31:26.781676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2605.09904","last_updated":"2026-05-12T03:09:23Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:47:59Z","title":"TOC-Bench: A Temporal Object Consistency Benchmark for Video Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T06:53:42.726350Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2605.09904"},"observation_digest":"sha256:37a22f1701470028467f4999e2e5318d7b178dcb1aec7011fff790d03c2cd52d","observation_id":"d1592a4c-4973-4d8d-9ed4-49b108b48f40","resolution":{"observed_at":"2026-05-13T06:57:28.252738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2605.16403","last_updated":"2026-05-13T05:00:19Z","snapshot_observed_at":"2026-07-06T23:27:34.514541Z","submitted_at":"2026-05-13T05:00:19Z","title":"When Vision Speaks for Sound","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T22:12:52.160596Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2605.16403"},"observation_digest":"sha256:01145c9dac4c6cccb42c1115c605b8a7c3247602cb6c4f2d777a037f17a7c55e","observation_id":"d7e427cf-6df5-443c-b8ee-d355a7adc5d1","resolution":{"observed_at":"2026-05-20T22:13:46.830651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2606.03614","last_updated":"2026-06-02T13:14:02Z","snapshot_observed_at":"2026-08-06T16:39:23.411692Z","submitted_at":"2026-06-02T13:14:02Z","title":"OmniHalluc-L: Counterfactual Benchmarking and Modality-Perturbation Reliability Calibration for Long-Form Omni Hallucination","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T07:31:51.780636Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2606.03614"},"observation_digest":"sha256:b5329d952e62574149976962c42a65aacc41346857ef889e2a934d338d1f7e47","observation_id":"800a68a7-01b2-4ef0-9d04-a977a9a6ee02","resolution":{"observed_at":"2026-07-02T06:06:41.663618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2606.11792","last_updated":"2026-06-11T05:33:10Z","snapshot_observed_at":"2026-08-05T06:18:17.353570Z","submitted_at":"2026-06-10T08:25:09Z","title":"MultiToP: Learning to Patch Visual Tokens to Mitigate Hallucinations in Video Large Multimodal Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T10:02:58.341050Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2606.11792"},"observation_digest":"sha256:f93a42108b785aaeac700b303e4566192c9496fcebf1b5b5e92917fd3e3709b3","observation_id":"45772a24-4efd-4ff5-8619-d861dc3a8784","resolution":{"observed_at":"2026-07-03T10:27:56.152859Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2606.31933","last_updated":"2026-06-30T16:38:41Z","snapshot_observed_at":"2026-08-02T09:05:31.252280Z","submitted_at":"2026-06-30T16:38:41Z","title":"No Place to Hide: Benchmarking Video Hallucination with Background-Controlled Pairs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-01T05:35:08.200219Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2606.31933"},"observation_digest":"sha256:3d20258a4b917df51412efa1bdbf3f8132a806c3d44eeb8a7c81fca743c7e19b","observation_id":"14e98e60-218d-4b8f-b609-c45d9003ed08","resolution":{"observed_at":"2026-07-01T10:25:41.367812Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":"2406.16338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-07-03T10:27:56.151478Z","title":"Videohallucer: Evaluating intrinsic and extrinsic hallucinations in large video-language models","venue":null,"work_id":"b9496e4e-b5c2-4eec-9b85-0c41f2b57ed9","year":2024},"citing_paper":{"arxiv_id":"2607.01117","last_updated":"2026-07-01T16:04:24Z","snapshot_observed_at":"2026-08-01T19:51:36.300993Z","submitted_at":"2026-07-01T16:04:24Z","title":"MoHallBench: A Benchmark for Motion Hallucination in Video Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-02T13:44:48.250838Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2607.01117"},"observation_digest":"sha256:5cc20a08b21f5cf9f0c2e3147c9633e9dbf3fad93dbbcda2b87d7663f0a99df8","observation_id":"59a397f0-75c9-4156-bc67-378eb53aaa3b","resolution":{"observed_at":"2026-07-02T13:46:58.702099Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.16338/citation-record","integrity":"/paper/2406.16338/integrity","json":"/paper/2406.16338/citation-record.json","paper":"/paper/2406.16338"},"outbound":[],"paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T20:31:18.439488Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2406.16338."}