{"as_of":"2026-08-23T00:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e3beecb396db84ebc42c7b7ff50da5b98264ff12b36d9d095ef820937a8052c","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:01:21.950461Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.09584/citation-record","integrity":"/paper/2508.09584/integrity","json":"/paper/2508.09584/citation-record.json","paper":"/paper/2508.09584"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T21:01:21.716984Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.716984Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:fb0392b11a097a8098cd3f2a4fb96ddaaf4e0dfe37b44ccf778321e5e09d4a6a","observation_id":"bf84e572-6857-4e44-9af6-52e32275a741","resolution":{"observed_at":"2026-08-05T21:01:21.716984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.857642Z","title":null,"venue":null,"work_id":"bab39dab-aa5e-4aef-87de-a4a754ab9261","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.722056Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:8d0288b7ccbce23bc37e54766a6714c768084430a89885d1019c1ca50574ac8c","observation_id":"3f4f6fda-e87a-4992-bd53-10b376434a6d","resolution":{"observed_at":"2026-08-05T21:01:22.864777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.840131Z","title":null,"venue":null,"work_id":"2920c27e-fcac-4624-b601-e7761bd0c6c4","year":2007},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.726862Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:fbf4625512683e8add11097701153cdd0c25cfe5b135320c773eb21299772e38","observation_id":"2f061fd8-78b7-4d13-b002-e7cc9f16598a","resolution":{"observed_at":"2026-08-05T21:01:22.844730Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T21:01:21.732650Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.732650Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:721440c5aac0bba74a2109cc952fc0882784704916cc54200c26cdd0c6a495f0","observation_id":"1caa85e6-4877-44bb-8d12-bd900a3bed81","resolution":{"observed_at":"2026-08-05T21:01:21.732650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-05T21:01:21.738548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.738548Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:ea9c36b485a9c9e69713d03e7d4c7e498121a27d8c2237158f084df3f471962c","observation_id":"6d23b856-f641-4779-a40f-1a8d75d5d3ac","resolution":{"observed_at":"2026-08-05T21:01:21.738548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.824449Z","title":null,"venue":null,"work_id":"86e8f203-354e-4e5d-8ae5-b81d505d635b","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.743654Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:5d4d6a5673625e3edf495c37decb9e98c16f2f232d3f403bf86cf2104e8f2997","observation_id":"fe4f39d6-fc0f-4c95-8a4a-aa85b36a7bda","resolution":{"observed_at":"2026-08-05T21:01:22.829661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:21.748811Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.748811Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:28a71f89a99fec0b3291868e12810509aac5c565774718a043e00ec4aaa45a38","observation_id":"9e545a5a-e912-4e5f-bcbe-47d43a62370a","resolution":{"observed_at":"2026-08-05T21:01:21.748811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.801125Z","title":null,"venue":null,"work_id":"f19ba50e-7c40-447c-9c9c-b7ae74e21b8b","year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.757789Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:bed2d06b9aa6ddee3be4f1d7be9b82f7c7b61e3f3073bd4f2385f043a3528629","observation_id":"c8da8b56-cac0-4ecc-9cb7-c68ad3ac901e","resolution":{"observed_at":"2026-08-05T21:01:22.805208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.787218Z","title":null,"venue":null,"work_id":"a5e8eedc-cbc0-494c-adee-59231ac4ef8c","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.762062Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:e1696f67df92237177d3cb9a245a573abc9f6a6170ec18f1aa22617b96038702","observation_id":"fad18707-b9a2-47ab-9fd5-cd3af37c50be","resolution":{"observed_at":"2026-08-05T21:01:22.791167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.773165Z","title":null,"venue":null,"work_id":"8f21873a-d41e-4993-b4d6-9057ae598da2","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.766720Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:9f43cb4d7c90fadeb54a9d4ea1b6b83e61ccdf5381f2f49edd1b93562b984ef2","observation_id":"13f17e2d-0916-4c51-80a4-912fa921bc38","resolution":{"observed_at":"2026-08-05T21:01:22.777733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.759726Z","title":null,"venue":null,"work_id":"bbfdae45-63f8-4325-8bef-1899888e4f5a","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.771599Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:99479865fc4b934410f6fbebb13e59c7e4675e50ba838ab21cbe9985ab36ecb9","observation_id":"b9fdc96d-8dbf-4b51-9c82-b056487c700e","resolution":{"observed_at":"2026-08-05T21:01:22.764091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.746843Z","title":null,"venue":null,"work_id":"5db4dc53-d05c-4c0d-8499-17dffef22353","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.776143Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:09fe9c163f494bb7516ef0a4505bf80107f754d7b2ae59a860157bfae004cfab","observation_id":"43077d48-ec48-4de7-b220-1d89733b4c0f","resolution":{"observed_at":"2026-08-05T21:01:22.750779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.733645Z","title":null,"venue":null,"work_id":"3911e93f-41c1-4dfb-ac1a-5c6c34d5e693","year":2009},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.780514Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:a4209a504292cee1df6f732cb98e7e6edc9592255f5d80fb1433ff3839ba1263","observation_id":"cc5776fa-72a9-4def-a0ac-1f2976b020cc","resolution":{"observed_at":"2026-08-05T21:01:22.737666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.720688Z","title":null,"venue":null,"work_id":"b57f4638-85b6-4a7d-882b-0fb413936cf2","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.784695Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:651c62266b2bcfa692922702201d7b95e194bbf260691ca3480dae9f0b2e074f","observation_id":"73766bf4-c3d3-4cd3-93c7-c24aa7fc3e41","resolution":{"observed_at":"2026-08-05T21:01:22.724597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16420","last_updated":"2024-01-29T18:59:02Z","snapshot_observed_at":"2026-08-16T05:38:56.513422Z","submitted_at":"2024-01-29T18:59:02Z","title":"InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16420","snapshot_observed_at":"2026-08-05T21:01:21.789352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.789352Z"},"links":{"cited_paper":"/paper/2401.16420","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:5dc17d6ff4ca6be7a31bbe811dffea6ae6b34d51403b394e3def33d6716a1a51","observation_id":"b8ce315f-da5d-4f72-82c5-f5e1fd4bd4cf","resolution":{"observed_at":"2026-08-05T21:01:21.789352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-05T21:01:21.793740Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.793740Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:490cc340dcb465d192db727be8b55957b158373be38140014ce9685867700761","observation_id":"4fe664ff-7425-472e-9bcc-746af1962d6f","resolution":{"observed_at":"2026-08-05T21:01:21.793740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.695549Z","title":null,"venue":null,"work_id":"3feb4bd7-aa58-49f6-a2af-2380cdaf8cf4","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.798853Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:a655520e5eb56fdf37cd6cec4e6827131b47458ff432b6dfaa68c022fd7b75ce","observation_id":"7cfe6aaa-ca19-4d77-b36e-68e59879d55d","resolution":{"observed_at":"2026-08-05T21:01:22.710719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.633012Z","title":null,"venue":null,"work_id":"b5932fd1-fc1f-4eed-b6e9-0dce62ad3050","year":2025},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.803487Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:7902ae7cb0483b8f14a43966856030f29fe5890cee29646347da9c9ac35e9108","observation_id":"25b140cf-0a92-4d3b-a818-38e492c853a3","resolution":{"observed_at":"2026-08-05T21:01:22.659368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.564868Z","title":null,"venue":null,"work_id":"b5757ca7-c859-49b4-9892-8c32d839a4c4","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.807867Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:a8558c52c566eb080160978daffb1505d1da913a377ee88336928d066a8e07ad","observation_id":"480248aa-9f42-44c6-b1c7-5a51cd0261b8","resolution":{"observed_at":"2026-08-05T21:01:22.595215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.533127Z","title":null,"venue":null,"work_id":"e1c01d84-9164-4206-821a-b6a2bab4e77b","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.811967Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:45520a6c9167246ac950fadaf557ea91518ff6f582faa60ce437ed7caf4148c4","observation_id":"5a756b33-16da-4241-9143-6dd2acdd6f3b","resolution":{"observed_at":"2026-08-05T21:01:22.537637Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.518742Z","title":null,"venue":null,"work_id":"cddf8a9f-5944-4e1c-bd79-651da752ea44","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.816053Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:1d0007b95a04db5ab73d77a3cd558d73626de492dfbe628fd0d15a45c0e9626a","observation_id":"915ca544-e355-4741-a394-17e05a4e2175","resolution":{"observed_at":"2026-08-05T21:01:22.523176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-05T21:01:21.820074Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.820074Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:7852d96c59ca9ae9ae3051a5794a672d14e334e0cfc63068e0c83d12c3771283","observation_id":"98d21b6b-5c25-4852-a52a-74a09f4d2142","resolution":{"observed_at":"2026-08-05T21:01:21.820074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.503242Z","title":null,"venue":null,"work_id":"167951f3-c090-4536-8bff-919859f8c377","year":2025},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.824825Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:54856fc520c9e59c6fce2be1f481718263eb42ce3b6352163d29d91ec2ed0704","observation_id":"f0335b90-7531-4e5f-9af2-9d9c4bf9b542","resolution":{"observed_at":"2026-08-05T21:01:22.507707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.488810Z","title":null,"venue":null,"work_id":"2f82c9ac-1b21-49ce-b84a-a005d465a96e","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.828858Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:d96cadcdc9e3bc44d97ed96c2dc0a93886a4c1e9f9dc22c2cd42e3ff382c7456","observation_id":"25293c3b-d722-4d48-9213-c2610ef22ae9","resolution":{"observed_at":"2026-08-05T21:01:22.493058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.474628Z","title":null,"venue":null,"work_id":"c247a460-0ab3-4fc6-920b-8469ea2d9404","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.833622Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:54606b016e4e708fe3a6199e3eef52e1f2bd01c582ae058d348bc5570aa4c22b","observation_id":"eddb343b-dfb2-4710-939f-fbd3e9a3c69c","resolution":{"observed_at":"2026-08-05T21:01:22.478824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.460629Z","title":null,"venue":null,"work_id":"6a04cca5-22b0-49f1-8cfd-3ab2d070ecb0","year":2014},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.838762Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:681621292a46ddd2f2227b1c69144a93f4fbe7b3ec7c92b80bf2676dff086854","observation_id":"d7c5509e-1e90-4004-a536-e33f719cef5b","resolution":{"observed_at":"2026-08-05T21:01:22.464741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.446689Z","title":null,"venue":null,"work_id":"49821e25-adf2-4b62-a0b0-b2b5efe92565","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.843571Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:5e6c3a3096596c0e9e11311d1fb7c6025b4a6ed311167c0ebff5ffa326c1ff01","observation_id":"dba439b2-2a1c-4a2d-aee4-cab421f0d5cb","resolution":{"observed_at":"2026-08-05T21:01:22.450843Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:21.848072Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.848072Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:3a92ea409cffb7e5580331ca206b425cf70032160d51ea614d5cfb5e5b951671","observation_id":"40dcf540-13a5-4959-a325-ca1119eb51b1","resolution":{"observed_at":"2026-08-05T21:01:21.848072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.409747Z","title":null,"venue":null,"work_id":"f94d22fd-6cf6-4cab-99bd-bb34f5550681","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.859662Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:752b2a518d12243e88a1ce95fed8c4ba8a01fa904c9eb1030ee1d40ecdbceb97","observation_id":"cd087f21-da4f-4efd-8026-e135418715f5","resolution":{"observed_at":"2026-08-05T21:01:22.414074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.394317Z","title":null,"venue":null,"work_id":"ab60f331-09dc-48ff-94ee-048517a25c2f","year":2025},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.864304Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:60b2a40a9d9e950b9a49b9d0a174f2365b3348d35b2093b89f9fd9fcaa9ad9d9","observation_id":"5fa0878b-cd7f-4bb3-9f84-d6c90946f94d","resolution":{"observed_at":"2026-08-05T21:01:22.399360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:21.868457Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.868457Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:54dd6507ccd7c59f2dc36cfd70c7b859c24a672f6e880676688923caa2e8a0f4","observation_id":"3fc10043-5954-4536-a79c-c4edadf8eb44","resolution":{"observed_at":"2026-08-05T21:01:21.868457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.355151Z","title":null,"venue":null,"work_id":"514f60d9-cb09-4117-9ba7-8fca40e79ed0","year":2018},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.878464Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:827475802887fb536119d558bef69496bec1e38dfa4f71309c5b2a73b82eb219","observation_id":"3529db7b-9316-46b7-8bee-1b9645bcefcd","resolution":{"observed_at":"2026-08-05T21:01:22.359680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.341519Z","title":null,"venue":null,"work_id":"6725604c-6267-489b-8859-ba92f543c35a","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.882553Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:e8d2d24928334f70642ad17664e219435939d2f7957cac57f2f3b33e43e88e26","observation_id":"082fd50e-02e0-4b71-a528-7e9275eb52a5","resolution":{"observed_at":"2026-08-05T21:01:22.345618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.368909Z","title":null,"venue":null,"work_id":"5d31cb7e-517d-49da-a2ea-baeafd5b7220","year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.872840Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:0915564eeefbea21aaacfd7f3b8e817b4e20e3bb02994551dd0779f5602acf66","observation_id":"51214ed7-2eea-4891-8a04-67e477639f7c","resolution":{"observed_at":"2026-08-05T21:01:22.373387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.328209Z","title":null,"venue":null,"work_id":"eec1ebfe-935e-4fbf-9960-2cd50ca8a681","year":2018},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.891061Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:75ac5923811e3eded9fa57cae52b16260ea6b7c4f8de9f0c11bc9febd5d29dfd","observation_id":"a780eb84-4afd-4e51-942e-e9611f7f229b","resolution":{"observed_at":"2026-08-05T21:01:22.332268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.314029Z","title":null,"venue":null,"work_id":"44c64220-905c-4ab0-bbbe-afc8e86c0b5c","year":2022},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.895009Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:5f2e85227a62965ef4ace87ee2dfed23e3ee6cd28eac029cb4631ffd03530c2f","observation_id":"6e5d5bb3-e3a9-4bb1-acda-e7edba12fd7d","resolution":{"observed_at":"2026-08-05T21:01:22.318710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05922","last_updated":"2023-09-12T02:34:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-12T02:34:06Z","title":"A Survey of Hallucination in Large Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05922","snapshot_observed_at":"2026-08-05T21:01:21.886601Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.886601Z"},"links":{"cited_paper":"/paper/2309.05922","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:267586f06bb11f9ff8b33361b8b48de3bed01fb053d2d44f4f260843e288c19d","observation_id":"3c5ffe1c-0f43-4bbe-ab7b-e2510302299c","resolution":{"observed_at":"2026-08-05T21:01:21.886601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-20T09:51:02.717471Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-05T21:01:21.903186Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.903186Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:f7c4f9a6d7ca11749af962f0e115386a3be0059a50cf7c41f32ce781a5264811","observation_id":"affc2308-9aa7-48b9-a23b-d18a1657460c","resolution":{"observed_at":"2026-08-05T21:01:21.903186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.283648Z","title":null,"venue":null,"work_id":"12c5e8c8-3862-4202-88f0-687a14dc7c6e","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.907323Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:430b62377be0d3aeb4c6741ed87b22c8622f5ed388360fd84beed3640081edea","observation_id":"98a3375c-3101-4af6-9f1b-0733d719296f","resolution":{"observed_at":"2026-08-05T21:01:22.287774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.299034Z","title":null,"venue":null,"work_id":"b4fecb6d-8812-498d-ac79-f139f16e452d","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.899206Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:fef469aae51991b864df2fea66c54932f08040ac48b0bda6b86e11def381e08c","observation_id":"d25fac17-4712-46f3-8d64-8d264b4c8dd0","resolution":{"observed_at":"2026-08-05T21:01:22.303553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-05T21:01:21.915655Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.915655Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:0cc86657858f63c626d8680be92a63a2fe750d23d7fc2b9d2fb0a35f51a16405","observation_id":"99c62565-55ca-4e6d-8643-fec15360054c","resolution":{"observed_at":"2026-08-05T21:01:21.915655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.268577Z","title":null,"venue":null,"work_id":"465c0528-77e7-431b-a996-a79f40185503","year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.919875Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:7791ccb27197c347dfc71a0deb8ce25aee7ad4db65006da3020b95ac48457847","observation_id":"e3dbeac4-0f01-4c75-bedb-8776c5792b34","resolution":{"observed_at":"2026-08-05T21:01:22.272911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-08-14T15:48:28.214119Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-08-05T21:01:21.911363Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.911363Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:2be60c54334337ae444a1bebc4a25d9596e9e11d17be15932adbe4c1c51ade31","observation_id":"438cd640-75ce-4f27-b2f4-723bf4f42247","resolution":{"observed_at":"2026-08-05T21:01:21.911363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20718","last_updated":"2026-04-08T17:39:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-30T05:18:55Z","title":"MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2412.20718","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.20718","snapshot_observed_at":"2026-08-05T21:01:22.040596Z","title":"MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models","venue":"cs.CV","work_id":"67f4f281-734d-40fb-ad89-1303539ed8e3","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.927846Z"},"links":{"cited_paper":"/paper/2412.20718","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:1869b06a2e24dd414c84806cec2f9e3b63fc4d9731c895e0e2e0b63b89011198","observation_id":"b35c3fb3-ea52-443a-a1b4-af7c6ed589b8","resolution":{"observed_at":"2026-08-05T21:01:22.048261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-08-21T07:48:51.700518Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-05T21:01:21.932290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.932290Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:e35fb4535ec77053dec384f9f6e013b49f4cd04ffc8ab514d95a44cfbacf76c5","observation_id":"66e7e325-eeb2-4db5-8cd6-c9f0d5cc9761","resolution":{"observed_at":"2026-08-05T21:01:21.932290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.254677Z","title":null,"venue":null,"work_id":"57cfb533-d7f3-4515-a243-b1f7b8c35e0c","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.923804Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:dada129dfb320d84ed2d7529a00bc976f6acd82a48472d1893acf0a0025f7004","observation_id":"32212485-051c-4a9d-a61e-46d62f0c06ce","resolution":{"observed_at":"2026-08-05T21:01:22.258861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.225187Z","title":null,"venue":null,"work_id":"635bfe95-bf62-4eea-b080-0f78be3f5aa9","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.941562Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:5fa779b0242fd33c85c22eed8899115dd97fefd49e656a66c3d6a8c89a31b2c7","observation_id":"0f97e699-76a1-43c6-93db-7395276cf8d3","resolution":{"observed_at":"2026-08-05T21:01:22.229508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15112","last_updated":"2023-12-14T17:21:39Z","snapshot_observed_at":"2026-08-21T19:15:22.406940Z","submitted_at":"2023-09-26T17:58:20Z","title":"InternLM-XComposer: A Vision-Language Large Model for Advanced Text-image Comprehension and Composition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15112","snapshot_observed_at":"2026-08-05T21:01:21.945592Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.945592Z"},"links":{"cited_paper":"/paper/2309.15112","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:8b9c003f19fbb27a2a2173b25550d4edcc7ed93f99b1159343edceb6a92105c9","observation_id":"0c4b6d2b-307f-4182-91e6-6717ded38838","resolution":{"observed_at":"2026-08-05T21:01:21.945592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.240006Z","title":null,"venue":null,"work_id":"cde1bd7a-a33c-46bc-a56b-428714f81e63","year":2024},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.936601Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:b2b05bb5e8541329c10bf56d15f9a6400a387caf8dbc381375752c1f6d37bb74","observation_id":"f194860f-7484-430e-8621-6b245b39a795","resolution":{"observed_at":"2026-08-05T21:01:22.244771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T21:01:21.950461Z","title":"yes\" or","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.950461Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:bea0a810f854c6c206a3a5a188ab6aab7f0ff91cd0522b44dd8c11b819cea8e9","observation_id":"ca5a0299-d50f-4b6e-b821-58632b51151b","resolution":{"observed_at":"2026-08-05T21:01:21.950461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-08-13T14:42:26.982679Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-05T21:01:21.753328Z","title":"arXiv preprint arXiv:2306.15195 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.753328Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:ea20951a2cb16687f70726023f3cbeed6b5ead166299de35f6f2f39c1573aea6","observation_id":"758218ea-6ace-4fad-938f-ecb16898b751","resolution":{"observed_at":"2026-08-05T21:01:21.753328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:01:22.423782Z","title":null,"venue":null,"work_id":"e1d125bb-49a7-4946-a3c6-f06081c43bf3","year":null},"citing_paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:21.852636Z"},"links":{"citing_paper":"/paper/2508.09584"},"observation_digest":"sha256:171b2208aff0f5ac7ce40169435feeeeb7a8ae0c06e493e36ee51cf92677efa7","observation_id":"0e4ce5ca-2b4d-49d4-bf03-3d226b0f8bf0","resolution":{"observed_at":"2026-08-05T21:01:22.428180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.09584","last_updated":"2025-08-14T11:57:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T02:55:56.798794Z","submitted_at":"2025-08-13T07:58:01Z","title":"SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2508.09584."}