{"as_of":"2026-08-06T12:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fccd222928698f7f058bfac0d16a085ae0ba80ab27eac94a7d3c3888fa6a64d","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:58:54.366215Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:44:01.132916Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T16:44:56.026212Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.04059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04059","snapshot_observed_at":"2026-06-30T16:44:56.026212Z","title":"Beyond the visible: Benchmarking occlusion perception in multimodal large language models","venue":null,"work_id":"221ed3ce-d7d6-4b6e-8f23-5c61cadae9ab","year":2025},"citing_paper":{"arxiv_id":"2511.14159","last_updated":"2026-07-17T15:39:00Z","snapshot_observed_at":"2026-08-03T21:43:56.189055Z","submitted_at":"2025-11-18T05:48:08Z","title":"MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T19:51:04.983299Z"},"links":{"cited_paper":"/paper/2508.04059","citing_paper":"/paper/2511.14159"},"observation_digest":"sha256:37e5787260cfe3ca54ca72269d46a5e87665c437ef098c1762440f8005105df1","observation_id":"caba08cf-eab8-4640-ab40-4d7fe6c35fe3","resolution":{"observed_at":"2026-05-21T19:54:20.245542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04059","snapshot_observed_at":"2026-08-03T21:44:01.132916Z","title":"Beyond the visible: Benchmarking occlusion perception in multimodal large lan- guage models.arXiv preprint arXiv:2508.04059, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.14159","last_updated":"2026-07-17T15:39:00Z","snapshot_observed_at":"2026-08-03T21:43:56.189055Z","submitted_at":"2025-11-18T05:48:08Z","title":"MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T21:44:01.132916Z"},"links":{"cited_paper":"/paper/2508.04059","citing_paper":"/paper/2511.14159"},"observation_digest":"sha256:6617a59d02320e7dffcfa96b66612f78f327ee63af9e6371e9fdf89db8db7d03","observation_id":"edcab68b-8e9a-45de-a603-0f26c6b6cef6","resolution":{"observed_at":"2026-08-03T21:44:01.132916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.04059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04059","snapshot_observed_at":"2026-06-30T16:44:56.026212Z","title":"Beyond the visible: Benchmarking occlusion perception in multimodal large language models","venue":null,"work_id":"221ed3ce-d7d6-4b6e-8f23-5c61cadae9ab","year":2025},"citing_paper":{"arxiv_id":"2605.23176","last_updated":"2026-06-15T18:43:33Z","snapshot_observed_at":"2026-07-30T02:30:56.837847Z","submitted_at":"2026-05-22T02:52:06Z","title":"DRIVESPATIAL: A Benchmark for Spatiotemporal Intelligence in VLMs for Autonomous Driving","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-25T05:10:32.522453Z"},"links":{"cited_paper":"/paper/2508.04059","citing_paper":"/paper/2605.23176"},"observation_digest":"sha256:f7d4bec466959cbf42f6400d66a8142384a4840c7af23a11070b8ce2b4242cff","observation_id":"66452167-f922-405d-beb1-f2fb9dc6defb","resolution":{"observed_at":"2026-05-25T05:15:22.836189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.04059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04059","snapshot_observed_at":"2026-06-30T16:44:56.026212Z","title":"Beyond the visible: Benchmarking occlusion perception in multimodal large language models","venue":null,"work_id":"221ed3ce-d7d6-4b6e-8f23-5c61cadae9ab","year":2025},"citing_paper":{"arxiv_id":"2605.23176","last_updated":"2026-06-15T18:43:33Z","snapshot_observed_at":"2026-07-30T02:30:56.837847Z","submitted_at":"2026-05-22T02:52:06Z","title":"DRIVESPATIAL: A Benchmark for Spatiotemporal Intelligence in VLMs for Autonomous Driving","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-30T16:40:22.441025Z"},"links":{"cited_paper":"/paper/2508.04059","citing_paper":"/paper/2605.23176"},"observation_digest":"sha256:3222b265c916d806aa8ea252929a5947b8011611fce040c0acd0331db951e799","observation_id":"ff714df9-b2d9-4417-b1c4-c8c5723470a8","resolution":{"observed_at":"2026-06-30T16:44:56.027656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04059/citation-record","integrity":"/paper/2508.04059/integrity","json":"/paper/2508.04059/citation-record.json","paper":"/paper/2508.04059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:48.190898Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.190898Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:b80a4e77960d04debea65b415e26071264c085535e1246ee1ab6c2b8db7f9585","observation_id":"926ee1fc-fe6a-4aca-8b12-01201a8bf4e7","resolution":{"observed_at":"2026-08-06T00:58:48.190898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:48.287875Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.287875Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:c57191aacc6a942323aa386fe471be17f6db222e52c925d71721656e5f8e1660","observation_id":"bb46297e-4b8d-43a6-a604-c2acf5419f11","resolution":{"observed_at":"2026-08-06T00:58:48.287875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:04.111436Z","title":null,"venue":null,"work_id":"d77f0f8c-b72a-428d-b8b4-e88cd5b1bc7a","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.406795Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:673043e3a9c767fa949098505d92a87b281e86178e55ce075615b3073f0ba3da","observation_id":"0ec6eb9d-66b0-4c5c-a127-0dbd557242dc","resolution":{"observed_at":"2026-08-06T00:59:04.224296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:03.844419Z","title":null,"venue":null,"work_id":"b30e86d8-abd2-4671-9bc2-7448896fcc16","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.527730Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:b38f20b57251b73444424c03222472693ae77a3351fb5a4029e796e126dff415","observation_id":"a0c7c0f8-b094-4cb5-a1ce-e3657f56821e","resolution":{"observed_at":"2026-08-06T00:59:04.008912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T00:58:48.669549Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.669549Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:af28dbdcadd2d63981201d7924a74a2771dc0c8d0658d72e1dbf04f6fd446f16","observation_id":"d2f7ba0a-4205-4089-8679-e961551caed1","resolution":{"observed_at":"2026-08-06T00:58:48.669549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:03.581438Z","title":null,"venue":null,"work_id":"303b45dd-d24f-42f5-bd88-ebe6fd2a9686","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.812705Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:c68fd7ddf726baf6066edf6eb0ade82a81a9a806a0224504499633102a290c89","observation_id":"bc457ec6-9978-4645-8da2-a0856af9cad7","resolution":{"observed_at":"2026-08-06T00:59:03.656712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:03.310405Z","title":null,"venue":null,"work_id":"cb9b6d3d-a715-434d-afcc-1597aae84477","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:48.935364Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:166a9932788c578a970132e5c7e74639fee638d5e4f7ce47e1d75b216794ea86","observation_id":"e4a70c2a-eb7d-4237-ac7a-18d7271a11a8","resolution":{"observed_at":"2026-08-06T00:59:03.467913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:03.049948Z","title":null,"venue":null,"work_id":"db6781d9-ded8-459a-9e3c-85d85538d2b7","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.101985Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:06d098a68fe44b96a7c95a2ed2d784c5c07c42adab982927c2045d65e9b4a859","observation_id":"2f125f06-6bb4-4397-ae53-36db71f906d4","resolution":{"observed_at":"2026-08-06T00:59:03.185674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-06T00:58:49.230191Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.230191Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:660899d7a979ac107613a74f09aab638da3723b433b0218fa0c319717163bad8","observation_id":"eff19c35-4aa0-4a44-a12f-df929c52d204","resolution":{"observed_at":"2026-08-06T00:58:49.230191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:02.772054Z","title":"S.; Salehi, M.; Muennighoff, N.; Lo, K.; Soldaini, L.; et al","venue":null,"work_id":"73f0affb-5bb5-49c7-abbc-84cc820f45ac","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.344250Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:62ee2c522b295ae99db1aa3c42bcfcf12484b7aef16c92fec0279e52a8317c1a","observation_id":"052f69b7-9d89-4eb3-9437-72a35c736a54","resolution":{"observed_at":"2026-08-06T00:59:02.878312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:02.515005Z","title":null,"venue":null,"work_id":"7a4519a1-5e89-4197-9972-2cd37bd5572a","year":2018},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.464463Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:dc3415e2f4bce8520e1f172fe97863e15a9823e3ea410e19731e25d3a0db62bd","observation_id":"ed0985e7-ffd2-4e65-a34c-fb2e4f333fbb","resolution":{"observed_at":"2026-08-06T00:59:02.627756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:02.271463Z","title":"o nig, R.; H \\","venue":null,"work_id":"93808f53-ea7c-424f-8194-f339fc0feadb","year":2019},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.603636Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:bb3f006c8639d271884aca0f87118bc9d9bd9f53d774d08244ad5ad886107b96","observation_id":"9ddd17d4-21a4-4ba1-ab1f-ccc9dc9a2507","resolution":{"observed_at":"2026-08-06T00:59:02.406354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-06T00:58:49.699498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.699498Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:14136f88c331c9fc71972936c6821e84aee0bd5a9e9366298d9fdfabc94538e2","observation_id":"a4f258c7-cd21-4b7a-9c85-d0bcf1297dda","resolution":{"observed_at":"2026-08-06T00:58:49.699498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:02.014338Z","title":null,"venue":null,"work_id":"c1ca24bc-fe2b-4243-a1ec-50c582c1404a","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.823189Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:f8c70253c06781071994b8ee5c4fb5ae9a4664a7073d9ef7d5365e83aad9fea3","observation_id":"caff9650-fb32-4a1e-83a5-7dce6e3a54cd","resolution":{"observed_at":"2026-08-06T00:59:02.123689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T00:58:49.955168Z","title":"P.; Perelman, A.; Ramesh, A.; Clark, A.; Ostrow, A.; Welihinda, A.; Hayes, A.; Radford, A.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:49.955168Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:6ecebf90cc5c68227ce0ceee26fdfabe6b3b6c4f308b81dbca594dd17af0952b","observation_id":"e894da89-05e5-44ee-a1f5-dc10386e272a","resolution":{"observed_at":"2026-08-06T00:58:49.955168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:01.795753Z","title":null,"venue":null,"work_id":"0bd21ef8-774e-43fa-b433-c6200d24c058","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.050354Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:32477c11b521bb0ebe651b2d7a7db779f1205e35ec518f136b3e1b978ab8bdbc","observation_id":"502a73e9-919a-4476-b6de-80da5ead6593","resolution":{"observed_at":"2026-08-06T00:59:01.891815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:01.570034Z","title":null,"venue":null,"work_id":"47ecbb8d-5e8b-42f5-b23d-3c22a4c46961","year":1979},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.173769Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:f811a0a152fe8b9cd76674074496506013c90c2a2ba56d5a98ba485d871aacde","observation_id":"dee141c2-5871-4109-a57f-5bbb8bf21cfa","resolution":{"observed_at":"2026-08-06T00:59:01.686753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:01.289911Z","title":null,"venue":null,"work_id":"7ef087e1-a64d-4c4c-b8ff-d01ec07869b3","year":2015},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.294498Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:ad517e3e88508d7b11f0cf1f76167f11cb8aa9188fad2690c1803cf2eea83549","observation_id":"df177e8c-3f81-4684-b051-6a8819f22268","resolution":{"observed_at":"2026-08-06T00:59:01.438515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:01.068821Z","title":null,"venue":null,"work_id":"cc8a3c4f-3aed-403d-9a8c-8b397da6ccb0","year":2021},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.453004Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:75568f79164f08ca5c9844a72b7889b692917efa5c555f454196d62a5c148357","observation_id":"cc74d608-7358-455f-935e-aaee5dfd8ce7","resolution":{"observed_at":"2026-08-06T00:59:01.162990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:00.880729Z","title":"J.; and Shipley, T","venue":null,"work_id":"0388ac57-dd42-4e4d-9671-5ad575af66a5","year":1991},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.559593Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:1e802385a6c340bee0ab2e71b9ee72526b6393948c1f4fbf668bc9bee501b32a","observation_id":"f63d6861-9749-42a6-a438-f63e705f9124","resolution":{"observed_at":"2026-08-06T00:59:00.979455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:00.647324Z","title":"J.; and Spelke, E","venue":null,"work_id":"986212a5-ea80-4e47-a317-ad492f2c4d0e","year":1983},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.663931Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:d545a5ef73a27477ff8a464276264bb199019405828a2a9c6e688a7abd4605a3","observation_id":"e4a4c47d-1942-4a61-9ba4-2b7fa7ca8395","resolution":{"observed_at":"2026-08-06T00:59:00.735057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:50.822887Z","title":"C.; Lo, W.-Y.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.822887Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:0a2e4bb4d74ac386defec5ff7f5e7fb66385da02092166c19d45ed234edb7d2b","observation_id":"5ca85caa-f75e-4cb8-9c8e-d9bbaf0b5437","resolution":{"observed_at":"2026-08-06T00:58:50.822887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:00.377907Z","title":null,"venue":null,"work_id":"3a8d4e19-bfec-421e-8890-9cbbe8a67b15","year":1929},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:50.919377Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:de2b0ecd796e8ef8c60c2684c304e30a0500e2955e74250c2a80240b42d9a1ca","observation_id":"a8663aa8-79bc-4212-8932-4bc38ed28ea1","resolution":{"observed_at":"2026-08-06T00:59:00.500216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:59:00.174848Z","title":null,"venue":null,"work_id":"fbc55452-69bf-4680-8b67-85aa10aead5e","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.061717Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:3b3f51dced764129c5ccd91b2fe64ef2e09229b335793c817eafc5c33b0c3940","observation_id":"691f60fe-9315-49da-a6f5-0607781ae849","resolution":{"observed_at":"2026-08-06T00:59:00.281786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:59.832929Z","title":null,"venue":null,"work_id":"7eadadb8-2c3e-4e11-a128-e0ec8160435c","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.207375Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:3300242feffa22f6ef612241afad9143eb34758d4071c30eb5f81bbd4cc047d3","observation_id":"7f083400-39eb-40c2-8e94-10e9d6d380b9","resolution":{"observed_at":"2026-08-06T00:58:59.990067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:59.571864Z","title":null,"venue":null,"work_id":"e6555213-6323-487f-bc6d-c646670f5c19","year":2016},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.302262Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:bffefbc56222b374c2131dc4e98dcf15499f5f7b543cadc91844dd4666ec715c","observation_id":"989522b4-ca7d-448f-8efb-0bff5add6f80","resolution":{"observed_at":"2026-08-06T00:58:59.690483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:59.251696Z","title":"W.; and Fidler, S","venue":null,"work_id":"39c31b88-7fca-4c11-a08a-5b417aa83b8b","year":2020},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.455131Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:423b8512896c61b57d208c7bc07f6dc2eab0868757cff18b639347b57a2723d3","observation_id":"f04264a7-8bad-4847-8ca8-f19972c10216","resolution":{"observed_at":"2026-08-06T00:58:59.377508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:59.002660Z","title":null,"venue":null,"work_id":"f9a7d049-6716-417d-aec8-d0ad446c5d95","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.598643Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:6b90e3f0487f5ea0db05b1c6defd9114003348068b2c67215bc9cf97000cb6b1","observation_id":"07f8d703-cb36-41cd-ab76-55ec947002a7","resolution":{"observed_at":"2026-08-06T00:58:59.127933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:58.765640Z","title":null,"venue":null,"work_id":"8f6f3ab3-a809-4eb0-a8d6-8ad97baa1bf2","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.765661Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:cb14a27bddec249b5ef7914ddd6a66911f117c88b1e53b82aad423b4d8ec2f7c","observation_id":"28803a17-07a4-41e7-92f0-776a4aff8515","resolution":{"observed_at":"2026-08-06T00:58:58.879915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:58.470628Z","title":null,"venue":null,"work_id":"fa6050a4-3877-4955-aed3-efac7d1d0b4c","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:51.909060Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:6156a921c6757efc117f537d98ec790d59241f0d5ece41af6ccb7b04cfd67832","observation_id":"6b7e90a2-9c90-44a2-b01f-cd710dbdac3b","resolution":{"observed_at":"2026-08-06T00:58:58.590535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:58.214385Z","title":"L.; XiXuan, S.; Xu, Y.; Zhang, S.; Lai, H.; Sun, J.; Yang, X.; et al","venue":null,"work_id":"9a0fbd32-3617-45f9-8d6b-96da641c3dde","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.017619Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:3c6c8462afae28189b2828a706802832895e1947ee45d1dc7baabce04c24c816","observation_id":"82951d38-aebb-4687-a510-eacd1f6cec89","resolution":{"observed_at":"2026-08-06T00:58:58.343360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:57.918175Z","title":null,"venue":null,"work_id":"d5309c48-c584-40d5-bf9f-ac990f082c75","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.157652Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:e4741d5f6127dbfc7d978ba450d9d36aaf2f263e6b915634aa3a8157753b6b67","observation_id":"228e9320-1832-407b-844c-6cf2c145a166","resolution":{"observed_at":"2026-08-06T00:58:58.093555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:57.479451Z","title":null,"venue":null,"work_id":"74cb999a-4b3e-4053-9e58-770b4af5e0cf","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.276161Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:b089d329313e9f556f5cbbba8b7d675dc2ffdfad6d2553f8c434ed456a3b2b42","observation_id":"24e109a3-d895-4fde-b30a-0004985548a9","resolution":{"observed_at":"2026-08-06T00:58:57.681883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:57.180077Z","title":null,"venue":null,"work_id":"edefc06e-08f7-432c-b5eb-7881cf3a715b","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.362149Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:ff7ad52c6c9542145130012a475741ada89a9cfdb424e7d36d98129b4d159b74","observation_id":"49ffd42f-118f-44e9-8e1a-586a580399a9","resolution":{"observed_at":"2026-08-06T00:58:57.263529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:56.960571Z","title":null,"venue":null,"work_id":"e96db74b-601f-4868-8f61-ed66bf9372f4","year":1964},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.479734Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:743667e932548e6f722149df2fcfcad1b374681d2060f89f68c9da7d8a939287","observation_id":"de8f430e-abd6-40aa-b5f9-f62da95b1e11","resolution":{"observed_at":"2026-08-06T00:58:57.063078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:56.718767Z","title":null,"venue":null,"work_id":"d92b31e8-213b-40fe-9403-95723d29f1e4","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.634626Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:a396a4c4dc243c3d3a1d978bee17b6f05d51038c3c5619de0cf5f05fb0c54a2e","observation_id":"cca04a1b-c13f-4f0a-b32a-0beb0b4b757e","resolution":{"observed_at":"2026-08-06T00:58:56.842800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:56.540121Z","title":null,"venue":null,"work_id":"ee45ca1e-ac2e-48a0-85ae-d7dcf56c57b3","year":2019},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.698337Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:817434ac80279c948cffaebfd6378ffe57cf77a75ba3ca358b2e288fba9b0355","observation_id":"30fbac27-1bb8-4d30-9927-93c16029a784","resolution":{"observed_at":"2026-08-06T00:58:56.612478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:56.330559Z","title":"M.; Xing, E.; Yang, M.-H.; and Khan, F","venue":null,"work_id":"44efdab8-d3e9-4c88-ba57-f8b7990be379","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.799854Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:846436227cb1f01fa3127933076a19b6b4f52b15dd4a92138ea409645cfd02db","observation_id":"19f6b06b-800a-4fdc-983d-38765f6036c1","resolution":{"observed_at":"2026-08-06T00:58:56.423234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:56.088902Z","title":"G.; Yu, X.; Haf, R.; and Li, Y.-F","venue":null,"work_id":"1fd17765-0172-4c05-b5a5-05845abdd033","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:52.960130Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:a62f6d42b70c5b6816c3811c399795a1314e861ce32593b89c65ca6db34cd74d","observation_id":"b11b76fc-9452-4390-8ce9-915ce1f6ea3a","resolution":{"observed_at":"2026-08-06T00:58:56.214167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.899069Z","title":null,"venue":null,"work_id":"5baba080-9c75-422c-96ed-04be8757dbfb","year":2020},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.101001Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:53b5cfd347aa2eb8e658ced8dcd22feabfb96b56a7490c5a45519b5d877d2e74","observation_id":"32c628a1-2fca-4248-ac16-f3b4ca7b4bdb","resolution":{"observed_at":"2026-08-06T00:58:55.998793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.731518Z","title":null,"venue":null,"work_id":"08462782-e8cb-4e66-b66d-78725568d892","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.267935Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:0286c311d4816ba21eb00da7646734ce29a6bb260b1b537cdd7999d7864ebd4e","observation_id":"1a1faa76-07d2-4457-a9f7-bc547f475158","resolution":{"observed_at":"2026-08-06T00:58:55.815556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.595043Z","title":null,"venue":null,"work_id":"1d431775-2eb9-4cbc-bcec-db7abb1b8427","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.354516Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:1130ad23401bb2e5bdc281cf629b5d9f96d32c708c04c57fc05566577130aa1b","observation_id":"ce01a478-67f7-479d-abcc-f9e8b55aa455","resolution":{"observed_at":"2026-08-06T00:58:55.651993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.428652Z","title":"M.; Chen, J.; and Yuille, A","venue":null,"work_id":"5efc8193-4eaf-4db5-86bd-40d5f74faf7c","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.434131Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:60db0f1763feeb1caa938eb88297875883d1ed550005e3b44475e29c54e9ad6b","observation_id":"4827f4b0-17aa-4e1e-8096-3f179a616a4d","resolution":{"observed_at":"2026-08-06T00:58:55.499163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.302219Z","title":null,"venue":null,"work_id":"5a1aab39-80aa-4c90-9563-832da9548b8f","year":2023},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.502585Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:bdc4a83d79f6e2384d336201b5d709bb7e534bbf5badbc383b5bd0f100cf0586","observation_id":"fa12420d-fd10-498f-a166-65e2dc586892","resolution":{"observed_at":"2026-08-06T00:58:55.367400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T00:58:53.608486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.608486Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:03a272a6be232b5a4701f67ea37449ff9a82e0001c5db32029ee66465cf28106","observation_id":"fb7edc0c-1e4b-4487-a10f-7654abb81dd7","resolution":{"observed_at":"2026-08-06T00:58:53.608486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:55.159953Z","title":"W.; Han, R.; Fei-Fei, L.; and Xie, S","venue":null,"work_id":"49604661-aaf7-459a-9f44-9dadb03b00ab","year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.741711Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:10eb725e3fdfafea76b6401a32da4da13706914d115fe6e3bcd44681aa4e038c","observation_id":"37b659b1-f7eb-49eb-b9af-f37e32972be8","resolution":{"observed_at":"2026-08-06T00:58:55.232884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:53.836109Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.836109Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:010168450f575d4443fd473f9164896a484b08cae0c6a9918114fb9688b7a29a","observation_id":"c62ed297-5e23-4703-a31a-01e8229df594","resolution":{"observed_at":"2026-08-06T00:58:53.836109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:53.962031Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:53.962031Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:ee47330f7c579bd99d03ccaaf47f2535acfa8ca368638d4aa864e3fd5243cccd","observation_id":"5517d13a-c926-4bcb-be02-4956badf45c5","resolution":{"observed_at":"2026-08-06T00:58:53.962031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:54.994971Z","title":null,"venue":null,"work_id":"b8603213-ebd1-4823-9d91-0c6b252fab3e","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:54.097267Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:b131f99ba89073e5fd66b85fad59c91bf51ec2eb7bd01bd07e8f1526b3fb7a10","observation_id":"145e8354-57f5-448d-b9bc-061b5f669d89","resolution":{"observed_at":"2026-08-06T00:58:55.075535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:54.826156Z","title":null,"venue":null,"work_id":"08530b48-21dd-4b81-9097-7ede1c9e7267","year":2020},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:54.179980Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:5b79284f8077436c5d3774256f7322fe534c7ddbe8ba0217f9de74ee587fe0b2","observation_id":"31ac5955-9604-4320-9954-f0d6eb9723ca","resolution":{"observed_at":"2026-08-06T00:58:54.882328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:58:54.558982Z","title":null,"venue":null,"work_id":"d19ac5c2-2ca0-4bc7-b5b4-132392ae7c36","year":2024},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:54.289131Z"},"links":{"citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:39e6d6579a44989a343a868d9301ce8971e0572a5d857b11953a8fbcabedeaa3","observation_id":"eff8e1a0-e455-416f-a729-85b1470fa740","resolution":{"observed_at":"2026-08-06T00:58:54.642926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T00:58:54.366215Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T00:58:54.366215Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2508.04059"},"observation_digest":"sha256:531d30f0ce9a0e31a81c461885fc129a294c3cccfad6b6a6e47608b075b4c004","observation_id":"444d6a33-67b4-43fe-a188-c77c954ad065","resolution":{"observed_at":"2026-08-06T00:58:54.366215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.04059","last_updated":"2025-08-06T03:39:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T04:55:20.533084Z","submitted_at":"2025-08-06T03:39:21Z","title":"Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 4 inbound Pith citation observations for arXiv:2508.04059."}