{"as_of":"2026-08-10T16:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15c893bc9f7605524833be0b58ad84ab4e7d8cea0b12195cb6d98e2125f45244","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:00:29.069067Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.04017/citation-record","integrity":"/paper/2508.04017/integrity","json":"/paper/2508.04017/citation-record.json","paper":"/paper/2508.04017"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:25.807566Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:25.807566Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:a8a9a3f81c9444c9816bc67b5fd9ac9acb2418ed4dfab58de027f1b04619fd5e","observation_id":"d0cb7c20-1858-46e9-9fb9-72c436f0f0c7","resolution":{"observed_at":"2026-08-06T01:00:25.807566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:25.865226Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:25.865226Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:2db9f18adfd17cbabc2079ed7136bc2923e7aa376373dba6af5938a853825d60","observation_id":"3948594a-e065-46ca-afd1-452ed53d0d02","resolution":{"observed_at":"2026-08-06T01:00:25.865226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:04.284747Z","title":null,"venue":null,"work_id":"87109b76-200c-41e5-8ee9-bf120bb4bbce","year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:25.946774Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:293455427f16aaddb594f6265dd857bf733f8466c5c7e8184928b587ea02b74f","observation_id":"bbcc5b9c-f44b-47a0-a22d-5a7dcfdfe9a5","resolution":{"observed_at":"2026-08-06T01:01:04.320608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T01:00:26.057218Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.057218Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:58cc3f56d5e93d2bc2df65474158d961a89a0f875585375d32b6a5a82b3a863d","observation_id":"5549909e-3697-4db1-a005-3a78583362b9","resolution":{"observed_at":"2026-08-06T01:00:26.057218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15268","last_updated":"2024-11-22T12:22:21Z","snapshot_observed_at":"2026-08-08T10:38:10.039848Z","submitted_at":"2024-11-22T12:22:21Z","title":"ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15268","snapshot_observed_at":"2026-08-06T01:00:26.157643Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.157643Z"},"links":{"cited_paper":"/paper/2411.15268","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:17fad9d8cf979af1eb7369d8e64d1784829a044d1b8ca72ab2f2aa1e6e7462fc","observation_id":"27d0bec9-0f49-4ce3-97e1-6ebb9e4e42ef","resolution":{"observed_at":"2026-08-06T01:00:26.157643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02199","last_updated":"2025-03-04T02:21:07Z","snapshot_observed_at":"2026-08-07T17:31:49.776715Z","submitted_at":"2025-03-04T02:21:07Z","title":"Words or Vision: Do Vision-Language Models Have Blind Faith in Text?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02199","snapshot_observed_at":"2026-08-06T01:00:26.259597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.259597Z"},"links":{"cited_paper":"/paper/2503.02199","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:5e9ca94a0834804bfe869ba270b3fc928e9970f338634b89b4007ab52ce93ff8","observation_id":"657d33d3-96b3-4675-bcd3-7d6e1fa4e4f6","resolution":{"observed_at":"2026-08-06T01:00:26.259597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:26.355964Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.355964Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:8d1f8b829491a7146c114fcbefc573ffab5791a5e1bf2699d1fedb88fb88f863","observation_id":"439fb4d0-d81e-41c7-8f00-69529d2c368f","resolution":{"observed_at":"2026-08-06T01:00:26.355964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06514","last_updated":"2025-04-11T02:36:28Z","snapshot_observed_at":"2026-08-10T09:50:19.291850Z","submitted_at":"2025-04-09T01:25:27Z","title":"Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06514","snapshot_observed_at":"2026-08-06T01:00:26.445995Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.445995Z"},"links":{"cited_paper":"/paper/2504.06514","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:55db1ea6450674a87faff9c9ca017fcdb74b1a233bd07cfa79ad1161db1ac67b","observation_id":"1a140720-96a2-46e9-be58-eb45b6f1c8d9","resolution":{"observed_at":"2026-08-06T01:00:26.445995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01091","last_updated":"2024-08-05T06:56:44Z","snapshot_observed_at":"2026-08-04T03:38:32.981944Z","submitted_at":"2024-08-02T08:11:11Z","title":"Dissecting Dissonance: Benchmarking Large Multimodal Models Against Self-Contradictory Instructions","version":2},"cited_work":{"arxiv_id":"2408.01091","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.01091","snapshot_observed_at":"2026-08-06T01:01:03.429180Z","title":"Dissecting Dissonance: Benchmarking Large Multimodal Models Against Self-Contradictory Instructions","venue":"cs.AI","work_id":"63d3944f-06bf-4413-895d-d0f161d4347a","year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.514574Z"},"links":{"cited_paper":"/paper/2408.01091","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:6633bc117ff634d9124dc4255936cdaeb5e47e0723df230272844fcbfd4f3983","observation_id":"a552404d-7de4-4e2d-a421-048912c88bd1","resolution":{"observed_at":"2026-08-06T01:01:03.445306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:04.170688Z","title":null,"venue":null,"work_id":"566f779c-a2b1-48c3-8d1d-5a1ac9722563","year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.594731Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:5fc5fa637d159f112bcedf504aa1100b91e7e8969cc8999abc91c0ac783501db","observation_id":"0c7e211b-0a81-4074-bb64-d949ca56f23d","resolution":{"observed_at":"2026-08-06T01:01:04.220737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19361","last_updated":"2025-03-30T14:48:59Z","snapshot_observed_at":"2026-08-07T17:45:25.804804Z","submitted_at":"2025-02-26T17:59:27Z","title":"Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19361","snapshot_observed_at":"2026-08-06T01:00:26.699637Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.699637Z"},"links":{"cited_paper":"/paper/2502.19361","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:a95c9abb5937f1156d5bb618ebd642d7d5ef7f8fff77486d294a797214fc52c6","observation_id":"d425b47c-4664-4ce2-bbf1-d8bdd1e889c2","resolution":{"observed_at":"2026-08-06T01:00:26.699637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:04.024666Z","title":"E.; Zhou, W.; Wang, G.; Yin, K.; Zhao, Z.; Yang, H.; Wu, F.; Zhang, S.; and Wu, F","venue":null,"work_id":"a5da6b63-6889-4f93-9567-397ac48bf395","year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.797424Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:a3b47401e6906cdf8dab2708bb41a46b7786ecf44c725f8f2ce7c00dc656f40a","observation_id":"be2e1064-075d-4e21-8c25-4910e79805b1","resolution":{"observed_at":"2026-08-06T01:01:04.126684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01790","last_updated":"2025-07-02T15:15:14Z","snapshot_observed_at":"2026-08-10T06:21:14.308985Z","submitted_at":"2025-07-02T15:15:14Z","title":"How Do Vision-Language Models Process Conflicting Information Across Modalities?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01790","snapshot_observed_at":"2026-08-06T01:00:26.919995Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:26.919995Z"},"links":{"cited_paper":"/paper/2507.01790","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:52d344bc630b6197a364d8f262f064aadafd05970175f8cbadb537a4ceed5255","observation_id":"f9767cf6-0900-4952-9bfb-3c0ca9bc9db0","resolution":{"observed_at":"2026-08-06T01:00:26.919995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T01:00:27.052675Z","title":"P.; Perelman, A.; Ramesh, A.; Clark, A.; Ostrow, A.; Welihinda, A.; Hayes, A.; Radford, A.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.052675Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:4656f43deabec98945c8b9fe172f91fffad4050f92506a90bfe059369c76675f","observation_id":"bd1e2e01-baae-4be9-9293-d47864400ad7","resolution":{"observed_at":"2026-08-06T01:00:27.052675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23715","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:03.239261Z","title":null,"venue":null,"work_id":"d947d2a0-18ad-4849-9cbb-055ded56145f","year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.208644Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:72030b696368aa7c4ce638d32be4000f2f7eb8321cdab4e001615d295cb200b3","observation_id":"6ce3c00f-0069-4a23-bc08-353760ab3f29","resolution":{"observed_at":"2026-08-06T01:01:03.300675Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:27.296483Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.296483Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:c883dd1094c6638b740193abe29426ac14b158f406c17d738d2e32488052a5f9","observation_id":"cdab12de-734a-4d24-aa40-0905b937edde","resolution":{"observed_at":"2026-08-06T01:00:27.296483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00755","last_updated":"2024-06-02T14:16:24Z","snapshot_observed_at":"2026-08-06T14:17:07.717687Z","submitted_at":"2024-06-02T14:16:24Z","title":"Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00755","snapshot_observed_at":"2026-08-06T01:00:27.359993Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.359993Z"},"links":{"cited_paper":"/paper/2406.00755","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:a7ec36fbb8e5e8ee771372138560e431a7ba48920a22f0c40866e95c40453763","observation_id":"19e1e387-97f8-456e-ae8d-d5cbfca4b2cf","resolution":{"observed_at":"2026-08-06T01:00:27.359993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19058","last_updated":"2026-08-05T12:36:09Z","snapshot_observed_at":"2026-08-08T23:12:35.435328Z","submitted_at":"2025-02-26T11:17:50Z","title":"MathDebugger: Detecting and Diagnosing Errors in Synthetic Mathematical Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19058","snapshot_observed_at":"2026-08-06T01:00:27.408499Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.408499Z"},"links":{"cited_paper":"/paper/2502.19058","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:b1b26086af9714c59956c3d93128be235e3fa52eff2e9fb23354f8970631196e","observation_id":"f61d17da-ce49-42c1-ae20-9d968445251c","resolution":{"observed_at":"2026-08-06T01:00:27.408499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14809","last_updated":"2024-06-01T07:46:28Z","snapshot_observed_at":"2026-08-09T15:29:40.218189Z","submitted_at":"2024-02-22T18:59:02Z","title":"CriticBench: Benchmarking LLMs for Critique-Correct Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14809","snapshot_observed_at":"2026-08-06T01:00:27.481589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.481589Z"},"links":{"cited_paper":"/paper/2402.14809","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:46bd961694900b71884aed49b932d3200ca53822a431b1fe344e28b4e0bfe1ba","observation_id":"daf54d4c-c5c4-4190-b04a-cbd843e76f0b","resolution":{"observed_at":"2026-08-06T01:00:27.481589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09818","last_updated":"2025-02-13T23:29:01Z","snapshot_observed_at":"2026-08-10T09:33:24.550360Z","submitted_at":"2025-02-13T23:29:01Z","title":"On the robustness of multimodal language model towards distractions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09818","snapshot_observed_at":"2026-08-06T01:00:27.572834Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.572834Z"},"links":{"cited_paper":"/paper/2502.09818","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:69abe123b5c3a44324dcfaf246b01fc83478b25d5a0205c72585ffc020b92196","observation_id":"1d1532fb-9e7f-4bea-bd60-4c445ac19072","resolution":{"observed_at":"2026-08-06T01:00:27.572834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-06T01:00:27.682515Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.682515Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:e892531b8f55c86507f9340b92c5d59023e5c02c80edb66c83265e58d3493f90","observation_id":"cffb212c-98ac-4faf-8036-f23bcfe707d5","resolution":{"observed_at":"2026-08-06T01:00:27.682515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04815","last_updated":"2023-10-07T14:12:15Z","snapshot_observed_at":"2026-08-09T21:04:10.104945Z","submitted_at":"2023-10-07T14:12:15Z","title":"Critique Ability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04815","snapshot_observed_at":"2026-08-06T01:00:27.774948Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.774948Z"},"links":{"cited_paper":"/paper/2310.04815","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:9a15be09b0c6bf4b187e3cd226461a0bc11b9c54065ad228a29b4d30207558b4","observation_id":"102204fa-41aa-49a3-8f5d-736e50321485","resolution":{"observed_at":"2026-08-06T01:00:27.774948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13321","last_updated":"2025-02-19T05:41:03Z","snapshot_observed_at":"2026-07-06T19:35:08.846184Z","submitted_at":"2024-10-17T08:24:27Z","title":"Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13321","snapshot_observed_at":"2026-08-06T01:00:27.854810Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.854810Z"},"links":{"cited_paper":"/paper/2410.13321","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:5f51eed170c20698977deae64505c14040ad1a4a788137ef649a3bc42263e452","observation_id":"5899463a-22ef-450b-855c-a2357d4e11d8","resolution":{"observed_at":"2026-08-06T01:00:27.854810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:27.899460Z","title":"H.; He, R.; Liang, H.; Qiang, M.; Meng, Z.; Zhao, Z.; Zeng, B.; Zhu, Z.; Cui, B.; and Zhang, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.899460Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:4a1be544fa99fea7c88a31f419e3e3cc2cd671ce584e51a9e02af13e891f8f4d","observation_id":"0bee6340-2ae4-4d1c-8e92-079e729fb560","resolution":{"observed_at":"2026-08-06T01:00:27.899460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:27.947422Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:27.947422Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:0484879088ded5790221dc2797d2ae4d85212ca25382980a546080de8d18a3fd","observation_id":"2c9be180-2d11-4c51-bdac-e6b01eb24106","resolution":{"observed_at":"2026-08-06T01:00:27.947422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13865","last_updated":"2025-06-04T17:29:13Z","snapshot_observed_at":"2026-08-07T16:32:02.150493Z","submitted_at":"2025-03-27T17:58:31Z","title":"A Survey on (M)LLM-Based GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13865","snapshot_observed_at":"2026-08-06T01:00:28.063764Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.063764Z"},"links":{"cited_paper":"/paper/2504.13865","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:92d1cd82a6caddb72bf2f11e8d546adca2a9c395460a3dc54a92dc94a3ac0931","observation_id":"99483082-7200-4722-89b8-391c4f547a31","resolution":{"observed_at":"2026-08-06T01:00:28.063764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:03.836929Z","title":null,"venue":null,"work_id":"81ac920e-1438-4940-9bc0-0f6b6b3661fc","year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.185452Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:5726aa72bef9411bd79b1fcb5cbb633a79486b4154685df70d2f092c0b533aa5","observation_id":"fe701744-5687-426c-92a8-dd9eaa8897cf","resolution":{"observed_at":"2026-08-06T01:01:03.924245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14899","last_updated":"2024-09-22T14:46:30Z","snapshot_observed_at":"2026-08-07T19:07:32.773798Z","submitted_at":"2024-02-22T17:36:34Z","title":"Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14899","snapshot_observed_at":"2026-08-06T01:00:28.274253Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.274253Z"},"links":{"cited_paper":"/paper/2402.14899","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:e40eb00917fcd574af0ad1462de024ba4ed7e38efa2f3b4d6b0b1321b4808f53","observation_id":"bd7da610-e695-4d96-a1f6-8ac920fecc0c","resolution":{"observed_at":"2026-08-06T01:00:28.274253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16033","last_updated":"2025-06-10T18:32:17Z","snapshot_observed_at":"2026-08-07T17:57:10.604846Z","submitted_at":"2025-02-22T01:52:37Z","title":"Multimodal Inconsistency Reasoning (MMIR): A New Benchmark for Multimodal Reasoning Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16033","snapshot_observed_at":"2026-08-06T01:00:28.391005Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.391005Z"},"links":{"cited_paper":"/paper/2502.16033","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:4e8d85390cb783f61cdb49c2fd1cb613c21693065353436db5778e8112fdd4b1","observation_id":"e8c61fe0-5c7b-4e10-aae3-950e14610429","resolution":{"observed_at":"2026-08-06T01:00:28.391005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04509","last_updated":"2026-04-20T02:03:24Z","snapshot_observed_at":"2026-08-02T21:14:32.237997Z","submitted_at":"2024-10-06T14:59:09Z","title":"ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04509","snapshot_observed_at":"2026-08-06T01:00:28.516071Z","title":"S.; Hu, X.; and Wen, Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.516071Z"},"links":{"cited_paper":"/paper/2410.04509","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:0c162c5fe8032a8b4427e56dffe7bc7c9d2479bddaf04107486e6bf7807d7aef","observation_id":"6a1fae2a-88ec-4283-b890-89b596714d48","resolution":{"observed_at":"2026-08-06T01:00:28.516071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:00:28.600580Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.600580Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:b17a91703a7b14cd5fc64c41298a60cd8ec83030bce59b92cd00593cedbd67d2","observation_id":"5edb0161-7467-47e5-832a-d3f8aa30074f","resolution":{"observed_at":"2026-08-06T01:00:28.600580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07151","last_updated":"2025-07-09T11:18:38Z","snapshot_observed_at":"2026-08-08T04:15:55.066531Z","submitted_at":"2025-07-09T11:18:38Z","title":"Robust Multimodal Large Language Models Against Modality Conflict","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07151","snapshot_observed_at":"2026-08-06T01:00:28.684512Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.684512Z"},"links":{"cited_paper":"/paper/2507.07151","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:0d7bb2e1384cfe55948c40243e8d88da52bd26ce4e6a6327f8ca6a424049dc80","observation_id":"3268c7ed-89ce-4f77-801e-bbd66db5bb4c","resolution":{"observed_at":"2026-08-06T01:00:28.684512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:01:03.710596Z","title":null,"venue":null,"work_id":"131c1594-e9fd-4fd3-956b-05d1bc595ad9","year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.771346Z"},"links":{"citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:8a0d5065465be8c57b7162aad5984515690e0d88a560f40c262b5b71565dff02","observation_id":"ae4b2458-d7f6-4e5e-9a34-2ff588376b5f","resolution":{"observed_at":"2026-08-06T01:01:03.765073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18657","last_updated":"2025-05-24T11:49:31Z","snapshot_observed_at":"2026-08-07T17:10:13.501355Z","submitted_at":"2025-05-24T11:49:31Z","title":"MLLMs are Deeply Affected by Modality Bias","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18657","snapshot_observed_at":"2026-08-06T01:00:28.861351Z","title":"P.; Huang, X.; Jiang, Y.-G.; Sebe, N.; Tao, D.; Gool, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.861351Z"},"links":{"cited_paper":"/paper/2505.18657","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:b962baef681c53fb1e601f31c63b475b4b8e922709bb83bd1b598cbfbf517670","observation_id":"409490f8-ec1c-4261-8af4-a4482362a558","resolution":{"observed_at":"2026-08-06T01:00:28.861351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04780","last_updated":"2025-02-18T12:47:58Z","snapshot_observed_at":"2026-08-08T19:20:34.617360Z","submitted_at":"2024-10-07T06:45:22Z","title":"Mitigating Modality Prior-Induced Hallucinations in Multimodal Large Language Models via Deciphering Attention Causality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04780","snapshot_observed_at":"2026-08-06T01:00:28.956589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:28.956589Z"},"links":{"cited_paper":"/paper/2410.04780","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:b7c0ed20875226bed553ca3b897946cde9bed6ed8a02ff70eb6a9eb119e19de1","observation_id":"6f4ec23f-1288-4294-b199-8d0cecb1c5b1","resolution":{"observed_at":"2026-08-06T01:00:28.956589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T07:07:56.707005Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T01:00:29.069067Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T01:00:29.069067Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2508.04017"},"observation_digest":"sha256:bd590417a1aa8adfd272be023b5e7c9efc575eb5664d1f65abc85cc9f90c1597","observation_id":"a30a1054-236d-4d75-ade0-2dee4d88def0","resolution":{"observed_at":"2026-08-06T01:00:29.069067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.04017","last_updated":"2025-08-06T02:13:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T10:31:10.699877Z","submitted_at":"2025-08-06T02:13:46Z","title":"Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2508.04017."}