{"as_of":"2026-08-11T17:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0dd3b3cabd13178a8f8d259ae7a35633af9f6c8270c51ab755dc9cb460da3ea","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:30:22.216120Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T05:04:26.622943Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14279","snapshot_observed_at":"2026-08-07T14:30:22.216120Z","title":"Looking beyond text: Reducing language bias in large vision-language models via multimodal dual-attention and soft-image guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18657","last_updated":"2025-05-24T11:49:31Z","snapshot_observed_at":"2026-08-07T17:10:13.501355Z","submitted_at":"2025-05-24T11:49:31Z","title":"MLLMs are Deeply Affected by Modality Bias","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:30:22.216120Z"},"links":{"cited_paper":"/paper/2411.14279","citing_paper":"/paper/2505.18657"},"observation_digest":"sha256:8d637d35b98bb234c73b1e214bbd9232b5a3c3c1b0bfd45aa7ec665b36255ece","observation_id":"2793178a-cee2-4fa3-bc9a-0a090975cfb8","resolution":{"observed_at":"2026-08-07T14:30:22.216120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14279","snapshot_observed_at":"2026-08-07T05:19:02.843411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08399","last_updated":"2025-06-11T06:57:37Z","snapshot_observed_at":"2026-08-09T16:20:12.110401Z","submitted_at":"2025-06-10T03:13:50Z","title":"SafeCoT: Improving VLM Safety with Minimal Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:02.843411Z"},"links":{"cited_paper":"/paper/2411.14279","citing_paper":"/paper/2506.08399"},"observation_digest":"sha256:9f80de04f1487a4b6e9a007de371ad0fc5b1310a01e33be7e031af6e94ac29bd","observation_id":"d88b1bd4-184d-4ee8-94b1-adea27547ae8","resolution":{"observed_at":"2026-08-07T05:19:02.843411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","version":2},"cited_work":{"arxiv_id":"2411.14279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.14279","snapshot_observed_at":"2026-08-06T05:04:26.622943Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","venue":"cs.CV","work_id":"a933d713-af0a-4543-88e7-cb79a5ff309d","year":2024},"citing_paper":{"arxiv_id":"2508.02419","last_updated":"2025-08-04T13:40:59Z","snapshot_observed_at":"2026-08-09T20:40:56.512342Z","submitted_at":"2025-08-04T13:40:59Z","title":"Modality Bias in LVLMs: Analyzing and Mitigating Object Hallucination via Attention Lens","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T05:04:26.036476Z"},"links":{"cited_paper":"/paper/2411.14279","citing_paper":"/paper/2508.02419"},"observation_digest":"sha256:ac0c1869a97de8a4672b542bbeed23ef7ab0f27566ea97ed6d4db864efbee684","observation_id":"cbbcd892-2eb5-4d64-9f04-095b2b765964","resolution":{"observed_at":"2026-08-06T05:04:26.729175Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14279","snapshot_observed_at":"2026-08-04T08:14:37.532330Z","title":"Looking beyond text: Reducing language bias in large vision-language models via multi- modal dual-attention and soft-image guidance.arXiv preprint arXiv:2411.14279,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.22067","last_updated":"2026-05-29T17:43:25Z","snapshot_observed_at":"2026-08-06T06:21:50.480419Z","submitted_at":"2025-10-24T23:04:26Z","title":"Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T08:14:37.532330Z"},"links":{"cited_paper":"/paper/2411.14279","citing_paper":"/paper/2510.22067"},"observation_digest":"sha256:2b6cf7b2aede6780e4decbb023fa136c943a5a62a016be6068fbd5092d604544","observation_id":"25dd4e4e-ab37-4922-b807-c21f269f41e1","resolution":{"observed_at":"2026-08-04T08:14:37.532330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14279","snapshot_observed_at":"2026-08-02T23:33:15.935160Z","title":"Looking beyond text: Reducing lan- guage bias in large vision-language models via multi- modal dual-attention and soft-image guidance.ArXiv, abs/2411.14279,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13600","last_updated":"2026-05-28T03:40:51Z","snapshot_observed_at":"2026-08-09T21:49:21.792607Z","submitted_at":"2026-02-14T04:44:37Z","title":"SAVAA: Mitigating Hallucinations in LVLMs via Step-wise Adaptive Visual Attention Amplification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T23:33:15.935160Z"},"links":{"cited_paper":"/paper/2411.14279","citing_paper":"/paper/2602.13600"},"observation_digest":"sha256:e621b871a76986e3200d91c5b7c1c1e893e70b34278c5f62c96fbc1abe2bbef8","observation_id":"d7bc94e8-617e-42b2-a805-f1e1d61896c4","resolution":{"observed_at":"2026-08-02T23:33:15.935160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.14279/citation-record","integrity":"/paper/2411.14279/integrity","json":"/paper/2411.14279/citation-record.json","paper":"/paper/2411.14279"},"outbound":[],"paper":{"arxiv_id":"2411.14279","last_updated":"2026-05-28T06:50:29Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:33:30Z","title":"Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2411.14279."}