{"as_of":"2026-08-14T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:52bec63b6208efba6db04afaada7bb159d2c7bb0233bebc63ed558865d4ffc73","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:07:46.368829Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09772/citation-record","integrity":"/paper/2608.09772/integrity","json":"/paper/2608.09772/citation-record.json","paper":"/paper/2608.09772"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.589225Z","title":"Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024) , pages=","venue":null,"work_id":"e951835f-cf92-41bd-aba8-abf75d8b5ee9","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.032306Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:06514967160841e910bd6039e5b370fdd42a5e76192b5b003224da6d37c9a1db","observation_id":"fd9ffc26-d5e7-441d-81e6-b1005a057c21","resolution":{"observed_at":"2026-08-11T11:07:47.593578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.039687Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.039687Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a392890038b9b02d7b935bfcd3a8bb49b9fbd716dd8639c3957bebed384aac2f","observation_id":"69cd5c07-f9f0-4d4a-9a21-eab8a9df1ead","resolution":{"observed_at":"2026-08-11T11:07:46.039687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.044305Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.044305Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:99b530d0227d14b943499c9877149156fd3ed6d0e6f8532f7ff0e26e84149f4f","observation_id":"bcc78282-e2fe-4c67-b614-679414b0b7d9","resolution":{"observed_at":"2026-08-11T11:07:46.044305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.048856Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.048856Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:89ac4ce5bfd97f78172e6c9b46fcdec16c86feb3ef2ee6ad8349a2b9e73d74a4","observation_id":"f4f127be-139a-4389-ace3-7d73678b537d","resolution":{"observed_at":"2026-08-11T11:07:46.048856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.058886Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.058886Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cedb1ac1d6f10c24741334b75f11d25eece3848c65bc712d20974c1245216bd4","observation_id":"e80466ea-fe37-4adc-82fc-aac915fe42a7","resolution":{"observed_at":"2026-08-11T11:07:46.058886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.063049Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.063049Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b228d479b5c09201a964f31177ebd2ce038ff25d548b5599d78448782293f63c","observation_id":"026202ce-93c8-4d2d-b7d4-23bd5924e38c","resolution":{"observed_at":"2026-08-11T11:07:46.063049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.067432Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.067432Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2c8e427666937d2104301c95809f4f52a1ad2c8f50f2ee244460b6f816d43e50","observation_id":"d1ab51cd-28b6-4e5e-91c4-80348b4eed9d","resolution":{"observed_at":"2026-08-11T11:07:46.067432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.072199Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.072199Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4967f225c36f7e1bb6d75a34083ed0f17abf86878a735e7e37047a6fdc02893a","observation_id":"f950fb53-ca3b-4432-beb9-6a5e3d40ca8a","resolution":{"observed_at":"2026-08-11T11:07:46.072199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.523783Z","title":"Information Fusion , pages=","venue":null,"work_id":"0f0adf26-f496-4198-96a3-045e7fcb83c4","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.076496Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:49d03d7ddc4e17dc8a6b9cec9db3e7e8cb318bbd1b63897b558951ca4c413252","observation_id":"a5a5dfc5-b155-41fc-9ef4-74e6a2b14219","resolution":{"observed_at":"2026-08-11T11:07:47.528368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.510193Z","title":"cortex , volume=","venue":null,"work_id":"09f0831e-70eb-4f4f-ada4-0855f0cd3c54","year":2012},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.080559Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:709aeb410695abbfc5e1f1f276bccb38178d1179528325adeec0327cc94b0b98","observation_id":"4e1790ac-a7b0-4b98-a4c9-ea5dd4d65530","resolution":{"observed_at":"2026-08-11T11:07:47.514922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.084220Z","title":"arXiv preprint arXiv:2412.14613 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.084220Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5b8858e46145c241b0f91da439a4bfcca5f8c2f9e1132e3a5454cbd2138767de","observation_id":"4b8b3d9d-5358-49ac-a91e-69aeff8bc217","resolution":{"observed_at":"2026-08-11T11:07:46.084220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.496741Z","title":null,"venue":null,"work_id":"90893102-7619-4c5b-9206-75574738c34f","year":2000},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.088491Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ac767bd0925ce8eda68bc78caad10d7bc2a116304654eb70a79695df09a2b6bf","observation_id":"65e04de8-b446-4e60-aa86-c1e3b7c6542c","resolution":{"observed_at":"2026-08-11T11:07:47.500699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.483514Z","title":null,"venue":null,"work_id":"e5b2a7fc-1b1b-4be8-a8f7-8d59566dbf50","year":1988},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.092465Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b95270600a205afe9c737f1b175eca9146cf4d2edd8435f1503124e9ed748907","observation_id":"dbe20a0e-f8ae-470b-9499-40482615c89e","resolution":{"observed_at":"2026-08-11T11:07:47.488834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.469351Z","title":"Proceedings of the 34th ACM International Conference on Information and Knowledge Management , pages=","venue":null,"work_id":"9fda6bdd-d599-4d2f-af9d-187760333ee8","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.096803Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a97314a6a400a28054c226b627f34420aff5331ff346f8f168abbbceade6b63e","observation_id":"02d29153-27b8-4114-b574-f93b5b9611c6","resolution":{"observed_at":"2026-08-11T11:07:47.473880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.456189Z","title":"Sarcasm and the Space Structuring Model , year =","venue":null,"work_id":"f110bb46-c0b9-449a-a07c-230b593830aa","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.101260Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:8a6b39902a2303a79c28a834e0ecaf8cd7012b1519b93be07215127d05139ac8","observation_id":"6a74f7a8-ce48-4844-8a0f-d5091a0f52ad","resolution":{"observed_at":"2026-08-11T11:07:47.460640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.105190Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.105190Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:1af210bc7cca30d31084ef8cc283c069d4e8131ca8f4d7a5ec46ce1050f9d9bf","observation_id":"35fd021a-11d8-47c3-b95d-2b077bfcfc82","resolution":{"observed_at":"2026-08-11T11:07:46.105190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.434614Z","title":"Proceedings of the 24th ACM international conference on Multimedia , pages=","venue":null,"work_id":"e39ec880-d2e3-4d9d-a549-eab25573944f","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.109757Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:62837acd99d4e44b93a7f56a651c941a58740e19055deed2d0920b857630a99d","observation_id":"20a65396-6af1-4f26-ae39-df05b9053704","resolution":{"observed_at":"2026-08-11T11:07:47.439266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.418419Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":"20d5e65f-3c1c-4d2a-a222-6b88e512fbb6","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.114878Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:c419a2b1d2274bf7c163f898afd00016e3538a33b21d8e26b588cdf8536eab3e","observation_id":"cc9b9912-6434-4394-9428-135de3bc6e33","resolution":{"observed_at":"2026-08-11T11:07:47.424932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.402539Z","title":"0: Towards a reliable multi-modal sarcasm detection system , author=","venue":null,"work_id":"81baae21-d68c-4c06-84e5-315881bffc6a","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.118795Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:7b9d739a1818762e48c191eb1b68db113a8b3195494477103d7d1aa290228f78","observation_id":"ae28317d-9144-4560-9039-e93b11ab90e8","resolution":{"observed_at":"2026-08-11T11:07:47.407283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.388390Z","title":"Proceedings of the 60th annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":"48cf22b7-4bc6-446e-a839-5146fc7c10f7","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.122598Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:3fd3b654cdf8c445dc6c2e59598845f4e3fbc208cc3f02bddfeaad5e32be6446","observation_id":"acde4124-ef72-45d0-9552-1ad3a87651b9","resolution":{"observed_at":"2026-08-11T11:07:47.393824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.360127Z","title":"Proceedings of the 29th ACM international conference on multimedia , pages=","venue":null,"work_id":"88749a59-2582-444a-95a0-b2edf40a691a","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.126600Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4b2cad7501a6d3fe77ef6815535cc3d05797c250126c7f0ad0fe9c8e8aeee132","observation_id":"cd8fb1b4-c5bb-490a-b074-52544cccc794","resolution":{"observed_at":"2026-08-11T11:07:47.365266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.343508Z","title":"2020 International Joint Conference on Neural Networks (IJCNN) , pages=","venue":null,"work_id":"7a09c146-9868-4715-84b7-9761f76cd821","year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.131070Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d35c574a669e728100cd9326b99a813117dc070681cc5c33f434f03482423e3b","observation_id":"d2a18dc6-4c33-48e4-b392-d894217fcb54","resolution":{"observed_at":"2026-08-11T11:07:47.349277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.330646Z","title":"Proceedings of the 20th international conference on multimodal interaction: adjunct , pages=","venue":null,"work_id":"f7080d84-5a88-4f06-bae4-814e38871776","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.134893Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:93128c3f4d68f5b3a3519e44b4658f2204f0b6d30a993237ecc08833b1a4224c","observation_id":"6ff40522-c0e0-4b23-adcc-f8b9640552df","resolution":{"observed_at":"2026-08-11T11:07:47.334750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.317613Z","title":"how long did you marinate in it? multimodal sarcasm explanation , author=","venue":null,"work_id":"83e79f7e-ca4b-4605-b96f-a2d066bd1959","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.139108Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:340430832a4aa00131c41fd7a3f868ecf92764bb9200759ee7b4054bb8b60b3d","observation_id":"48382de6-fd49-4fd1-8655-4d9a59267e8e","resolution":{"observed_at":"2026-08-11T11:07:47.321719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.305266Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2020 , pages=","venue":null,"work_id":"54d41927-dfc3-44a5-841c-f9e3e63d3603","year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.143438Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:98f03cc9d3e6fc50cb26925f11e221bf74a12d8f8c6db01998c04c276265a44f","observation_id":"c5e3d745-90b9-4d2e-b583-aba5e2c4d473","resolution":{"observed_at":"2026-08-11T11:07:47.309245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.292855Z","title":"Proceedings of the 32nd ACM International Conference on Multimedia , pages=","venue":null,"work_id":"f0cdfa8b-cfad-43ed-a2e1-0680846ede3a","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.148195Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b2b3155a8163f4cdb723d0a923053db9a4d00ac27b52ae9f627b6f57c790e722","observation_id":"ae2b44d3-35c0-4e85-8bba-3cc95b322a46","resolution":{"observed_at":"2026-08-11T11:07:47.297212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.152862Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.152862Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:411c3b823f43374b80116a1b740ecbbd2940dcd10b46bbf34db7a93c0cc1f610","observation_id":"fe548c10-d61c-4a73-a224-e7b1117ec38d","resolution":{"observed_at":"2026-08-11T11:07:46.152862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.274327Z","title":null,"venue":null,"work_id":"85fd2dd6-bb77-49a4-bf54-a0ef0ae2ee47","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.156913Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2a2e8be03723ddc60f206cd652d313f1f1562ec7c38d72bdc3d027348af03787","observation_id":"ae7fc9e3-8da6-4b98-98b8-b02a451542a3","resolution":{"observed_at":"2026-08-11T11:07:47.278309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.262571Z","title":"IEEE Transactions on Affective Computing , volume=","venue":null,"work_id":"b6d1d362-90dd-41bb-95b7-850213aee9c2","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.160891Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:c7ca34eb0614c01037eae507e6314dbfca307619457955bb0be55a8e9e235439","observation_id":"6405a6ba-104d-4132-816b-a3ce3ad62888","resolution":{"observed_at":"2026-08-11T11:07:47.266399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18882","last_updated":"2024-10-24T16:17:47Z","snapshot_observed_at":"2026-08-12T22:15:45.753938Z","submitted_at":"2024-10-24T16:17:47Z","title":"A Survey of Multimodal Sarcasm Detection","version":1},"cited_work":{"arxiv_id":"2410.18882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18882","snapshot_observed_at":"2026-08-11T11:07:46.678918Z","title":"A Survey of Multimodal Sarcasm Detection","venue":"cs.CL","work_id":"d15b5844-2c93-46a8-ac4f-45cc8017432a","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.164943Z"},"links":{"cited_paper":"/paper/2410.18882","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:7e4aa55efe2abaa88dc092ba1735e30c64ac9acf580278b388cbf85f5ec7b02a","observation_id":"3976daf3-efd7-4986-8b48-672fad31e442","resolution":{"observed_at":"2026-08-11T11:07:46.684075Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:07:46.169676Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.169676Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9b2b3a5e9168dd8d9d192b75b2f9b66746d1a3ec53f685cefa3721ffa144bd18","observation_id":"43ca6f2c-d194-4d83-b5bc-be12d8b6490e","resolution":{"observed_at":"2026-08-11T11:07:46.169676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.175086Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.175086Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:85111edf6327ce5c9a8fae9f134a370eb18bc1883dd5e8d1f2b72d0b4114d3ba","observation_id":"d14a6ab2-390e-4af1-a5c5-df39deb4fd54","resolution":{"observed_at":"2026-08-11T11:07:46.175086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.179021Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.179021Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d7b3a3d1e8a2ea684cd05aedde6c735de6f75ff1569fe4819f954190af9a41bc","observation_id":"9ba339a2-8d03-4b54-8f33-4d5bf7fb98b5","resolution":{"observed_at":"2026-08-11T11:07:46.179021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.236505Z","title":"2025 IEEE International Conference on Data Mining Workshops (ICDMW) , pages=","venue":null,"work_id":"e9d08b02-1053-4485-a4d5-6b53ffa4a63d","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.182927Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:346ae3ecc54b9598516b4c3a2255cb5a58724a06ec5b662514e9034f6911e68a","observation_id":"9edf7d81-288b-4f69-93d1-1719c94877f2","resolution":{"observed_at":"2026-08-11T11:07:47.240535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.224609Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"070e317c-7d65-46ba-962f-b59b5979ba35","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.187896Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d70d920a7757fd723818bba859a2b552aafe53179d5da5541e6c0d7f43bbb67d","observation_id":"860abc87-3809-4a42-8744-a4763bf04c20","resolution":{"observed_at":"2026-08-11T11:07:47.228819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.211868Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"f5a0cf91-2e4f-4e9a-bf13-88c07f5a2e83","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.191912Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cda22f300afc2fa5fc80f47cd93685b826a54caecc688c4ebe89096b081e7c73","observation_id":"bde581d8-1377-4e2f-b166-5b0829d2e115","resolution":{"observed_at":"2026-08-11T11:07:47.216470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04550","last_updated":"2025-03-06T15:36:06Z","snapshot_observed_at":"2026-08-10T06:38:13.718003Z","submitted_at":"2025-03-06T15:36:06Z","title":"Benchmarking Reasoning Robustness in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04550","snapshot_observed_at":"2026-08-11T11:07:46.195820Z","title":"arXiv preprint arXiv:2503.04550 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.195820Z"},"links":{"cited_paper":"/paper/2503.04550","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cda3dcb635c8114f911ef49c7d494523d45c32527b97ed9a01b9a8ade5976862","observation_id":"0ed2473e-5552-4df2-9cc4-c70fe8f5b0cb","resolution":{"observed_at":"2026-08-11T11:07:46.195820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.198713Z","title":"Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies , pages=","venue":null,"work_id":"3c3d38e3-95f4-4462-b284-598cf3510482","year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.200053Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:7c2eb5d9cfe6a620ad35376e309fa681493d74fcfe38fe101cb9600b4cf049b4","observation_id":"8ba8bd99-30e2-4642-9009-6d3ea9a47d33","resolution":{"observed_at":"2026-08-11T11:07:47.203530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.185352Z","title":"ArXiv , year=","venue":null,"work_id":"4d5c0e78-e89f-4c57-aae5-ae79a0973066","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.204411Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9a403376abf6d00e5b257a9582b0ae2dc86f0948380ebe9f7d5b0bf4ff208a31","observation_id":"3dee4481-01d3-41f4-ac44-d9c4bf303668","resolution":{"observed_at":"2026-08-11T11:07:47.190131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.208413Z","title":"arXiv preprint arXiv:2509.22437 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.208413Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b5ca5d7a29247b3c50da65ef7263f41d236b2c1d798aeca9d7938a4bf5ae881e","observation_id":"5ff0004a-2b56-4974-a628-a3657e261d3c","resolution":{"observed_at":"2026-08-11T11:07:46.208413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.212116Z","title":"Nature Machine Intelligence , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.212116Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:0de9bc73b18b5b2d9b21d50a08da7413fe16bf2ddbb0332a324f45cc0dca6c9b","observation_id":"dd0b6508-f76e-4f69-9b89-af77713476b4","resolution":{"observed_at":"2026-08-11T11:07:46.212116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16228","last_updated":"2024-07-11T23:03:09Z","snapshot_observed_at":"2026-08-13T05:41:07.997609Z","submitted_at":"2023-10-24T22:54:05Z","title":"On the Foundations of Shortcut Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16228","snapshot_observed_at":"2026-08-11T11:07:46.215999Z","title":"arXiv preprint arXiv:2310.16228 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.215999Z"},"links":{"cited_paper":"/paper/2310.16228","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4be30f71645227cfc9068119f31682cec0df22bc120234135fe5932d129b81da","observation_id":"6c9e0cd2-324a-4add-9964-40f6c5c3826b","resolution":{"observed_at":"2026-08-11T11:07:46.215999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.166487Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"0d31dbc5-bdca-4e5e-9f0b-744ad5a4c9c1","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.219953Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2645e57336863881c85556be4005596d3b9967a09de332bab6e0586523983d98","observation_id":"e339540f-9e2b-4ff3-9c9a-27827940c6ee","resolution":{"observed_at":"2026-08-11T11:07:47.170579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15183","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.547544Z","title":"arXiv preprint arXiv:2602.15183 , year=","venue":null,"work_id":"838ca4c7-7b67-4c3e-9f5c-341fa4f03365","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.223824Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5c32c0ac16ebde79d5819a9cf0e7b1cd6423500be64a1525bafa9a2cc39b5d73","observation_id":"aca611cd-5c5d-47a5-8207-bc3cf04c036d","resolution":{"observed_at":"2026-08-11T11:07:46.555152Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.155440Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"7e6db259-3ef6-444d-bbbb-9c00e9cb0b41","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.227756Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d07fd808cef8b1948440100e73c212ef36bfa15de40ab5d751cd21cc67a083f1","observation_id":"82843fa4-7709-4e12-b843-12d78d4074b4","resolution":{"observed_at":"2026-08-11T11:07:47.159336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.144111Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":"46ecb7d7-e3f3-40aa-adef-75e15aeb8070","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.231439Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:981616c8608af5938c5a72c910e13963c51fe78c11522f8ea348dcbeb4c4aef5","observation_id":"f491c2f4-5610-4a2f-9c9a-001eec3245de","resolution":{"observed_at":"2026-08-11T11:07:47.147982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.133079Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":"bd14809b-0158-48a2-835a-b5b683b47905","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.235081Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4027aa0906395afb5e68c2be816dbff87065bfef05eaa1dc56e766620c7dba2c","observation_id":"d8512e61-7e14-4e4d-8293-e92415d9fecc","resolution":{"observed_at":"2026-08-11T11:07:47.136811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.121866Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"ca61b0b6-31b3-47cf-86ae-4f94ed35889e","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.238675Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f411c1758ead71472b500429899d5d4c05f63fa44820da0de67a1abf16a48440","observation_id":"fd4881ce-8bc7-4cba-8585-9a0812e373ef","resolution":{"observed_at":"2026-08-11T11:07:47.125911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01790","last_updated":"2025-07-02T15:15:14Z","snapshot_observed_at":"2026-08-14T10:41:27.675225Z","submitted_at":"2025-07-02T15:15:14Z","title":"How Do Vision-Language Models Process Conflicting Information Across Modalities?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01790","snapshot_observed_at":"2026-08-11T11:07:46.242486Z","title":"arXiv preprint arXiv:2507.01790 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.242486Z"},"links":{"cited_paper":"/paper/2507.01790","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f493333c775c29c886bb839bb14429f6d05cb23478bac95c152ff91e26d9b98d","observation_id":"c362de38-7834-40c6-885b-21f210e261b2","resolution":{"observed_at":"2026-08-11T11:07:46.242486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.110544Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"29ef6577-9e89-47cb-a8ee-e3058b627741","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.246791Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:e061b8b2f94704d5f5243248ecfaa9a15f08061d043bf40617468413e53047b9","observation_id":"b9a5bef0-3a0b-44f9-bb69-faba6d5cb39c","resolution":{"observed_at":"2026-08-11T11:07:47.114484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T11:07:46.250530Z","title":"arXiv preprint arXiv:2409.12191 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.250530Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a5e2fb4b8bb3aa161fdece818315be6adef8f397932fba6e07484814ff4ea447","observation_id":"ec82bc81-157e-4792-997d-63170f7a2210","resolution":{"observed_at":"2026-08-11T11:07:46.250530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-11T11:07:46.254577Z","title":"arXiv preprint arXiv:2304.08485 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.254577Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:73528ac1c4974a53b1722fb84ffce4922e564081c3908314c110c11d39806a9b","observation_id":"92a20af4-7e89-4ffd-b179-c1ac632a38ff","resolution":{"observed_at":"2026-08-11T11:07:46.254577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-14T01:46:07.796460Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-11T11:07:46.258643Z","title":"arXiv preprint arXiv:2507.18043 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.258643Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ea498ab8ec67007cabfdc41289be09d2aab78077457d84003f89e2c509691470","observation_id":"2f169d23-f4fd-431d-9bcb-1a53b5901c10","resolution":{"observed_at":"2026-08-11T11:07:46.258643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.098456Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2022 , pages=","venue":null,"work_id":"74851127-4daa-4ac8-80ee-83a948a39768","year":2022},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.262574Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ffa51a64da7e79107b48153895b516e70b53753ad49c00946ce52935256314ea","observation_id":"68cb8b13-b5d7-4781-af36-2f1c6ded3a33","resolution":{"observed_at":"2026-08-11T11:07:47.102587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.085434Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"16a67259-dea9-4609-8604-7b83f9d92018","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.266490Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cbf3e5355b23ea689af1c40e01626d9ba9d32f589b6eb3c20d7c8cb2cb7fdae0","observation_id":"eb126cd7-367d-47b7-94c2-2a9b6911f380","resolution":{"observed_at":"2026-08-11T11:07:47.090527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02486","last_updated":"2026-08-04T17:24:30Z","snapshot_observed_at":"2026-08-11T10:39:22.741285Z","submitted_at":"2026-04-02T19:40:56Z","title":"VLMs Need Words: Vision Language Models Ignore Visual Detail In Favor of Semantic Anchors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02486","snapshot_observed_at":"2026-08-11T11:07:46.270807Z","title":"arXiv preprint arXiv:2604.02486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.270807Z"},"links":{"cited_paper":"/paper/2604.02486","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9d0802a1199c7a875092c73ded233775f26a758ac7c638629896874d8349dc19","observation_id":"0ddb081c-1c30-4fe3-b60e-a1bb023f2054","resolution":{"observed_at":"2026-08-11T11:07:46.270807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-08-13T18:28:46.913210Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02189","snapshot_observed_at":"2026-08-11T11:07:46.275285Z","title":"arXiv preprint arXiv:2501.02189 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.275285Z"},"links":{"cited_paper":"/paper/2501.02189","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fe8d2eda46b2941070afbda6b989d2d5c915a4dfc8d3fea5072116e1945f0294","observation_id":"186c5fe3-d4cb-4934-ac02-2cb3bee9ec17","resolution":{"observed_at":"2026-08-11T11:07:46.275285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.073230Z","title":"IEEE MultiMedia , volume=","venue":null,"work_id":"b5d51418-79f2-4c4b-895b-8668ab4752e5","year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.279831Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:da8cd59aa5396ead08785032af89bfc03b0e5338d4d982762765db5cca126666","observation_id":"1f386500-d441-44ed-8bdd-7540dd29f47f","resolution":{"observed_at":"2026-08-11T11:07:47.077373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.059811Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":"327b1824-4f1d-4521-adf4-ff2d9388ae99","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.284563Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:07ac2d7c5577f337dd6df18442c356cbc6a8bee1d2e99325e27230bc00b13571","observation_id":"e951d434-a252-4419-bae2-fdbb55421b25","resolution":{"observed_at":"2026-08-11T11:07:47.064730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.047188Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2025 , pages=","venue":null,"work_id":"ffc260bc-377a-4de1-b395-0e684b046df3","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.288849Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cf1ff1e2860faeefe9245aa2b86827e86e3b1894637d7a972975a00d7e8164da","observation_id":"89c5e90c-73d5-4168-a2a4-b9d56919281c","resolution":{"observed_at":"2026-08-11T11:07:47.051511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.035492Z","title":"IEEE Transactions on Affective Computing , year=","venue":null,"work_id":"94006330-c218-4404-9bba-99f4c40c0a76","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.292869Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5d632d32873351004539380e0fc9d49197264f8ad7f8d2ca959a8472fefdbbb7","observation_id":"a1748827-9094-415a-96cc-acb85dc28118","resolution":{"observed_at":"2026-08-11T11:07:47.039517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.023162Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"b7fe3eff-810c-4f5a-99c3-f47504e8db97","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.297074Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:3e577dda18dca451713321c48ca55a9a62847f797c8939a6b61ee25fc7f489a7","observation_id":"448a305d-6b19-4e1d-a92f-4591176137ca","resolution":{"observed_at":"2026-08-11T11:07:47.027509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.007924Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":"457ac7ab-16f4-4ea8-953f-362e9629fb26","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.301035Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:04210b81422de717133302fcfdb9787f8edfb6889363a00b893bf841ee772fff","observation_id":"845161b3-a69d-49bf-bb58-dbe9e21f48a2","resolution":{"observed_at":"2026-08-11T11:07:47.012185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.994470Z","title":null,"venue":null,"work_id":"4faaa74c-9611-4b37-b969-31654ae4e249","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.304986Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ac561bceb3c97f7b98147c0a5609d30d9d8f4090a88c2195a87dcd05a0d375a4","observation_id":"80f7945e-6bc9-43cf-8fe3-41ee4cd323a0","resolution":{"observed_at":"2026-08-11T11:07:46.998562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.981475Z","title":"2025 , eprint=","venue":null,"work_id":"3c209d72-1f7c-46d5-897c-20ed2c29332d","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.308886Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:30caa6c9c1597db533d1761d707855f748243f0e55b9c0e6e06f3d2a8a3ebb2e","observation_id":"6c18eca8-10a5-46c2-8702-6ddc573228a7","resolution":{"observed_at":"2026-08-11T11:07:46.985832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.969218Z","title":null,"venue":null,"work_id":"76d80763-424c-4134-aecc-8e5f27bc86ef","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.313350Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:72b3c72498c24e2ad933ecae080d0678e8f504f52a01cae94bbb622be3d7cc93","observation_id":"7d9a1bac-b8bc-43aa-b105-b8f2bf9502c8","resolution":{"observed_at":"2026-08-11T11:07:46.973397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.957649Z","title":"IEEE Transactions on Affective Computing , year=","venue":null,"work_id":"99b1655e-006e-4736-8ccf-b94730959610","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.317181Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9bf52d52a32f2559f87360fca9d8af9c8283ea18a82caa77dfeaaa57dd35d521","observation_id":"46244535-da24-48a6-9c4a-bf8b0e7c7aa9","resolution":{"observed_at":"2026-08-11T11:07:46.961522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.945213Z","title":"2023 , eprint=","venue":null,"work_id":"607f5959-570b-46de-a1ce-53956471a2f2","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.320818Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a3bc23e1f801a77e4d1756748e1116886380af46f60bbe6ee8f009e48da299b5","observation_id":"f9e07637-caf0-4a18-b9d2-e016904c0f50","resolution":{"observed_at":"2026-08-11T11:07:46.949569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.931665Z","title":"2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"0178005c-7ac5-4670-a4e2-f04a78554459","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.324900Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fe9fe25909c0fe945e6b1afaf1c150bfa510741ca8281389fb61def6d50d454b","observation_id":"8bb573e3-397c-4c8c-8eee-343952a5cac4","resolution":{"observed_at":"2026-08-11T11:07:46.936271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.328539Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.328539Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:081f728f32d6a0008639543eaab049b93f872c847d0a3ccc5dda5ffb4a17104e","observation_id":"17e945b9-15dd-490a-af73-ffbdaabcee80","resolution":{"observed_at":"2026-08-11T11:07:46.328539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.911648Z","title":"Teaching Structured Vision & Language Concepts to Vision & Language Models , year=","venue":null,"work_id":"e6f28205-24bf-4205-89fa-3d0dbcbe9977","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.332206Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9708b3d0c81fd4248049662e48ef21b7552a9177ba2e897ac7bc280f88421a64","observation_id":"346c818e-e521-4950-abed-dab5c632ab46","resolution":{"observed_at":"2026-08-11T11:07:46.915767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.896881Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"1fc67a5b-5dec-426c-ae63-ddf882924834","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.336444Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:1b3a657b9d63e72cd0e5fe1147a3d09a1c2ece88708e7bd2029f8af0919fa7c5","observation_id":"8b6f13b8-503e-4b35-b529-879ac52f8d50","resolution":{"observed_at":"2026-08-11T11:07:46.901676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14669","last_updated":"2025-06-10T09:47:04Z","snapshot_observed_at":"2026-08-13T01:48:38.032809Z","submitted_at":"2024-10-18T17:58:21Z","title":"NaturalBench: Evaluating Vision-Language Models on Natural Adversarial Samples","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14669","snapshot_observed_at":"2026-08-11T11:07:46.340382Z","title":"Advances in Neural Information Processing Systems (NeurIPS) Track on Datasets and Benchmarks , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.340382Z"},"links":{"cited_paper":"/paper/2410.14669","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:481332f074a036c6d7d23975897770735d604b4660940651ada113bb202fd209","observation_id":"ca7a3ee2-281a-4af5-b88e-b183e411b609","resolution":{"observed_at":"2026-08-11T11:07:46.340382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.880355Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"41f9b5df-ddb0-4cba-9454-d9ddd932e22c","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.345374Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:30fa8499e751cf991a19a62dfaf96834cb5f53b616886ae95f6f25846958b7b9","observation_id":"42d9ae63-9a6b-4c05-9c80-f34bf86f4461","resolution":{"observed_at":"2026-08-11T11:07:46.885751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.868041Z","title":"2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"48e5102e-6f88-445f-954e-a197b3c3e39c","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.349264Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:7cab458bea17d99cd617d4844b81a89f61c41965147938464f511084664eeb7e","observation_id":"a6054183-6819-43f2-aea2-2a2219c93ab5","resolution":{"observed_at":"2026-08-11T11:07:46.872066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.352960Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.352960Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d9348381d8d1b155fef7b1308cc8ca36b7e67fbcc67c28ee8ede319f08cd15df","observation_id":"4c68a8bc-4c6a-4701-86fd-6ac6b6f6bc6c","resolution":{"observed_at":"2026-08-11T11:07:46.352960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.356611Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.356611Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:e01a25487423a7536153085c9989af3bd940ba319391a26b4adaa74137a14d3e","observation_id":"c466550c-41d0-4bf8-8402-6900a82e1624","resolution":{"observed_at":"2026-08-11T11:07:46.356611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.842204Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year=","venue":null,"work_id":"83d13965-1a71-4351-ab07-587ae1a41c3f","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.360587Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:05fd04f1316ab3156312a16a16ddbeac9c773fef69efc8202ab2cef9dff20c94","observation_id":"cf200170-10cf-46f1-aaad-febbf40a07a7","resolution":{"observed_at":"2026-08-11T11:07:46.846228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.365171Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.365171Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f87e01f37a35e4836d8fd410a8db547ea642435158172ebc66327c9acc633778","observation_id":"b6779d20-d32a-4d17-a919-654c1c47cb22","resolution":{"observed_at":"2026-08-11T11:07:46.365171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.368829Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.368829Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5cb3786710d0bbb067f715ccbd15ab69656a5315a3927227fa17f052c28d3e62","observation_id":"3a9202b9-5bc8-4daa-a619-6c754b2a6ee1","resolution":{"observed_at":"2026-08-11T11:07:46.368829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.09772."}