{"as_of":"2026-08-05T07:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ccca97c710cca0458a8457f667d39f6569c4c90eec840dcf2afff6850637764","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:41:57.825009Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:30:14.867025Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-11T07:35:57.340007Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"cited_work":{"arxiv_id":"2604.05930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05930","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","venue":"cs.CL","work_id":"aa1ba151-e809-4cd0-b263-c355678c73a1","year":2026},"citing_paper":{"arxiv_id":"2604.06819","last_updated":"2026-04-08T08:37:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T08:37:17Z","title":"Beyond End-to-End: Dynamic Chain Optimization for Private LLM Adaptation on the Edge","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-10T18:30:14.867025Z"},"links":{"cited_paper":"/paper/2604.05930","citing_paper":"/paper/2604.06819"},"observation_digest":"sha256:e9f740a0b638dae516b6058a7eae1c2dd662d79544afd931b2599de278106ddd","observation_id":"f3e606b1-a5d1-4f8a-a65c-642ea8d126b6","resolution":{"observed_at":"2026-05-11T00:30:51.421351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"cited_work":{"arxiv_id":"2604.05930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05930","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","venue":"cs.CL","work_id":"aa1ba151-e809-4cd0-b263-c355678c73a1","year":2026},"citing_paper":{"arxiv_id":"2604.10071","last_updated":"2026-04-11T07:19:17Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T07:19:17Z","title":"Spotlight and Shadow: Attention-Guided Dual-Anchor Introspective Decoding for MLLM Hallucination Mitigation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-10T17:07:09.330134Z"},"links":{"cited_paper":"/paper/2604.05930","citing_paper":"/paper/2604.10071"},"observation_digest":"sha256:ac8ae734940e9383ed860c2c2d4ae4f548167583ba5f93a2cd86087f618fae1f","observation_id":"e54e1105-4b94-4dc2-896a-ecaa94e1cca2","resolution":{"observed_at":"2026-05-11T07:35:57.349546Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.05930/citation-record","integrity":"/paper/2604.05930/integrity","json":"/paper/2604.05930/citation-record.json","paper":"/paper/2604.05930"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T11:09:45.979813Z","title":"Ziqiang Liu, Feiteng Fang, Xi Feng, Xeron Du, Chen- hao Zhang, Noah Wang, Qixuan Zhao, Liyang Fan, CHENGGUANG GAN, Hongquan Lin, and 1 others","venue":null,"work_id":"f3e92df8-7738-4525-89da-99d9e186917f","year":2026},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:7ea9abf2cc55cbf43ced9e1f10c16b1c9794f7557cdc8c9ea52345f013f7e777","observation_id":"bac5ddbe-cdc6-44f4-86b7-fdf49d238f6b","resolution":{"observed_at":"2026-05-10T22:35:51.472647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:ba478e2d0675706be11e4e781c30d0b082ebef20e54a17f0eaa724bf44c140e5","observation_id":"40383433-267a-49fa-84d7-565abf6a7676","resolution":{"observed_at":"2026-05-10T22:35:51.489171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"the boating store had its best sail ever","venue":null,"work_id":"4abe24d4-b576-4137-a78c-ecd7b3fdda9a","year":2025},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:b8655bcb9567ba960ac5ebb35d65d6359772fa44dd9818c2a27a41c94cd31397","observation_id":"94d4b57d-0391-4c64-8791-20e035ee6230","resolution":{"observed_at":"2026-05-16T04:17:17.450176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d1a3c14e-dc0a-46bf-b856-491aadb88387","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:072605db818b0122550c8f8e48dd72355d2f8d7d682ae1d05f2dd01736909880","observation_id":"8e252fc7-6585-4e79-ba47-3307645544c9","resolution":{"observed_at":"2026-05-16T04:17:17.453589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f9412020-1ba9-40b0-91f5-45419dc5df4d","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:ea3074f3fb5c5b3a0ba87064796d6000937cf74ad625b7a426385368b944df8e","observation_id":"17c947e2-13ef-42fc-aa54-218decf2899f","resolution":{"observed_at":"2026-05-16T04:17:17.465000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b7c253f7-4271-461c-8f96-4c747c6e7463","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:ae3e3f01ebaf87660009e67092c574e2a14b2ce0578f95186d56f94ec9f7a983","observation_id":"2e7b5061-0f1e-43a5-a1c7-cb6f699a6903","resolution":{"observed_at":"2026-05-16T04:17:17.443253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Two cartoon pears holding hands","venue":null,"work_id":"cdfbab0e-c9f0-4faf-86aa-b0e9b87a1607","year":2026},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:88760f4df5ede49250a1d2846ced1fcc885e4d9cd64d7255dfa09f586b93e80d","observation_id":"f1c7ff27-1bd9-4bcd-9133-d7a87dae4100","resolution":{"observed_at":"2026-05-16T04:17:17.457457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"14152b62-0cb7-481c-aa1a-fd15b2ab5d60","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:269937dec748a7951354a416f88bb86679deb2efd7da4813a88a5623b5442952","observation_id":"5e3b07c8-4080-4d84-83a4-93a6dc9af8af","resolution":{"observed_at":"2026-05-16T04:17:17.439045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c2104baf-ddb9-428d-844e-4e6a8180c861","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:d908437f750bc35b12403cfa31e66409f6331890f1c1b1f530bc54868bf240ae","observation_id":"30bc0086-ae73-4e46-803f-f7dea9412395","resolution":{"observed_at":"2026-05-16T04:17:17.446911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"90256c1a-e9cf-4358-9c69-376925648727","year":null},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:abd2f05738a5f99db00caba72676858cf90fc28673f798bcc6aaf7a78b423f8c","observation_id":"2fe1545d-88cb-4c1b-8d1b-2ee69d7787e4","resolution":{"observed_at":"2026-05-16T04:17:17.468373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"is_pun\": true/false} IMPORTANT: Output ONLY the JSON object, no additional text or explanation. Note: The biased-to-non-pun variant changes the task description to","venue":null,"work_id":"3501eccf-7d94-4066-86b2-ee62c2d9b4ae","year":2025},"citing_paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:41:57.825009Z"},"links":{"citing_paper":"/paper/2604.05930"},"observation_digest":"sha256:990982443492c6bb2f7b26c4af82766f469efc7b5d643bc3f3d02ae47a9a476f","observation_id":"a71f9207-9036-4f17-ac0e-4a88d81d16ff","resolution":{"observed_at":"2026-05-16T04:17:17.461679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.05930","last_updated":"2026-04-07T14:31:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-30T07:49:14.095968Z","submitted_at":"2026-04-07T14:31:32Z","title":"\"I See What You Did There\": Can Large Vision-Language Models Understand Multimodal Puns?"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 2 inbound Pith citation observations for arXiv:2604.05930."}