{"as_of":"2026-08-17T22:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c047a601fa8e97e6ffcf8634e7654569aea12e40ae2580a4d042bcfe8e26523","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:38:32.447759Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.09120/citation-record","integrity":"/paper/2502.09120/integrity","json":"/paper/2502.09120/citation-record.json","paper":"/paper/2502.09120"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.490510Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.490510Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:ca276c711c26c2e730134c3b8538650f5eecc1c755c5f1c3fb28aab27d00a1ac","observation_id":"3013663f-fb13-4d51-8015-874ce8478c23","resolution":{"observed_at":"2026-08-07T22:38:31.490510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.702919Z","title":null,"venue":null,"work_id":"6d48a2e1-bc51-485f-a695-19bba862a099","year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.501808Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:97d98259dff41577f6fbaf615b0dc53cea7d7e8a9b7e708782fe283e9a076f09","observation_id":"7c6465d0-d890-47b0-b476-1c93cae562ed","resolution":{"observed_at":"2026-08-07T22:38:33.737411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.512934Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.512934Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:60e5b0c3b8b606e4b16b27f6339a43c54a52bcf82685dbbbeef1d942c4c3f89f","observation_id":"9569f9b9-b34c-4d26-8ab4-0a9ce5f08965","resolution":{"observed_at":"2026-08-07T22:38:31.512934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.543391Z","title":null,"venue":null,"work_id":"166ad8fc-981e-49fd-9657-c85626f4ea17","year":2008},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.517592Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:ceaf1035be609ef648813bbb3442965aef25ec9f2263b85e65de303f4d596b6e","observation_id":"9adfdafe-3894-4128-a3a7-e55925429a28","resolution":{"observed_at":"2026-08-07T22:38:33.644992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.477735Z","title":null,"venue":null,"work_id":"7de02cac-5143-48ef-965c-e6d6e235e8ef","year":2008},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.522144Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:8da00c49a40645a60b685e82d0778ccce66da98b3bab62eeb9358fe3ef14b456","observation_id":"5497a746-4c0e-4963-9605-a0b179d161b5","resolution":{"observed_at":"2026-08-07T22:38:33.481085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.466914Z","title":null,"venue":null,"work_id":"8c4e0a7c-8144-4021-aedd-435310542d8a","year":2015},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.526710Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:d617809b7dc9c111deda0626efdd43801abcc4b4c96cc300e34d2820658068f0","observation_id":"f15c75a1-de57-4d06-8f4d-6b93bdbde1f6","resolution":{"observed_at":"2026-08-07T22:38:33.470889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.455626Z","title":null,"venue":null,"work_id":"c6fe834e-a47b-4877-92b2-601895245cd0","year":2008},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.530909Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:2416880472c63a128ffd6dae5416cebceb60ef5609aa50e637c0a5f67e090e05","observation_id":"fc7ce458-5941-4174-8546-6119ddd33be5","resolution":{"observed_at":"2026-08-07T22:38:33.459857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.446262Z","title":null,"venue":null,"work_id":"65a155ca-64c1-432d-8192-dec3fc85ff89","year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.534998Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:684dc0feae8dbffe252814777fff1cb0b5f10e84aca73837e22fff22c1d1c891","observation_id":"f8bb7d5c-c9b8-4c3a-8086-76d887e75840","resolution":{"observed_at":"2026-08-07T22:38:33.449332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.539127Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.539127Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:bd57de958d8c3012cc8a2fea1e1a4f2da1e0f50c321c2b2fc9cf7d3b4f7c85cd","observation_id":"b27ac852-12db-4858-b95b-6ca95ebe3bba","resolution":{"observed_at":"2026-08-07T22:38:31.539127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06794","last_updated":"2023-06-05T17:55:12Z","snapshot_observed_at":"2026-08-16T15:49:09.216982Z","submitted_at":"2022-09-14T17:24:07Z","title":"PaLI: A Jointly-Scaled Multilingual Language-Image Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06794","snapshot_observed_at":"2026-08-07T22:38:31.542624Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.542624Z"},"links":{"cited_paper":"/paper/2209.06794","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:78269334348935398b537ff03c897d1734a5cb725ac905333b7cda38a789aa6e","observation_id":"369fd888-1db0-4d34-8771-d0213486720e","resolution":{"observed_at":"2026-08-07T22:38:31.542624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.546653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.546653Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:ffa3861bc519878a45b9ce6bd835eef1c86bcc49323150929e4adad357b7fc18","observation_id":"223a0c36-7505-483f-96ec-8792edecc613","resolution":{"observed_at":"2026-08-07T22:38:31.546653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.423082Z","title":null,"venue":null,"work_id":"c2548727-b1c7-4911-8883-6ef19ce5fb5c","year":2015},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.550101Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:b7457448a800a10a07bda4c718bb6af7ce59cc2b10f762d9d3acfd29b6c02b52","observation_id":"9115e054-59a2-430d-8591-2dd887baa733","resolution":{"observed_at":"2026-08-07T22:38:33.426425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.553359Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.553359Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:d0f852d58866a523c30f761e034d7cb0b027ab564bfcd4a5e0a3f21d122f327c","observation_id":"1af8c2d0-f804-49b7-965a-6a161ff43c8f","resolution":{"observed_at":"2026-08-07T22:38:31.553359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.406720Z","title":null,"venue":null,"work_id":"a0893159-15c0-4583-808c-b2a486dd5bc5","year":2013},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.556458Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:ffd27426319413764867f1c1b748a2b9f5df81e5351102d45630e959a8da7f45","observation_id":"901dac4e-7cdd-4b7f-b79f-3d709bb90bbd","resolution":{"observed_at":"2026-08-07T22:38:33.409748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.396360Z","title":null,"venue":null,"work_id":"263e993a-9e6f-496b-b649-fbd0b48cbd03","year":2013},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.559408Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:0966916a1e80732e193247ac37f75bbc6268ee1d190102e5c8049df283d6585a","observation_id":"b73b5bec-77f4-49a7-afd9-390f197e19ef","resolution":{"observed_at":"2026-08-07T22:38:33.399815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.385623Z","title":null,"venue":null,"work_id":"28a18886-5c84-4410-909c-7fcf41984b57","year":2022},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.562807Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:d90e39abbcfab260db94502b6200ec2857296229a3abe3f50d563c7ec074d2bd","observation_id":"61e18334-24b5-44a3-afb7-2d057036e535","resolution":{"observed_at":"2026-08-07T22:38:33.389805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.285665Z","title":null,"venue":null,"work_id":"939c19f8-d36d-4d60-8562-40e0c595e5a8","year":2013},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.565890Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:a87257c6f18a6dd996d36f97d47a8b8ae080d4e081303f4b93d8a0e221b88ee1","observation_id":"1c79225e-3766-49db-aea8-1a3d4b19c3a9","resolution":{"observed_at":"2026-08-07T22:38:33.340223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.186002Z","title":null,"venue":null,"work_id":"96f7c69d-c55a-44de-83df-4fa01479aa12","year":2010},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.569250Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:3fc4f0707d177f7cebf2fc0888b3522f9192104a57ff427c35eab1ca3d5f0e37","observation_id":"6a0b10a9-18cf-47ce-ada5-1db5389de28c","resolution":{"observed_at":"2026-08-07T22:38:33.230208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.105015Z","title":null,"venue":null,"work_id":"2ead1a3d-c1a8-41fa-b2ec-8d997710a47a","year":2012},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.572185Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:e6586edc8723b544cace9271e2e907d92497591b1026a09d087b4468e5c580bc","observation_id":"835a8c62-e810-4723-984e-7cd6c0148186","resolution":{"observed_at":"2026-08-07T22:38:33.143923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.094529Z","title":null,"venue":null,"work_id":"7f18b435-cdc2-4238-8354-aa3aafcc1611","year":2010},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.575499Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:70bff08321f542d6c70d6850c0802e289053b7a820d23e51eb35bfbbf1f682c4","observation_id":"6fdecd61-77af-49ba-b5c2-52118dea57ab","resolution":{"observed_at":"2026-08-07T22:38:33.097590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.084149Z","title":null,"venue":null,"work_id":"d28223ed-5216-4142-8b7a-38c2a91bdc93","year":2007},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.578727Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:98540bbc683501a712935e39cdf9f39ac4f4e1e5fadf4b7e989c77d00d0d676d","observation_id":"ed425878-332d-40cb-b67c-0d0366ec97c2","resolution":{"observed_at":"2026-08-07T22:38:33.087220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.073579Z","title":null,"venue":null,"work_id":"4b87b368-1a40-42f6-8af9-14309755d404","year":1975},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.625736Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:0f8cb1cc833550e1cb98d28834c142272ede80660e8ade4af9fec9954498b387","observation_id":"e1101fe5-acbe-4739-8327-aff6320f86cb","resolution":{"observed_at":"2026-08-07T22:38:33.076950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:31.775831Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.775831Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:93c68eeaee3602b5de7945c3dac882e268a5f8906d30bdad42a13bdf9afac571","observation_id":"698a3420-2b2e-433b-b209-0690c5cd0d50","resolution":{"observed_at":"2026-08-07T22:38:31.775831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.054246Z","title":null,"venue":null,"work_id":"81fa09f8-6ce1-4f95-92d5-ca0f85020989","year":2023},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.901410Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:19a25b0e97d304199dbf2ffa5c9d3c017bd287c67fc06a5756fd7be2f4ac61b4","observation_id":"e74beec2-e146-4eca-87d1-3b086eac671a","resolution":{"observed_at":"2026-08-07T22:38:33.059543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.041624Z","title":null,"venue":null,"work_id":"49dbc22a-99fd-4752-849b-8acb9f331eee","year":2022},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:31.996905Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:02b98b77c23cac248157bde6148e41685500090673b131ec47434ca0592873fa","observation_id":"2398096a-bfa2-4609-bb27-dae4cfcd2cfa","resolution":{"observed_at":"2026-08-07T22:38:33.045516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:33.013707Z","title":null,"venue":null,"work_id":"4386002f-a5b2-4492-96f4-8926b172f545","year":2008},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.109433Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:151ae6f3a67a6634859cec5d78927f25a1fd645e3c072922d0aa654cc2193eb2","observation_id":"e91b51b9-1ab1-4260-8670-5953df6cf9fb","resolution":{"observed_at":"2026-08-07T22:38:33.024086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.997485Z","title":null,"venue":null,"work_id":"83d80883-bfb2-49f4-8e44-ff438c92b1a8","year":2011},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.232655Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:993358d4709757315a47c3ddac6cd48009070a4baf5ab00f95777a3464c9ba94","observation_id":"0b98e48d-bda4-44c7-bc41-ebd0922654b6","resolution":{"observed_at":"2026-08-07T22:38:33.006391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.985328Z","title":null,"venue":null,"work_id":"88feb901-6b1d-4e29-b1d9-f801e8de2688","year":2004},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.236224Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:6bce1f5d38a314045923f47b4f0fc10d57de1afbae06869ad53037e2d6f8e19d","observation_id":"598e3815-9ff9-49be-a4af-d61e44017b4c","resolution":{"observed_at":"2026-08-07T22:38:32.988897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09073","last_updated":"2019-11-07T14:06:58Z","snapshot_observed_at":"2026-08-14T16:44:08.554075Z","submitted_at":"2019-04-19T04:28:17Z","title":"Integrating Text and Image: Determining Multimodal Document Intent in Instagram Posts","version":3},"cited_work":{"arxiv_id":"1904.09073","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09073","snapshot_observed_at":"2026-08-07T22:38:32.606340Z","title":"Integrating Text and Image: Determining Multimodal Document Intent in Instagram Posts","venue":"cs.CV","work_id":"7d1af17a-886e-4b6e-848d-8fb225859a86","year":2019},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.239055Z"},"links":{"cited_paper":"/paper/1904.09073","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:f7fa69d3de25844d824a4b8cd6389b54f9f6f9c424f565e2c5058cce541ea77e","observation_id":"264b4bd6-2b7c-406c-87b4-519eb00fc5df","resolution":{"observed_at":"2026-08-07T22:38:32.610052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.243030Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.243030Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:1d4ab2570170d31d49f8de1d5a220b7fcba0bebe1dd3cbf3311fa7d7a61e16cc","observation_id":"c950178c-db27-403d-ab20-390cee9aec82","resolution":{"observed_at":"2026-08-07T22:38:32.243030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.246621Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.246621Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:c0945a91ea7ab01642bd5a610a7ae98f98824acd2f61983a850e116e6d55b2df","observation_id":"edf5f45e-5ebe-48ce-9298-c41dfc40f4f8","resolution":{"observed_at":"2026-08-07T22:38:32.246621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01020","last_updated":"2023-05-01T18:22:10Z","snapshot_observed_at":"2026-08-16T15:36:27.696536Z","submitted_at":"2023-05-01T18:22:10Z","title":"Evaluating statistical language models as pragmatic reasoners","version":1},"cited_work":{"arxiv_id":"2305.01020","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.01020","snapshot_observed_at":"2026-08-07T22:38:32.590967Z","title":"Evaluating statistical language models as pragmatic reasoners","venue":"cs.CL","work_id":"4c0cb2ee-b7f7-4a27-946e-b11e74b59832","year":2023},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.250191Z"},"links":{"cited_paper":"/paper/2305.01020","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:3377425433fb44580782e23de45476fa7167cda9a00fd535be27deb234bf6eae","observation_id":"3e91a2e3-b5fc-419b-b9a8-749abc82b485","resolution":{"observed_at":"2026-08-07T22:38:32.594850Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.962522Z","title":null,"venue":null,"work_id":"01718be1-8236-4a2a-aa78-617cf18e8d44","year":2019},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.253427Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:65086b152a52d40eea62f4a82f62cf17188805aa9a924471721d4e3e27a2fcc3","observation_id":"b4d45563-8a84-40bf-927f-88ed8b944c72","resolution":{"observed_at":"2026-08-07T22:38:32.965991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.951845Z","title":null,"venue":null,"work_id":"4d16c305-2743-417a-a27f-5b96078c7ecf","year":2007},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.256781Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:fe3575f28f9baefa3d84acb3e47ae7bc4008e775fbb58b8d027e582abd8969bc","observation_id":"cee352ad-7185-4351-9ec3-db652d2ef6d5","resolution":{"observed_at":"2026-08-07T22:38:32.955893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.874943Z","title":null,"venue":null,"work_id":"296f0dd5-c27b-4395-b7c0-ce6e1daa1b56","year":2014},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.260149Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:4c5a8b06d3a9cc90756c19beb2df91ad42069e371f5541fe4f997c27bd6a7c84","observation_id":"6b292f6b-384b-46a5-9e33-132c16cf2d8e","resolution":{"observed_at":"2026-08-07T22:38:32.909334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.793718Z","title":null,"venue":null,"work_id":"5be5c411-c608-4325-ad10-e6a121b745dc","year":2008},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.263261Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:03546449346eaf4fe3e8e4794fc4de1ae8695eb6ae94b6c214d6a4816ae956e7","observation_id":"a805df8c-5ad2-4bce-9737-0aeab3a3bc67","resolution":{"observed_at":"2026-08-07T22:38:32.827376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.722495Z","title":null,"venue":null,"work_id":"671f0aff-27f7-4a24-b44e-012003420cfe","year":2010},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.267073Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:777a0193a17e9b4ca333309b5d20d5539ad37e951645be37559fe9370281517e","observation_id":"0ab108ea-1af0-42c1-aee9-ceefc232bbca","resolution":{"observed_at":"2026-08-07T22:38:32.760340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.270535Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.270535Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:9e4db3253e9c827a61ea8d087e785aabe3f0df3ae5e1809823c294ec4ccf8b23","observation_id":"938cf3a4-92d0-453f-a91d-754ac65456af","resolution":{"observed_at":"2026-08-07T22:38:32.270535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.274276Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.274276Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:309fea84d82431e160603b83362a8a3265f9509685e0f31e021f774d6e61d52b","observation_id":"7ddd5de5-a2ab-4029-bf6e-770590a79444","resolution":{"observed_at":"2026-08-07T22:38:32.274276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.700447Z","title":null,"venue":null,"work_id":"a7895908-63af-4076-b065-c47c9b2cc331","year":2019},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.277722Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:22f73701810d30a60736f7e01fba71179338448fba799bae5dc9cbf03423189f","observation_id":"8f5da03e-bee2-408e-a7d0-e0d99c8ec310","resolution":{"observed_at":"2026-08-07T22:38:32.703810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.281111Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.281111Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:e82de16b912be0e27815e35d8671a1db9470034082d41750654aad869dfc71e2","observation_id":"0a410e1c-ec54-4970-9dbf-20cc508f796d","resolution":{"observed_at":"2026-08-07T22:38:32.281111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.284569Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.284569Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:78af3ea03d0f14330490f9680089dd39f3ec4bd3e8d42eae28eb8fb3ebebae2c","observation_id":"9de7a651-9116-4606-b39f-49e840edc094","resolution":{"observed_at":"2026-08-07T22:38:32.284569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.288462Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.288462Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:dc1dbd2d93628f7310d19307ebf2d125d72d02cf7397bed8835bc3732ff5ee63","observation_id":"60bd49b8-033d-49e1-9aea-4fd1238593f5","resolution":{"observed_at":"2026-08-07T22:38:32.288462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.292340Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.292340Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:5ed4fd70455dfcdedecddb03cb70e56e93f96fbb5bdb1c987d6ba5c9e7e68581","observation_id":"7d7a3a60-7450-472b-9cb2-0c4f2c3b628f","resolution":{"observed_at":"2026-08-07T22:38:32.292340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07075","last_updated":"2019-06-11T03:17:53Z","snapshot_observed_at":"2026-08-14T16:30:53.891584Z","submitted_at":"2019-05-17T01:16:15Z","title":"Deep Unified Multimodal Embeddings for Understanding both Content and Users in Social Media Networks","version":3},"cited_work":{"arxiv_id":"1905.07075","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.07075","snapshot_observed_at":"2026-08-07T22:38:32.575477Z","title":"Deep Unified Multimodal Embeddings for Understanding both Content and Users in Social Media Networks","venue":"cs.IR","work_id":"24cacbe8-dead-4944-a753-6832db75bf92","year":2019},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.295708Z"},"links":{"cited_paper":"/paper/1905.07075","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:f9a1f28f9fde8f8bb3429fb29ab3443bad7e5a5fffb99a2318bc5c60a7b56452","observation_id":"b2a34b12-57e5-46c7-bbe8-f83daf20d905","resolution":{"observed_at":"2026-08-07T22:38:32.580174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T22:38:32.299008Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.299008Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:99fe2bee4bbab02ac4397507e85d395112642b5ecfdd1dcb48d0ae7c9ff93a03","observation_id":"58a22a50-2f4b-4458-9e92-11be802f99d6","resolution":{"observed_at":"2026-08-07T22:38:32.299008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.666743Z","title":null,"venue":null,"work_id":"cdc2e978-0393-4505-b5ec-e448bdbd9bf6","year":2023},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.302735Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:dcd07db3ed3e657e71a8aaa10d0d425e0306d49f1fbbf413e51a89b8c17ddfc4","observation_id":"d62db07f-5da4-47e3-9479-5761db8b8816","resolution":{"observed_at":"2026-08-07T22:38:32.670089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05776","last_updated":"2024-05-09T13:54:15Z","snapshot_observed_at":"2026-08-16T13:54:02.401078Z","submitted_at":"2024-05-09T13:54:15Z","title":"Experimental Pragmatics with Machines: Testing LLM Predictions for the Inferences of Plain and Embedded Disjunctions","version":1},"cited_work":{"arxiv_id":"2405.05776","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.05776","snapshot_observed_at":"2026-08-07T22:38:32.520993Z","title":"Experimental Pragmatics with Machines: Testing LLM Predictions for the Inferences of Plain and Embedded Disjunctions","venue":"cs.CL","work_id":"02406863-882e-4101-87cb-13309b1d7177","year":2024},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.306243Z"},"links":{"cited_paper":"/paper/2405.05776","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:753b621ea70c4ba32f44bacf6a9e4c5760c72cd1572cd9235d2526df4eb756c3","observation_id":"39122f81-e0d5-4d0e-a714-c3212ed1dda7","resolution":{"observed_at":"2026-08-07T22:38:32.554150Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.310023Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.310023Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:86f043384d1032d3779a753026734e7fa27ae102a4f369821ea845384fe4bd98","observation_id":"46c31e93-d9b1-44bd-bc0d-a6e72a2177d8","resolution":{"observed_at":"2026-08-07T22:38:32.310023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.650102Z","title":null,"venue":null,"work_id":"51e2c923-b116-447a-b823-664fc248c981","year":2014},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.313139Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:6df7047156912bb98a863f2af1573ae80a74488fa3df1890970742f52013d4ab","observation_id":"2f8856b5-2fb4-4ee3-a302-f2510e7384ee","resolution":{"observed_at":"2026-08-07T22:38:32.653515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.639071Z","title":null,"venue":null,"work_id":"b0c0a0d0-7a07-4599-bd98-01019e500ba4","year":1995},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.316568Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:69c88d8492f51c9f71d758a8b21b93d6e29da80da4131c242cd0d09944dc61d7","observation_id":"1643af03-e4e6-4313-a0b7-de4eae830956","resolution":{"observed_at":"2026-08-07T22:38:32.643482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-07T22:38:32.343507Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.343507Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:85a62b2ba419b959d96155dbed95c1a7f0a15e412d85405c48af47447e1771d1","observation_id":"4f5965a2-5e93-4e95-b125-f83b64f8241b","resolution":{"observed_at":"2026-08-07T22:38:32.343507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.387792Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.387792Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:d4efb9f29094243a852fd75c7278e0b1d25a8aff4ebbd6e38637433612d9032e","observation_id":"d8c9a067-ff11-4956-969e-bdb66be724b2","resolution":{"observed_at":"2026-08-07T22:38:32.387792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:38:32.447759Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T22:38:32.447759Z"},"links":{"citing_paper":"/paper/2502.09120"},"observation_digest":"sha256:710cff17b4c9eb511a717591a3c38db417c473c4f5d297ef959e6c7e8d19be7d","observation_id":"e17dd37a-e787-48e6-a204-ae47896a3854","resolution":{"observed_at":"2026-08-07T22:38:32.447759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09120","last_updated":"2025-05-17T07:00:39Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T16:05:58.834751Z","submitted_at":"2025-02-13T09:55:48Z","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2502.09120."}