{"as_of":"2026-08-07T04:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0030c6788119a50f6c4d384cf358a93082f54df52e8be19761629ba9651a0776","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T05:18:36.820829Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.31719/citation-record","integrity":"/paper/2606.31719/integrity","json":"/paper/2606.31719/citation-record.json","paper":"/paper/2606.31719"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/002383099103400404","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Language and Speech","work_id":"25657742-6fa6-4d16-b674-2cc9717c044f","year":1991},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:3f03afd45364b7c672ae0f30590ffe7ffc8a9ce6440c5300099bb1cfb8c0a867","observation_id":"0ef00150-fe2e-4885-b6a1-80222fe07719","resolution":{"observed_at":"2026-07-01T05:25:24.888493Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.63317/59anbt78wyj7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grounded Misunderstandings in Asymmetric Dialogue: A Perspectivist Annotation Scheme for","venue":null,"work_id":"eed57a42-9eca-4306-aa44-485e139b81f3","year":2026},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:4c0abb815e3c86e10dd1943c90d16c14a929952037046a3c6a3e9d80f1c1471a","observation_id":"e831ca0c-221e-411b-a656-4ba92e6c806e","resolution":{"observed_at":"2026-07-01T05:25:24.865720Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:744c3f039d11cd37ea45f7b503e64364d1e8a9fde51778409d7bb2b352cdd883","observation_id":"73814646-d54c-4a69-828e-a65774b7a314","resolution":{"observed_at":"2026-07-01T10:35:42.770982Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0006.361316","doi":"10.1145/3600006.3613163","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention , booktitle =","venue":null,"work_id":"1b10f2a9-a178-4d23-97fb-8db2354c7e6c","year":2023},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:784c5f32e216e054cac91e0afb7914367a05a27865fd5852e300bb44fa34d6e0","observation_id":"939c890b-8b6d-4a43-90ae-4a28d421981d","resolution":{"observed_at":"2026-07-01T05:25:24.891546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v29i1.9602","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"34281328-717c-4789-a36e-f9fcd05b7e2e","year":2015},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:04266b09bef3f1d70de353fcfe3ec062ba5ce533067bceca7c9108f703734dfb","observation_id":"bbbdb101-06b8-441a-aa9e-a6a22701d472","resolution":{"observed_at":"2026-07-01T05:25:24.878488Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T22:12:57.001438Z","title":"Proceedings of the 34th International Conference on Machine Learning , pages=","venue":null,"work_id":"1f60ec78-529d-4076-a498-9e37ba2755a6","year":2017},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:0f095b79d53c8cab9252bbd85aff08b8262ec5c6e247548ab9039877ae74b873","observation_id":"3d9a1b58-657b-45b6-8c97-8a3569ed998f","resolution":{"observed_at":"2026-07-06T22:12:57.002804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2734.2025","doi":"10.1109/cvpr52734.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Freeman, Frédo Durand, Eli Shechtman, and Xun Huang","venue":null,"work_id":"d0e5199d-8907-47b1-905a-07ab8b623a4c","year":2025},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:d3c75bf31856a34ad49e5b9e0a5c5064d5ee6373804b433b590c69fa507bb83a","observation_id":"775eb98f-a49a-4e1a-b597-bff3a1bd66f2","resolution":{"observed_at":"2026-07-01T05:25:24.882942Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0010-0277(86)90010-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"1986 , journal =","venue":"Cognition","work_id":"cd6f98bd-a1af-4e5a-958b-9d0b6de9002a","year":1986},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:78ed3a0eb4b920cf32e4888fa79b34e80b6d7b63f3d70fc215e47550f55d7d88","observation_id":"90b1cfeb-ddd7-46ce-b5d0-b36442a7492d","resolution":{"observed_at":"2026-07-01T05:25:24.864474Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1207/s15516709cog1302_7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"1989 , journal =","venue":"Cognitive Science","work_id":"0f4c162d-b046-4f15-83ab-cf47a71d27bd","year":1989},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:f4af4ae9e8c333d1c2ff09cfc952dae2833d760e8a2cc88d4e3144572e5e8912","observation_id":"1b309450-1603-4bff-bdb1-ed60139baab7","resolution":{"observed_at":"2026-07-01T05:25:24.870352Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/10096-006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Herbert H","venue":"American Psychological Association eBooks","work_id":"2da82059-7c24-4521-ae68-f4c470e4ea42","year":1991},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:676f1657cb620782c118775587f80e81b98ef79ef3bdc8f7583825ba03e50718","observation_id":"3d56fc00-edaa-4466-bba4-a79a04a66f84","resolution":{"observed_at":"2026-07-01T05:25:24.895535Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T20:49:32.105966+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T20:49:32.105966+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0140525x04000056","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Garrod, Simon , year =","venue":"Behavioral and Brain Sciences","work_id":"60279c21-b0f1-43af-a091-9479e5a32268","year":2004},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:ad77f884af82a9e7dd59ec2e63a8b6ac7809d72c4ed9f557d4bd387dcbf40cd8","observation_id":"8f2c6875-21f9-4aca-afa0-a283cb7560b4","resolution":{"observed_at":"2026-07-01T05:25:24.866710Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:58:17.293218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:58:17.293218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1999.2667","doi":"10.1006/jmla.1999.2667","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2000 , journal =","venue":"Journal of Memory and Language","work_id":"9aa78ab1-b020-47f2-b467-c57591b6bca8","year":2000},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:bbd05da4a710b2ad746e42e87d42dd34c8c67c8f51e0f318548cf6418c37ce1b","observation_id":"c80be74b-b2e3-4830-8e37-676a1e590c0d","resolution":{"observed_at":"2026-07-01T05:25:24.886201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T22:12:57.003090Z","title":"re-use , author=","venue":null,"work_id":"c3e30005-3eb9-4b7b-9d1f-15a1793a7171","year":2011},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:e024da2523778baddea7f28e3d071b6479e4f7b6ecc4364c5ef5c28ea22e515a","observation_id":"21c6798a-140c-4b5a-9e62-e728899e5a41","resolution":{"observed_at":"2026-07-06T22:12:57.004457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T22:12:57.004883Z","title":"The Impact of Visual Context on the Content of Referring Expressions , booktitle =","venue":null,"work_id":"babd7f7b-c158-428b-b66e-80936a334ae7","year":2011},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:f49d6a4bb448ece902890ad66770d2c90dafed1101558825a0009bfd7586a89e","observation_id":"03c36636-2a25-42a1-aa6b-bd8b4253c211","resolution":{"observed_at":"2026-07-06T22:12:57.006344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33017120","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"c94f8b8c-2f8e-448c-816b-8cd9275542c6","year":2019},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:ba6b3f64532775efe8e77caef8d0094376d23f280a10b0b5e9ee798c25e97755","observation_id":"e7595665-fcae-41e0-8683-49114741748e","resolution":{"observed_at":"2026-07-01T05:25:24.875488Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0010-0285(89)90008-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"1989 , journal =","venue":"Cognitive Psychology","work_id":"4d4b2e5c-4062-4778-a94c-6488c25cd070","year":1989},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:27f377e5ccfaf60fd3c3f2a18177a11a9a9ab9769136cc30f0e42ace6b07dd46","observation_id":"11b64969-5e80-4aa4-8749-12579527a35f","resolution":{"observed_at":"2026-07-01T05:25:24.872833Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1184","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"d5ecdff1-964f-4ac3-878b-955f984d8d2a","year":2019},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:efabef7778b1454c31fa0b2b0860ae253311bd9b65c2395f4e6ee75d6299c4a9","observation_id":"f1257cf5-0581-4c89-a865-3edb966a3e8c","resolution":{"observed_at":"2026-07-01T05:25:24.854794Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-demos.6","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T09:06:59.046980Z","title":"Transformers: State-of-the-Art Natural Language Processing","venue":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing: System Demonstrations","work_id":"801601a0-1077-41ef-a947-ba81c0b7510f","year":2020},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:aa63361d1c4ed159d4bea100c801cf8afcd469b770db9e2004fecd318b4b788d","observation_id":"cc35a8e4-ebac-4a71-82ca-017e8a322d43","resolution":{"observed_at":"2026-07-01T05:25:24.860585Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:48.412582+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:48.412582+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.sigdial-1.13","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"It Couldn ' t Help but Overhear: On the Limits of Modelling Meta-Communicative Grounding Acts with Supervised Learning","venue":null,"work_id":"2e6cb9c2-7080-4e66-afa1-8ade8e3dbd60","year":2024},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:17cfe9dca7264a06a662df4e4088eb2c6d670bbbfd2e0a3393f612f532b22e43","observation_id":"7af33dee-97bc-4255-afff-0dd0d6bac881","resolution":{"observed_at":"2026-07-01T05:25:24.842102Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.849","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LVLM s are Bad at Overhearing Human Referential Communication","venue":null,"work_id":"d65dd2b1-0443-4f14-952b-55a2a1bdd65e","year":2025},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:23396615d06d224c3eb148974120090e60f54168309712eff59d812181922f83","observation_id":"c128db7f-a4e1-496d-a2d7-cc89bc3cb2d0","resolution":{"observed_at":"2026-07-01T05:25:24.851514Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19792","last_updated":"2026-06-17T16:13:02Z","snapshot_observed_at":"2026-08-06T13:39:47.664756Z","submitted_at":"2026-01-27T16:52:20Z","title":"LVLMs and Humans Ground Differently in Referential Communication","version":5},"cited_work":{"arxiv_id":"2601.19792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.19792","snapshot_observed_at":"2026-07-01T10:35:42.752578Z","title":"LVLMs and Humans Ground Differently in Referential Communication","venue":"cs.CL","work_id":"50c8be87-957d-48be-a892-900212fe5ed3","year":2026},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"cited_paper":"/paper/2601.19792","citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:3d94b89b36450fec2d3f778469c12de07dd80a8da1dcbae7830319c75b88bbc0","observation_id":"34fecb1b-924e-4f8a-98df-06a0065d1442","resolution":{"observed_at":"2026-07-01T10:35:42.753659Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1016","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":"30056bcf-3ba6-4a4e-8a8b-f243336efb06","year":2025},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:ec74aef395e2935cd835edabc5da355c5a5a8b7afd411a2a766fa5c14ac03b66","observation_id":"f7c930cb-c4d4-45c6-a9f8-8b2dac25bbb4","resolution":{"observed_at":"2026-07-01T05:25:24.893763Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.sigdial-1.16","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"` W hat are you referring to?' E valuating the Ability of Multi-Modal Dialogue Models to Process Clarificational Exchanges","venue":null,"work_id":"028642e5-603d-4481-b5e6-b0f77adb25bf","year":2023},"citing_paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:36.820829Z"},"links":{"citing_paper":"/paper/2606.31719"},"observation_digest":"sha256:ffc600ae675c6299472eb92670bcb27940729b275f66bf5899e3f2725b5ed31a","observation_id":"06aef289-a8fc-46e1-9a4c-40124a8d1942","resolution":{"observed_at":"2026-07-01T05:25:24.863529Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.31719","last_updated":"2026-06-30T14:22:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T01:48:53.732340Z","submitted_at":"2026-06-30T14:22:48Z","title":"Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":3},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2606.31719."}