{"as_of":"2026-08-13T18:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f0fce1152f52100d34e9f9a09d9295bd9d710939e5381a4ec34b8f23d26cd3e","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:19:40.323661Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T21:38:08.608340Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27310","snapshot_observed_at":"2026-07-30T21:38:08.608340Z","title":"How and what to imagine? visual thinking in unified multimodal models for cross-view spatial reasoning.arXiv preprint arXiv:2605.27310, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26769","last_updated":"2026-07-29T11:10:34Z","snapshot_observed_at":"2026-08-03T03:36:32.779474Z","submitted_at":"2026-07-29T11:10:34Z","title":"See2Think: Do Multimodal Models Really Use Intermediate Visual States?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T21:38:08.608340Z"},"links":{"cited_paper":"/paper/2605.27310","citing_paper":"/paper/2607.26769"},"observation_digest":"sha256:4fc9da793cde34c10ef5420b9aa7bea2e8ba3f271f8de33cb4f0e98f74110777","observation_id":"0d11f08f-6272-47f8-8f0b-86454827cea6","resolution":{"observed_at":"2026-07-30T21:38:08.608340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.27310/citation-record","integrity":"/paper/2605.27310/integrity","json":"/paper/2605.27310/citation-record.json","paper":"/paper/2605.27310"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:16092037d275ae00b5f9d21d864435ab135a6ddf55764481928667f7dc5f1c4a","observation_id":"3dd08ca0-8425-41e0-a0e9-95a3899708ac","resolution":{"observed_at":"2026-06-29T18:23:50.688850Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:3eb675d4c66ef615644a9340a380a9652bf7fecd0924d37d6dcc378d138975fa","observation_id":"348a80d0-11ff-4c90-aff6-3db1a4d152f6","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:7b9ce9d9a6a04e6fc15b6bc19ce17d3ab1c0476d5464ddf4700a07766554d1a7","observation_id":"7f08ef09-1647-4115-9d24-6dbfe995fd19","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-08-12T12:44:22.350068Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":"2501.17811","doi":"10.48550/arxiv.2501.17811","metadata_source":"pith","pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","venue":"cs.AI","work_id":"67d9e391-26d1-459e-ab56-07e60511c886","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:b3ca33817cbb17744899e7efd38182b48ca45fdbcc689eee7c27dbf1e93818c4","observation_id":"242bab3d-42aa-49d0-849a-45fdb372b92d","resolution":{"observed_at":"2026-06-29T18:23:50.691296Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:42.195864Z","title":"Think with 3d: Geometric imagination grounded spatial reasoning from limited views.arXiv preprint arXiv:2510.18632, 2025a","venue":null,"work_id":"ae1cb37a-2b2d-43f8-a699-d412decf06d1","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:6cd8dfd585940f50de5c2a62434bf9097a3d39f83d17d951ad77d7ccc727a8e1","observation_id":"2eedf577-e12c-48af-ae79-3b8247e1e6a7","resolution":{"observed_at":"2026-06-29T18:23:50.667321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:50304a392db2ef939e9a1985cdf07329dcec8a8956fd812c6bce0f54efcff258","observation_id":"8c5b67d6-ac9e-4c79-b641-4a7fc60a7294","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-11T10:16:40.394612Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:dcfb7c97fa89051cbd36b09b5be68e5bd1af9a95fcfd7a258f6d29bc316e919e","observation_id":"0ae30ed4-f04d-4cfb-b719-a72c90bb89a3","resolution":{"observed_at":"2026-06-29T18:23:50.661816Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12500","last_updated":"2026-05-12T17:59:58Z","snapshot_observed_at":"2026-07-06T23:24:13.851504Z","submitted_at":"2026-05-12T17:59:58Z","title":"SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture","version":1},"cited_work":{"arxiv_id":"2605.12500","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12500","snapshot_observed_at":"2026-07-08T02:04:26.362870Z","title":"SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture","venue":"cs.CV","work_id":"3fc01381-3983-477d-a5cf-193da464f6e3","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2605.12500","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:6938abe27f1517339f91c237d707b05fa030c9d8dd88bf6b7b472ec33d4a63ba","observation_id":"78146988-1f12-4e74-b914-132dd2518d34","resolution":{"observed_at":"2026-06-29T18:23:50.686391Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:e0bc4a64ef172c5bd6bb1ca6a287e299707b05f79f4b8358e8c54907b6e753ef","observation_id":"a4b2b6e6-7c3f-442c-9d88-65bac298cf8c","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:b5ddb545f08ba996e6b46959f15d33b175119b5a59aefda55ee20fc390231354","observation_id":"69a50e7a-a27a-426b-8448-648e11a19133","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:9c9bc239551ee7247efb45784b28a14169f0d4a3cca35be5a3440851c0603c67","observation_id":"e45465a3-ecc2-437c-b3b8-39cfdc143f7d","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:7733afdb9c38559f8654488118d159549519c90f2dec43c609cbcc5424ca291f","observation_id":"fd83d925-ee9d-41af-9ded-f73f6b3a706b","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:cf36fe3860b261d16bb3f4acbf968884df4b0f858cf0de172488ae0036e9e50c","observation_id":"eabba675-f5fe-4290-97aa-aa6886716286","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:e31b145c0a3e62129464592854722a8feb9bd0d3f09d4d479925c708fa846d7d","observation_id":"a8737088-92dd-4d1e-bd3d-f4dc09fc2394","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:736ed8e126276465e74efd1594817255208aec784391812dc69a0ea4a23d0025","observation_id":"4bfbd459-9464-431b-9e35-5019b30701de","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:00268f1bc7e668059f93dac6e0a524f31d18d83f796d3ab3d46e42c387ea31d6","observation_id":"44fdedd9-251c-4262-a198-b6f0b9458c61","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:53c4574fd1ca4a8a77d515f39c46db16e16e59610098a6d137731b53e5647861","observation_id":"8ba89a69-4dea-4536-a222-9954741a6f6c","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24763","last_updated":"2026-05-18T04:20:18Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:59:56Z","title":"Tuna-2: Pixel Embeddings Beat Vision Encoders for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2604.24763","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24763","snapshot_observed_at":"2026-07-10T13:37:06.881254Z","title":"Tuna-2: Pixel Embeddings Beat Vision Encoders for Multimodal Understanding and Generation","venue":"cs.CV","work_id":"6d1815d2-46f1-4217-a874-f25ae24be85c","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2604.24763","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:83df36665d77a24d11be41d9ee9cda61ac121778faafa45d38ab29eae3cca287","observation_id":"aaae50c0-09d6-4294-91d0-c03f773b6f88","resolution":{"observed_at":"2026-06-29T18:23:50.680893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:37:06.868333Z","title":"Tuna: Taming unified visual representations for native unified multimodal models","venue":null,"work_id":"caa100a4-03f6-4ad6-8461-4d3a89233486","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:846aa85f9b8a9d26a13fd82addc9a6be01ad46c124476495d3f35921a6fc0e36","observation_id":"b19625ec-1ce9-4422-b2ba-bc1869d8ca6f","resolution":{"observed_at":"2026-06-29T18:23:50.672677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.23482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:50.673766Z","title":"On the faithfulness of visual thinking: Measurement and enhancement","venue":null,"work_id":"2a8eb32e-d7d4-4785-8b86-162a3124d495","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:cf2a66376444bebc5267f91abc7fa2d24a00ad375631d664c31adafae06895ea","observation_id":"de90a6bd-cdd4-46d2-9451-94e40f4ab370","resolution":{"observed_at":"2026-06-29T18:23:50.675174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:9c51ff9656a3326f69540e524eaed3eea595b54d156ed99e679d0a8d6c37214f","observation_id":"d4477653-4d6a-4fd8-9643-6576f37facb9","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27183","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:50.682157Z","title":null,"venue":null,"work_id":"d78eb5f3-5b54-4bf4-a316-06288a583902","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:9ccb13bf0c1f12bbcada058046f664c3888dddafbad251c7419eba9a88cb8483","observation_id":"d320b631-8431-490b-bb25-79c4b7d283dc","resolution":{"observed_at":"2026-06-29T18:23:50.683511Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:58f980b4d95cd6ea51bc2bb970f85f18500b767f10bb38eb00c8eddbf84fe132","observation_id":"8de9581b-c8bb-4c7b-a79a-4d47e2a7520e","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:107bfc6bf94c8b5b75c52d78fc25382ad6c0e286ce0e77f1c4ebd92f6f77231a","observation_id":"45797a99-c0b8-4573-8d41-c7e65b249fc0","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:d3b81343b4f0ca72e7cd09e62ff0ae149347b08db41dc4fa6161061d31a2acec","observation_id":"549e4634-a0c4-4941-8f20-a0b7a8a22075","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04686","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T04:29:35.794160Z","title":"Towards cross-view point correspondence in vision- language models","venue":null,"work_id":"8df34b64-6f0d-407d-8e8a-7c47fd806156","year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:cc60b8d3870315432acf7f46fb8e4c0c13422f8c15cd44ad57065c7f45155de0","observation_id":"fecc4a5a-f9d3-4d1d-a18d-3c133eaf00b4","resolution":{"observed_at":"2026-06-29T18:23:50.669993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:b40494c3781dc30b7d2b0b2f028a976487a49b433e8d39856e5052582ce34fd2","observation_id":"76ececa2-e4ed-44aa-be9f-33c49030e597","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:6da0d956daa87535420aa1f437422b4a9d0babde9ca66f29311a195b9bf1eac8","observation_id":"5ffac8d2-4516-4e8e-b5a6-9562c2514e9f","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:73f213cd52761ef8e58f01467da6f3f6bde40bec966ccb6d0d2585024413ace7","observation_id":"179039e1-a077-4cc9-860f-8e96cfea2ede","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:82c26ca2b315be3e3b17e62f535ed0419679d4f18019cd7469b600767267b278","observation_id":"5bb566fc-f590-4140-a412-deb0452517a4","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:ba266d11e52cc0ca54e64d888a5ec41745e03cda8a6a2603b40f0619c70e01a4","observation_id":"30f171c9-5550-477d-b10e-386c8c6a3a32","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:00f5437fc186abf88959a4db68aeb02f0572031fb2e523a56b11d8c2451185f7","observation_id":"163df406-cacd-4f23-9923-1dc5599c9bc8","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08236","last_updated":"2026-05-31T23:44:59Z","snapshot_observed_at":"2026-08-13T16:53:07.924748Z","submitted_at":"2026-02-09T03:21:48Z","title":"When and How Much to Imagine: Adaptive Test-Time Scaling with World Models for Visual Spatial Reasoning","version":2},"cited_work":{"arxiv_id":"2602.08236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.08236","snapshot_observed_at":"2026-07-04T13:59:51.783600Z","title":"When and how much to imagine: Adaptive test-time scaling with world models for visual spatial reasoning","venue":"cs.CV","work_id":"a6ffefb4-09b3-486d-856d-e3aaf4c60e32","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2602.08236","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:08d9918ab2c61ef6bcbf9907320f6783416d7101307ccbef66b9c0b938a71b09","observation_id":"6f6731d0-2cb5-46a0-8379-006a217dc5c9","resolution":{"observed_at":"2026-06-29T18:23:50.664354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02130","last_updated":"2026-05-04T01:19:36Z","snapshot_observed_at":"2026-08-13T07:34:28.060398Z","submitted_at":"2026-05-04T01:19:36Z","title":"From Where Things Are to What They Are For: Benchmarking Spatial-Functional Intelligence in Multimodal LLMs","version":1},"cited_work":{"arxiv_id":"2605.02130","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.02130","snapshot_observed_at":"2026-06-29T18:23:50.657533Z","title":"From Where Things Are to What They Are For: Benchmarking Spatial-Functional Intelligence in Multimodal LLMs","venue":"cs.CV","work_id":"99e6bb1c-5bd9-415b-b6bf-cafd8a6505cb","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"cited_paper":"/paper/2605.02130","citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:406b36757888ca2db517bd31c1f35f2b6a66daa40747b1abb04181fca362d3ba","observation_id":"ec4655f5-24ac-495b-9951-0dc8b407ad74","resolution":{"observed_at":"2026-06-29T18:23:50.658839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13029","doi":"10.48550/arxiv.2601.13029","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think3d: Thinking with space for spatial reasoning","venue":"Open MIND","work_id":"e6dccdbb-b31e-4545-9ce9-686d78d7262c","year":2026},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:90e3b639435828f74e53acd945116ef8209fa19fad8c71504e514cb487a9e9be","observation_id":"973e3003-c948-46c9-94b5-f531e1ed3ed5","resolution":{"observed_at":"2026-06-29T18:23:50.677720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:768635a07c4be061ad424cc2150fe6020e205807b7e97a3199dd3eff77791f50","observation_id":"6570a2c6-f5b5-47f8-9291-8d2452c90763","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:19:40.323661Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-29T18:19:40.323661Z"},"links":{"citing_paper":"/paper/2605.27310"},"observation_digest":"sha256:a899273fdf5681e4993e544f14f0758ba0c2dbd37966562bc09b3743a0a997ae","observation_id":"1436ab21-ad17-4501-9848-73b8f80678c5","resolution":{"observed_at":"2026-06-29T18:19:40.323661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.27310","last_updated":"2026-05-26T17:20:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T07:01:32.599524Z","submitted_at":"2026-05-26T17:20:05Z","title":"How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":13,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2605.27310."}