{"as_of":"2026-08-08T16:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23f68daf77dac86f1f9e6ffd48a7c8035646b9d4c339fcbfa97288db35c5fe42","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:25:40.237122Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2505.12549","last_updated":"2025-05-23T11:59:20Z","snapshot_observed_at":"2026-07-06T21:25:56.796553Z","submitted_at":"2025-05-18T21:33:09Z","title":"VGGT-SLAM: Dense RGB SLAM Optimized on the SL(4) Manifold","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-20T21:03:14.217231Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2505.12549"},"observation_digest":"sha256:5bd431e8043321f5d4b1122d8a3438b3f4eca7fb5ccea15c7af4b402f5e565c4","observation_id":"8487a358-7691-4cb7-a9e3-b71056650a50","resolution":{"observed_at":"2026-05-20T21:03:14.282572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T15:25:40.237122Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15235","last_updated":"2025-05-26T14:57:30Z","snapshot_observed_at":"2026-08-07T15:19:18.741876Z","submitted_at":"2025-05-21T08:14:10Z","title":"X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:25:40.237122Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2505.15235"},"observation_digest":"sha256:993e295e6a8587c0d7227cbc52f40e92973882198edd34704a207d60827f618b","observation_id":"87632817-7ec7-4ba2-8be0-8952f64d600e","resolution":{"observed_at":"2026-08-07T15:25:40.237122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T15:25:00.097364Z","title":"Vggt: Visual geometry grounded transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15441","last_updated":"2026-07-06T10:16:05Z","snapshot_observed_at":"2026-08-07T15:15:28.038723Z","submitted_at":"2025-05-21T12:22:53Z","title":"Quick ViTs: Speeding up Vision Transformers through Equivariance","version":5},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:25:00.097364Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2505.15441"},"observation_digest":"sha256:2107164056e3feefa915e84a788bdd4a15720d9dc7e9f376b490900e106b2d90","observation_id":"76c1902a-cd4b-4764-aa8a-9990c3e1a3c8","resolution":{"observed_at":"2026-08-07T15:25:00.097364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T14:58:10.388471Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16882","last_updated":"2025-05-23T20:14:12Z","snapshot_observed_at":"2026-08-07T14:51:23.358383Z","submitted_at":"2025-05-22T16:36:52Z","title":"Tracking the Flight: Exploring a Computational Framework for Analyzing Escape Responses in Plains Zebra (Equus quagga)","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:10.388471Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2505.16882"},"observation_digest":"sha256:527bbe4563437b76d7af158c906d3753ce1870547482543201dbc2b1bbb769ab","observation_id":"296c4722-a969-4f8d-a0db-cae639518871","resolution":{"observed_at":"2026-08-07T14:58:10.388471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2505.20279","last_updated":"2026-04-21T02:48:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T17:56:30Z","title":"VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction","version":5},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-19T12:54:01.013242Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2505.20279"},"observation_digest":"sha256:229b3d58af28c76fb5842acc3e5ead59be279ea9b205cc5bcde205850c78298c","observation_id":"2f1d1b15-0de5-45ac-8c0a-daec510929df","resolution":{"observed_at":"2026-05-19T12:57:17.992322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T10:35:15.781361Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05011","last_updated":"2025-06-05T13:21:09Z","snapshot_observed_at":"2026-08-08T14:48:36.715235Z","submitted_at":"2025-06-05T13:21:09Z","title":"UAV4D: Dynamic Neural Rendering of Human-Centric UAV Imagery using Gaussian Splatting","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:15.781361Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2506.05011"},"observation_digest":"sha256:94cdbca09d99a746e1ebf2bff59eb0ae16baddad1786095aeb0019a0f4a65dd7","observation_id":"99d6a516-f02a-407d-86f6-010df308359c","resolution":{"observed_at":"2026-08-07T10:35:15.781361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T04:35:08.389877Z","title":"Vggt: Visual geometry grounded transformer.arXiv preprint arXiv:2503.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10335","last_updated":"2025-06-12T04:07:07Z","snapshot_observed_at":"2026-08-08T14:22:46.232232Z","submitted_at":"2025-06-12T04:07:07Z","title":"PointGS: Point Attention-Aware Sparse View Synthesis with Gaussian Splatting","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:08.389877Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2506.10335"},"observation_digest":"sha256:d3a9f2e5e4b6144792e0eaa63ae1ed7da2a9cef727edf16e02ed1e6fe405916b","observation_id":"f50c65f6-6265-4a3d-b12a-81b94125c0e8","resolution":{"observed_at":"2026-08-07T04:35:08.389877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T00:32:06.332826Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13750","last_updated":"2025-06-16T17:56:22Z","snapshot_observed_at":"2026-08-07T08:57:08.872123Z","submitted_at":"2025-06-16T17:56:22Z","title":"Test3R: Learning to Reconstruct 3D at Test Time","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:32:06.332826Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2506.13750"},"observation_digest":"sha256:452259dc1de7d38a61ca0386d91180420ed73949bfa620dd2a40c5f281abf0a4","observation_id":"e945b7ed-c03b-457b-89d6-32e96b981d73","resolution":{"observed_at":"2026-08-07T00:32:06.332826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-06T23:35:15.369610Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17450","last_updated":"2025-06-26T02:46:40Z","snapshot_observed_at":"2026-08-08T05:18:07.096875Z","submitted_at":"2025-06-20T19:38:34Z","title":"BlenderFusion: 3D-Grounded Visual Editing and Generative Compositing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:15.369610Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2506.17450"},"observation_digest":"sha256:f7a6ea46560f9bf6a807c8650b5b4853e7aadf7fe925a9f7d06ac7d03844e30e","observation_id":"3d076b88-1e90-437d-9aa0-fedef93c86d0","resolution":{"observed_at":"2026-08-06T23:35:15.369610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-06T21:34:04.027841Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23863","last_updated":"2025-06-30T13:57:24Z","snapshot_observed_at":"2026-08-08T02:52:09.805484Z","submitted_at":"2025-06-30T13:57:24Z","title":"Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:04.027841Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2506.23863"},"observation_digest":"sha256:ff77e3a59e56ee5408da46a6c9b0265d1c709233f97436b780c4abc48e80b1c7","observation_id":"c9f8087b-9be2-4bc3-bf0e-41081324e0f9","resolution":{"observed_at":"2026-08-06T21:34:04.027841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T17:14:22.678806Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2507.13347"},"observation_digest":"sha256:f806a7a62566caa1963cb047cc1f70473480963922976847968a68bdc57b5cc1","observation_id":"60b492d7-82de-430d-95d2-7799e98d3a51","resolution":{"observed_at":"2026-05-12T17:14:22.741377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T17:42:03.479495Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15972","last_updated":"2025-08-21T21:31:04Z","snapshot_observed_at":"2026-08-07T14:50:32.625181Z","submitted_at":"2025-08-21T21:31:04Z","title":"UnPose: Uncertainty-Guided Diffusion Priors for Zero-Shot Pose Estimation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T17:42:03.479495Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2508.15972"},"observation_digest":"sha256:3cbdb572e6bd7018e417a8ccde4ce69c639284401c8b45b7ca56be449bb68576","observation_id":"d7b02808-373b-4a63-80f8-e5cbb977d361","resolution":{"observed_at":"2026-08-05T17:42:03.479495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fc49766181d7b95135bc35122b0c749fb986db2ef70206d9bfbff1f7e92b7466","observation_id":"f808afb6-0364-409b-8327-73ccf0b1aa32","resolution":{"observed_at":"2026-05-18T02:00:39.706494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-02T20:18:05.012742Z","title":"VGGT: Visual Geometry Grounded Transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.23721","last_updated":"2026-06-30T14:23:11Z","snapshot_observed_at":"2026-08-08T06:33:40.080560Z","submitted_at":"2026-02-27T06:43:37Z","title":"StemVLA:An Open-Source Vision-Language-Action Model with Future 3D Spatial Geometry Knowledge and 4D Historical Representation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T20:18:05.012742Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2602.23721"},"observation_digest":"sha256:b625ff8ff59fed7c277ef92d8f30decaa4e459049c404855fbb30a3c438e7bd4","observation_id":"c84d68c7-2e32-440c-81b3-6844818041ff","resolution":{"observed_at":"2026-08-02T20:18:05.012742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-07-13T23:54:26.281624Z","title":"In: IEEE Conf","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16271","last_updated":"2026-06-30T03:31:28Z","snapshot_observed_at":"2026-07-13T23:53:56.592969Z","submitted_at":"2026-03-17T09:04:10Z","title":"VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T23:54:26.281624Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2603.16271"},"observation_digest":"sha256:1a7c042d13755f5b89285ddc824f0aa5243c64eb38645f47431a5a6171a1a18b","observation_id":"c595c482-b65d-4269-8bbc-17b77ebbab14","resolution":{"observed_at":"2026-07-13T23:54:26.281624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2604.10809","last_updated":"2026-04-12T20:40:59Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:40:59Z","title":"WARPED: Wrist-Aligned Rendering for Robot Policy Learning from Egocentric Human Demonstrations","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-10T15:14:24.932972Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2604.10809"},"observation_digest":"sha256:6cc91d8713aa67052b91847c34268880135b4cedbc445de68b34f13571a18614","observation_id":"74957055-cab3-456f-8414-4077fc4597eb","resolution":{"observed_at":"2026-05-11T11:01:02.703560Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2604.12309","last_updated":"2026-04-14T05:35:46Z","snapshot_observed_at":"2026-07-31T16:00:15.289886Z","submitted_at":"2026-04-14T05:35:46Z","title":"Towards Realistic and Consistent Orbital Video Generation via 3D Foundation Priors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T14:50:20.837112Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2604.12309"},"observation_digest":"sha256:aeeba3032f8a5071fbdce93c2fd0859f26456f971e08e9f1fc7cce9e0512f407","observation_id":"5154cdc3-0a0f-4f41-8aad-775d933a2c64","resolution":{"observed_at":"2026-05-11T11:31:01.670969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2604.14025","last_updated":"2026-04-15T16:07:18Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T16:07:18Z","title":"Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T13:13:42.052386Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2604.14025"},"observation_digest":"sha256:7ae111b045971a59a25b739fe248b9cff68ffc6a398ccbbdfda008641fbc79f4","observation_id":"7e3850b6-a6ac-4878-8d17-ba9a15798bc5","resolution":{"observed_at":"2026-05-10T13:20:26.206351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.06481","last_updated":"2026-05-07T16:06:08Z","snapshot_observed_at":"2026-08-03T04:45:05.402667Z","submitted_at":"2026-05-07T16:06:08Z","title":"OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-08T08:52:07.545191Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.06481"},"observation_digest":"sha256:6bc18285368c207bc633add4beb37fc1d33bf86f90d216099382b1ff2ba6bf1d","observation_id":"b10d6584-7cfe-4c6d-bc4c-7e5560a8bcf2","resolution":{"observed_at":"2026-05-11T20:31:11.216124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.12938","last_updated":"2026-05-13T03:18:26Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T03:18:26Z","title":"CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T20:07:28.493050Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.12938"},"observation_digest":"sha256:260cc995560076f32c7b6467515025deef5dc1d543aa723461993431d3a02d2f","observation_id":"78b28ec7-2dbd-44a4-9c44-eeac6c96330d","resolution":{"observed_at":"2026-05-14T20:07:53.447893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.21121","last_updated":"2026-05-20T12:50:52Z","snapshot_observed_at":"2026-07-06T23:31:37.061253Z","submitted_at":"2026-05-20T12:50:52Z","title":"ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-21T05:04:07.790893Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.21121"},"observation_digest":"sha256:686a08994e2fd7b476565d0752c62030b95dda1ffa4753da50d449b898bace15","observation_id":"c908c258-a524-44a0-b4cf-fbd89e4acaf3","resolution":{"observed_at":"2026-05-21T05:04:37.283023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.21472","last_updated":"2026-08-04T12:52:46Z","snapshot_observed_at":"2026-08-07T23:11:36.388083Z","submitted_at":"2026-05-20T17:55:16Z","title":"Stream3D: Sequential Multi-View 3D Generation via Evidential Memory","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-21T04:49:58.127599Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.21472"},"observation_digest":"sha256:133137a1bf4f7d43f9bb9177ae09edcf6d490d0e8a9f91663d25f2953bf50a11","observation_id":"aa477ece-622f-4592-8022-ac34ac38438a","resolution":{"observed_at":"2026-05-21T04:53:58.168953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.21472","last_updated":"2026-08-04T12:52:46Z","snapshot_observed_at":"2026-08-07T23:11:36.388083Z","submitted_at":"2026-05-20T17:55:16Z","title":"Stream3D: Sequential Multi-View 3D Generation via Evidential Memory","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T16:51:48.920965Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.21472"},"observation_digest":"sha256:01c519d15d98a27e28af6b402c6f616de884b3cb5d681a2a4439cea4e7658a69","observation_id":"158f727c-f36b-4077-8fe9-9048e0982715","resolution":{"observed_at":"2026-06-30T16:54:58.448177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.22190","last_updated":"2026-05-21T08:57:21Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T08:57:21Z","title":"No Pose, No Problem in 4D: Feed-Forward Dynamic Gaussians from Unposed Multi-View Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T06:27:21.559658Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.22190"},"observation_digest":"sha256:37da7c8ce9b925a082af999b38741b6e1a61874d4c8e4d2693013562c2340665","observation_id":"2098c6b8-7dac-4191-bd75-6b76a769f019","resolution":{"observed_at":"2026-05-22T06:31:10.207060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.23888","last_updated":"2026-05-22T17:49:59Z","snapshot_observed_at":"2026-08-02T20:09:35.530609Z","submitted_at":"2026-05-22T17:49:59Z","title":"GenRecon: Bridging Generative Priors for Multi-View 3D Scene Reconstruction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T04:37:47.777425Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.23888"},"observation_digest":"sha256:edf6771a3c45bad750c45ccba82ea227ba3100ad100625a1f5dd298eae711cb9","observation_id":"7b080ea6-2890-4d91-9df2-1c7c0f57e4f0","resolution":{"observed_at":"2026-05-25T04:40:24.027792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.24642","last_updated":"2026-05-23T16:18:41Z","snapshot_observed_at":"2026-07-30T07:41:42.487489Z","submitted_at":"2026-05-23T16:18:41Z","title":"Understanding the Impact of Geometric Foundation Models on Vision-Language-Action Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T13:40:59.330788Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.24642"},"observation_digest":"sha256:c04b45780c619fdaaf41ee27143f4332d226bfda9df117dcea6ff17364cbdbff","observation_id":"6adaa43c-9e72-4c54-bf7e-4a244f4c4b5f","resolution":{"observed_at":"2026-06-30T13:44:40.731071Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.25308","last_updated":"2026-05-25T00:13:15Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T00:13:15Z","title":"Stabilizing Streaming Video Geometry via Dynamic Feature Normalization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T23:15:20.254402Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.25308"},"observation_digest":"sha256:e380c6db2f7a46866a0b830caf43984720dbeffc2597c6efb672b147d168347c","observation_id":"1329d460-51e4-4015-ac17-d0cb65357000","resolution":{"observed_at":"2026-06-29T23:24:02.094440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.26115","last_updated":"2026-05-25T17:59:53Z","snapshot_observed_at":"2026-08-05T14:24:13.279939Z","submitted_at":"2026-05-25T17:59:53Z","title":"TriSplat: Simulation-Ready Feed-Forward 3D Scene Reconstruction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T22:11:45.816171Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.26115"},"observation_digest":"sha256:2a8d043dd4be8e10eb7e812cc80e98b456481404d2a232c2ba5b59c3da0f54d1","observation_id":"46ad6045-0b98-4039-8608-3e7ec2a539cb","resolution":{"observed_at":"2026-06-29T22:13:59.722591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2605.28101","last_updated":"2026-05-27T07:54:47Z","snapshot_observed_at":"2026-08-01T20:36:16.545203Z","submitted_at":"2026-05-27T07:54:47Z","title":"EigeNet: Geometry-Informed Multi-Modal Learning for Few-shot Novel View RIR Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T10:25:14.873276Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2605.28101"},"observation_digest":"sha256:042d95c36dc31a5abc0b965863ce272f59ab7d9a14f1a6d6907645c436489bae","observation_id":"860f9337-5281-4973-9d5e-087197ff6664","resolution":{"observed_at":"2026-06-29T13:23:28.918895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2606.05491","last_updated":"2026-06-03T22:30:58Z","snapshot_observed_at":"2026-07-06T23:45:28.379468Z","submitted_at":"2026-06-03T22:30:58Z","title":"Unpaired RGB-Thermal Gaussian-Splatting Using Visual Geometric Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T06:07:45.100095Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2606.05491"},"observation_digest":"sha256:f63c15b2979e3b9433fa6ee62226f30a4f7402d2ba182546914936fe4cfd536a","observation_id":"36594c6e-972a-4802-9051-d78cbebdf2b0","resolution":{"observed_at":"2026-07-02T08:16:48.427340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2606.20515","last_updated":"2026-06-28T15:54:03Z","snapshot_observed_at":"2026-08-02T07:26:05.359571Z","submitted_at":"2026-06-18T17:34:55Z","title":"S-Agent: Spatial Tool-Use Elicits Reasoning for Spatial Intelligence","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T17:56:07.864580Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2606.20515"},"observation_digest":"sha256:0945e69a4558ed52cde7c30d7852af14c15faf5e24a6b0a0524f376e7c3fe9ca","observation_id":"86cdc3fd-4672-4e06-9238-e6d06651fa46","resolution":{"observed_at":"2026-07-04T03:29:31.624924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2606.20515","last_updated":"2026-06-28T15:54:03Z","snapshot_observed_at":"2026-08-02T07:26:05.359571Z","submitted_at":"2026-06-18T17:34:55Z","title":"S-Agent: Spatial Tool-Use Elicits Reasoning for Spatial Intelligence","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T10:22:08.535453Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2606.20515"},"observation_digest":"sha256:9e12e15701118f59b6e52dcfe72b2203b1d603f9d04ea928d48e2a5c80377810","observation_id":"864854fa-12e9-4d51-9869-52bc99fab10e","resolution":{"observed_at":"2026-06-30T11:54:39.077485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2606.22481","last_updated":"2026-06-21T12:50:07Z","snapshot_observed_at":"2026-07-06T23:57:18.596834Z","submitted_at":"2026-06-21T12:50:07Z","title":"Lighting-Consistent Object Transfer Across Radiance Fields","version":1},"reference_index":299,"source":"arxiv_source","source_observed_at":"2026-06-26T09:46:46.216810Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2606.22481"},"observation_digest":"sha256:f52d3dcecc4641279913f3fde61bff84786cba7af932be74c16bcf0c6a1ff7c8","observation_id":"556040ee-2226-4b32-9226-7ab515e6a9da","resolution":{"observed_at":"2026-06-26T09:49:17.988255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2606.27354","last_updated":"2026-06-25T17:56:27Z","snapshot_observed_at":"2026-08-02T07:39:29.823887Z","submitted_at":"2026-06-25T17:56:27Z","title":"Error-Conditioned Neural Solvers","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-26T04:54:56.698035Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2606.27354"},"observation_digest":"sha256:26d054ca406c6afdceb951a3d0f6fb0adfc0f4336847e9517e42c993d5cef421","observation_id":"2bb9ff09-48bb-4b2d-b28a-a2019e022599","resolution":{"observed_at":"2026-07-04T13:49:51.654492Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"ArXiv.org","work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2607.02075","last_updated":"2026-07-02T12:14:02Z","snapshot_observed_at":"2026-08-05T08:46:58.228914Z","submitted_at":"2026-07-02T12:14:02Z","title":"HandsOnWorld: Unconstrained Egocentric Video Generation with Camera-Disentangled Hand Control","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-03T15:52:18.371702Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2607.02075"},"observation_digest":"sha256:732771aa7307d7ff8a47c317cc538e9ccecad658b95bee9536bc47300a1d886f","observation_id":"f618cacd-4bc3-4224-bbf3-2e12eff2fd2d","resolution":{"observed_at":"2026-07-03T15:58:37.406209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-02T07:01:42.802539Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11285","last_updated":"2026-07-15T05:18:17Z","snapshot_observed_at":"2026-08-06T08:25:02.363279Z","submitted_at":"2026-07-13T09:06:49Z","title":"SalientGS: Unified SfM-to-3DGS with Importance-Guided MCMC Gaussian Allocation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:42.802539Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2607.11285"},"observation_digest":"sha256:7cac0263e087e6827f60796a43ba52e49e1104c72dc46cbe160f40fee4009c2e","observation_id":"3d7c1fb4-2620-4f27-8556-67226206310c","resolution":{"observed_at":"2026-08-02T07:01:42.802539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-02T06:16:25.268319Z","title":"VGGT: Visual geometry grounded transformer.arXiv preprint arXiv:2503.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12993","last_updated":"2026-07-15T17:13:15Z","snapshot_observed_at":"2026-08-07T20:19:58.454005Z","submitted_at":"2026-07-14T17:45:50Z","title":"X-Lens: Real-Time Metric Depth Estimation with Heterogeneous Cameras","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T06:16:25.268319Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2607.12993"},"observation_digest":"sha256:666a78a387d66b654c94b43128f7f8ff5ea139b054ceb6999a9535bcd946b318","observation_id":"dff690a6-b741-4831-9315-2e53e092375d","resolution":{"observed_at":"2026-08-02T06:16:25.268319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-01T18:33:43.504820Z","title":"VGGT: Visual geometry grounded transformer, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17268","last_updated":"2026-07-19T14:20:13Z","snapshot_observed_at":"2026-08-06T21:29:33.397260Z","submitted_at":"2026-07-19T14:20:13Z","title":"PACE: Polar Axis-Conditioned Estimation for PairUAV Relative Localization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T18:33:43.504820Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2607.17268"},"observation_digest":"sha256:2855cdf652ea25ccfabab7bdbdc3949b4cc7cb563ec9df6367aa03b46721c1cc","observation_id":"048fbe45-1ccf-49d2-a186-55a2830d7333","resolution":{"observed_at":"2026-08-01T18:33:43.504820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-01T17:26:13.325134Z","title":"Vggt: Visual geometry grounded transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17660","last_updated":"2026-07-20T08:10:58Z","snapshot_observed_at":"2026-08-08T16:38:08.568423Z","submitted_at":"2026-07-20T08:10:58Z","title":"RayOcc: Occlusion-Aware Ray Occupancy Estimation via Gaussian Mixture Intensity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T17:26:13.325134Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2607.17660"},"observation_digest":"sha256:58413571cd4f1e02919bf36a811dd856bbe939ef525ed6fd99e0058f29c66b9e","observation_id":"1eac6d03-5a75-4482-ba44-1bc5dbf2928e","resolution":{"observed_at":"2026-08-01T17:26:13.325134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-08-07T00:14:13.351774Z","title":"VGGT: Visual geometry grounded transformer.arXiv preprint arXiv:2503.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T23:09:56.055766Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":159,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.351774Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:7a0d560ad1febbed9e9e54944494a5ef56e27cd65238b2fc52788e62813060e8","observation_id":"617277bd-7bef-4a68-8df7-13ad9f36ee15","resolution":{"observed_at":"2026-08-07T00:14:13.351774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.11651/citation-record","integrity":"/paper/2503.11651/integrity","json":"/paper/2503.11651/citation-record.json","paper":"/paper/2503.11651"},"outbound":[],"paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T17:03:09.355801Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2503.11651."}