{"as_of":"2026-08-05T19:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:534a4842a314ef4ef22d459e4d60c37e27e3aba6c6b622dfa602eca0426f412b","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:19:03.850707Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17478/citation-record","integrity":"/paper/2605.17478/integrity","json":"/paper/2605.17478/citation-record.json","paper":"/paper/2605.17478"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A naturalistic open source movie for optical flow evaluation","venue":null,"work_id":"3f58f385-64bd-4f4e-beb9-0981c26077c8","year":2012},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:c485152bf672e98912b35a2f1bdfa8ee46570188a2214c0c28c0e4f96669478d","observation_id":"78cf1c13-41d7-45a2-9c6a-e53b07a8b7e1","resolution":{"observed_at":"2026-05-20T14:23:30.739490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam3: An accurate open-source library for visual, visual–inertial, and multimap slam","venue":null,"work_id":"d1da642d-4bbf-4749-83b7-1e998593c5a3","year":2021},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:426939f55d6f0f0cd2848dfee262582d8d4197ced55cf66a7e02527b48dc7f39","observation_id":"c0456a0b-e108-4073-8507-cbe111fa66f3","resolution":{"observed_at":"2026-05-20T14:23:30.737020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:cb71b106c78d3c3a532d4fe0cf6dc524d06bcecf627b7f3ccbc46ecd551c04b9","observation_id":"f18cd508-a9f0-449d-8deb-5c7d1652b163","resolution":{"observed_at":"2026-05-20T14:23:21.726832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26645","last_updated":"2026-03-03T12:58:09Z","snapshot_observed_at":"2026-07-30T21:37:36.891851Z","submitted_at":"2025-09-30T17:59:51Z","title":"TTT3R: 3D Reconstruction as Test-Time Training","version":4},"cited_work":{"arxiv_id":"2509.26645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26645","snapshot_observed_at":"2026-07-10T20:17:33.684655Z","title":"TTT3R: 3D Reconstruction as Test-Time Training","venue":"cs.CV","work_id":"a2dcce9c-5c33-49e2-989b-e0438645054f","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2509.26645","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:7ccf863fe8a5055d91b8a73071e47a73a1b9b893b87f0f89680b070e0c6bb4ae","observation_id":"e8bd6f5b-f5aa-43e9-87dc-11944c452bd7","resolution":{"observed_at":"2026-05-20T14:23:21.720248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16443","last_updated":"2026-03-16T08:45:25Z","snapshot_observed_at":"2026-08-04T13:08:09.273271Z","submitted_at":"2025-07-22T10:39:04Z","title":"VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences","version":2},"cited_work":{"arxiv_id":"2507.16443","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.16443","snapshot_observed_at":"2026-07-10T20:17:33.710596Z","title":"VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences","venue":"cs.CV","work_id":"7f673068-ecd4-4d78-b994-4ec07cae304f","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2507.16443","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:201e6da6a867796e682ed6e300017889a6ac468145df21ce3458460123711b3d","observation_id":"991200b4-14c6-4e8d-b5f8-d44c641f1df9","resolution":{"observed_at":"2026-05-20T14:23:21.729719Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11247","last_updated":"2026-05-13T03:31:24Z","snapshot_observed_at":"2026-07-06T17:45:55.829892Z","submitted_at":"2024-03-17T15:41:35Z","title":"Compact 3D Gaussian Splatting For Dense Visual SLAM","version":3},"cited_work":{"arxiv_id":"2403.11247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11247","snapshot_observed_at":"2026-07-04T13:09:51.149892Z","title":"Compact 3D Gaussian Splatting For Dense Visual SLAM","venue":"cs.CV","work_id":"d8274008-86ea-42d5-93fa-b5f806a9224a","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2403.11247","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:82c19935ad74dd360ee8159dd74fbb05d1792e1b8017261d69e6b151ddf2f7f9","observation_id":"c6c0decf-675a-43a8-96a7-69eced380157","resolution":{"observed_at":"2026-05-20T14:23:21.723574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03422","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:46:11.607069Z","title":"What is the best 3d scene representation for robotics? from geometric to foundation models","venue":null,"work_id":"e2f37cab-d139-438b-9969-f14a0c9fc8f9","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:5b1678b7705452b23b71b1f6281c97b14fd28340a1290e952327b4b4bdfaeeee","observation_id":"27e0fb42-d774-4096-9ccf-47722f0b0fbf","resolution":{"observed_at":"2026-05-20T14:23:21.717423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plgslam: Progressive neural scene represenation with local to global bundle adjustment","venue":null,"work_id":"26615735-39b2-4e42-9476-796ceeeeac57","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:b53b9476cf37acbfaa0098efd5e3c57bfafeb65dd0d78574e1e4def87e766d51","observation_id":"743e1f25-5520-436c-b815-3233a1f8e5cf","resolution":{"observed_at":"2026-05-20T14:23:30.770934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.23361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T07:16:44.824411Z","title":"Available: https://arxiv.org/abs/2602.23361","venue":null,"work_id":"d003785b-ecf7-4089-94f2-ec9adb7a6518","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:ed69c187f50113ce26095df346808831eadd71878b2af46671ee0fdc4c1e62b0","observation_id":"1bab43fa-0226-4964-9c89-d56e4af45ac4","resolution":{"observed_at":"2026-05-20T14:23:21.705044Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Incvggt: Incremental vggt for memory-bounded long-range 3d reconstruction","venue":null,"work_id":"640cb5ce-42b5-4008-8d6a-b9a1b68807a3","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:54e346808ea71db3f5ec06fae6e4c56da998283e6e7d8bfa5a9f23b8735df9be","observation_id":"476f2638-c6b5-450a-87ba-9e2f6cc2e106","resolution":{"observed_at":"2026-05-20T14:23:30.743247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:f8c80d0f4ddba1e8358c52294f20241a3966f1b3133865bc45b04377ccd99d3b","observation_id":"05e1c021-89ee-4a1f-9ab2-fc65f5e3b7c9","resolution":{"observed_at":"2026-05-20T14:23:21.695885Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large scale multi-view stereopsis evaluation","venue":null,"work_id":"60ba3ee2-c148-4985-8cf3-5f6db91ca0e7","year":2014},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:31a834549170e921a27613419f63ac9a01ee0fdc5fb6ff1fe497dbae15ed92eb","observation_id":"6fcd8821-be37-442e-ab7a-2ec8810f36d0","resolution":{"observed_at":"2026-05-20T14:23:30.754257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04385","last_updated":"2026-04-08T22:29:40Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-03-04T18:49:37Z","title":"ZipMap: Linear-Time Stateful 3D Reconstruction via Test-Time Training","version":3},"cited_work":{"arxiv_id":"2603.04385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.04385","snapshot_observed_at":"2026-07-02T07:16:44.799839Z","title":"ZipMap: Linear-Time Stateful 3D Reconstruction via Test-Time Training","venue":"cs.CV","work_id":"dd4dd2cb-d30a-464f-a067-ad0d84dbb0f4","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2603.04385","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:f6d3226416105f595a391694dd00d57546580a063d22c40dc6ceb11201d61833","observation_id":"dfd0d7c8-b2ae-4494-b383-61b1fa51fa9e","resolution":{"observed_at":"2026-05-20T14:23:21.693268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/itsc55140.2022.9922275","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":"2022 IEEE 25th International Conference on Intelligent Transportation Systems (ITSC)","work_id":"538e32a7-33de-461c-9bcc-7d531a31fb65","year":2020},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:faecefa79dfc6901a8de9ce7920856e3d3f6e1be1d3c679ef348734f77946dd6","observation_id":"a9041407-9f2b-4d45-ac1b-26afddfb6cbf","resolution":{"observed_at":"2026-05-20T14:23:30.777365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":"cbc78ad8-5314-471f-8bcd-2c07dff652dd","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:2fb0b33c95e0cec9d20a8a871e430f76880389caea3c90d673d7cb8940581603","observation_id":"8a65eac2-8b42-473c-8d69-1d4473ec5822","resolution":{"observed_at":"2026-05-20T14:23:30.761498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07279","last_updated":"2026-04-08T16:41:22Z","snapshot_observed_at":"2026-07-06T22:55:33.502756Z","submitted_at":"2026-04-08T16:41:22Z","title":"Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training","version":1},"cited_work":{"arxiv_id":"2604.07279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07279","snapshot_observed_at":"2026-07-02T07:16:44.821718Z","title":"Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training","venue":"cs.CV","work_id":"aa0a83b7-070d-4b86-ac6d-72fb5b801a7c","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2604.07279","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:6cb5e82d6c0d1c784a0a6b38eaa78bd5d2f96d52b8060ccbf0ccf4405dda3432","observation_id":"c7e7e4a2-2a87-407d-b90c-80809b0c8033","resolution":{"observed_at":"2026-05-20T14:23:21.698618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12549","last_updated":"2025-05-23T11:59:20Z","snapshot_observed_at":"2026-07-06T21:25:56.796553Z","submitted_at":"2025-05-18T21:33:09Z","title":"VGGT-SLAM: Dense RGB SLAM Optimized on the SL(4) Manifold","version":2},"cited_work":{"arxiv_id":"2505.12549","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12549","snapshot_observed_at":"2026-07-03T20:08:56.102340Z","title":"VGGT-SLAM: Dense RGB SLAM Optimized on the SL(4) Manifold","venue":"cs.CV","work_id":"01d7329c-ee37-4f18-a3e3-4e786084b162","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2505.12549","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:78b12406cb26b39aa0f8b195ca4664e8f066dc8d7e0e00b48c6a4d19d0dc43fa","observation_id":"cb661fc1-09c4-4a33-a724-1db317a7f495","resolution":{"observed_at":"2026-05-20T21:03:14.770801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian splatting slam","venue":null,"work_id":"e2587ae6-80e3-4a17-8d68-3b3b97a85b28","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:d2ee8f0df897b64c36c3895f960a14508acda354760da4a7af61ba5ad3b55e82","observation_id":"3bb12aac-6507-4b99-bd48-56634ced7bd9","resolution":{"observed_at":"2026-05-20T14:23:30.766913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:51:35.516859Z","title":"Refusion: 3d reconstruction in dynamic environments for rgb-d cameras exploiting residuals","venue":null,"work_id":"bcb8cf15-f392-42eb-a9c0-f3ddf41387d1","year":2019},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:604d503c760be076a98b80f6e10c3ef1fbad7c5fc3132d6a5e70dc844bdaf657","observation_id":"2a4532a8-aebd-4100-a49e-2c9f8ba816c6","resolution":{"observed_at":"2026-05-20T14:23:30.772828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:53:58.185404Z","title":"Common objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"a0fc1836-c0b3-475d-a4c4-2df42d8fe3ab","year":2021},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:b5b848649f438b27e8d647fb2aed7fe16167086f8fe698796850880fb841d45b","observation_id":"b93a6e51-6921-486d-a4c9-b3997b4ba251","resolution":{"observed_at":"2026-05-20T14:23:30.758386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear transformers are secretly fast weight programmers","venue":null,"work_id":"40a31666-0c01-4e8e-b324-dc1078ab867f","year":2021},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:effcbf3093b0196dfb68b7d8b5aa632c4ecd71362e3c56266918427600c428c4","observation_id":"1a2099ca-e5c8-44c2-b074-afca38c52b64","resolution":{"observed_at":"2026-05-20T14:23:30.754101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T17:31:23.292795Z","title":"A multi-view stereo benchmark with high-resolution images and multi-camera videos","venue":null,"work_id":"01b94260-73c8-4312-a639-f5fb6aa76bfb","year":2017},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:d84331fe530a0878a42869c5fe6e5d7b8796e459811dd16408309db35aaf5b7b","observation_id":"f9eff9aa-eb5a-469e-8c4e-29226ea9122e","resolution":{"observed_at":"2026-05-20T14:23:30.766727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23737","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grs-slam3r: Real-time dense slam with gated recurrent state","venue":null,"work_id":"0665234f-bbf1-498f-a192-b8d6ff9cfb34","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:f0613bee67c3747a653eba7fbabb8e336055d120a5756bfdc76c64fb4030047c","observation_id":"932c4bfe-2920-4470-b523-7b86092fd807","resolution":{"observed_at":"2026-05-20T14:23:21.710946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04620","last_updated":"2025-08-31T18:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-05T16:23:20Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","version":4},"cited_work":{"arxiv_id":"2407.04620","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.04620","snapshot_observed_at":"2026-07-09T18:46:26.563289Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","venue":"cs.LG","work_id":"c682430c-e7a2-4699-b82d-55287448dbba","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2407.04620","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:5965bcf66f1910476173b6a35ee75d48d4e754994eec631d04b63b1986c33617","observation_id":"4e2eee0c-5354-44f4-9a14-070cbae77166","resolution":{"observed_at":"2026-05-20T14:23:21.707871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:45:54.238925Z","title":"Droid-slam: Deep visual slam for monocular, stereo, and rgb-d cameras.Advances in neural information processing systems, 34:16558–16569","venue":null,"work_id":"1c240637-0495-47fe-b2da-72a5e9de6ebf","year":2021},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:f5eddc55080408f0029468085afd17be380112f05fa66dae09c2793d0951f4e2","observation_id":"4aa328d3-006c-4285-abc3-018224a142ad","resolution":{"observed_at":"2026-05-20T14:23:30.775324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d reconstruction with spatial memory","venue":null,"work_id":"7ae6a39d-8fff-46e5-8f09-742ff60f677f","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:71509ddc0c7fd56fba9f7722ae83b825681bd3aa88a735fc4949f8a304322f4e","observation_id":"8c718375-796e-4be4-9850-054dd5a369da","resolution":{"observed_at":"2026-05-20T14:23:30.748954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20343","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:38:39.687516Z","title":"Amb3r: Accurate feed-forward metric-scale 3d reconstruc- tion with backend","venue":null,"work_id":"e23363c6-4f1f-4098-a563-5577e086b3c8","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:4d32702e93ac6639156050c16fc7a32fd790b6da7cfa00d41fb0021e8e58a081","observation_id":"b7a5e069-462c-4a92-b95c-ba4b59746854","resolution":{"observed_at":"2026-05-20T14:23:21.701919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr52734.2025.00499","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vggt: Visual geometry grounded transformer","venue":"2025 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","work_id":"07a3c51b-ffe4-44d2-9239-86e84934db95","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:96de5d1bec1cfe1ee1d7992110f2a832f14d4bb03eafda867312e8b78feb2341","observation_id":"28202854-5786-406d-a5d3-285b5b30c561","resolution":{"observed_at":"2026-05-20T14:23:30.764740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-20T18:21:56.85888+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T18:21:56.85888+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:12:55.334806Z","title":"Continuous 3d perception model with persistent state","venue":null,"work_id":"de40b3a6-d541-41cb-a5cf-88289dc76de1","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:cde32bd6da382d0f4d98b91752d638294932c5104f31758ae7c27e115a9b4432","observation_id":"945cda72-fc0c-4068-af93-d4551466b0af","resolution":{"observed_at":"2026-05-20T14:23:30.768898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":"39690c16-861d-4e2f-9422-8ef00df9c62e","year":2024},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:81932e28f3a60103ce1407f30ef3703d9d7dfea58fc4718c8327402ff1249e0b","observation_id":"bf5e9695-d193-4e0d-9e06-0f43f754e660","resolution":{"observed_at":"2026-05-20T14:23:30.762025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":"2507.13347","doi":"10.48550/arxiv.2507.13347","metadata_source":"pith","pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","venue":"cs.CV","work_id":"8ab9cfd6-a60d-45e6-a572-9b4db82b8527","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:0f0840fd3f98d1efdd057b16a84de42ab945787e54dfbc070338fa050e3397fc","observation_id":"166dc34f-0023-44a8-a024-d69b5749dd56","resolution":{"observed_at":"2026-05-20T14:23:21.713655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.02863","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T07:16:44.793540Z","title":"Point3R: Streaming 3D reconstruction with explicit spatial pointer memory","venue":null,"work_id":"05fd3f4e-7118-475b-8ddb-dc3156aa7d6c","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:c9cd341ebf2692d7f3b715996f54ce64c5042206eae7a7828408fd6dc691da20","observation_id":"de4e5f4a-96c5-43a9-9557-e4b2ebc1d698","resolution":{"observed_at":"2026-05-20T14:23:21.686913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08542","last_updated":"2026-04-09T17:59:50Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:59:50Z","title":"Scal3R: Scalable Test-Time Training for Large-Scale 3D Reconstruction","version":1},"cited_work":{"arxiv_id":"2604.08542","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08542","snapshot_observed_at":"2026-07-04T06:49:37.499327Z","title":"Scal3R: Scalable Test-Time Training for Large-Scale 3D Reconstruction","venue":"cs.CV","work_id":"104f6a9a-e75d-4f87-ad93-e4b19ee246d1","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2604.08542","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:d5c9ba2d6a693de3b6bda3781cb5b8bfd557f957ed85d9b8813cad89135ae18f","observation_id":"7fda499c-4d7c-46e3-bb01-e1d470d06217","resolution":{"observed_at":"2026-05-20T14:23:21.680792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast3r: Towards 3d reconstruction of 1000+ images in one forward pass","venue":null,"work_id":"f2d10204-07c3-4340-b2ec-8248b0e77fc3","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:69f8dc97f3760a106d940961ec919314d1dfe8f4a4f9bb0037938dd2401089cc","observation_id":"8500eb51-f4d2-4b73-9bbf-6fd9e57946ac","resolution":{"observed_at":"2026-05-20T14:23:30.760362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.02281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:17:09.613803Z","title":"InfiniteVGGT: Visual geometry grounded transformer for endless streams","venue":null,"work_id":"2534bd49-88ba-4e9b-9574-4d3c88f540db","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:ff41710ba91cdfa35de240aecb9fbd6326b439dabe96ebb9be7bda0717f2d37e","observation_id":"4bdb0a14-414e-482a-8093-454534815ea5","resolution":{"observed_at":"2026-05-20T14:23:21.664029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.03269","last_updated":"2026-04-27T16:46:35Z","snapshot_observed_at":"2026-07-06T22:47:41.997192Z","submitted_at":"2026-03-03T18:55:37Z","title":"LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory","version":2},"cited_work":{"arxiv_id":"2603.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.03269","snapshot_observed_at":"2026-07-04T06:49:37.496039Z","title":"LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory","venue":"cs.CV","work_id":"cf6731b8-f718-41ca-b15e-a88e301684c9","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2603.03269","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:09cf93fd6bcbf3af16c11f6da2b512d637924664adda120f2e223831cea28121","observation_id":"3058228d-6c70-4923-be8c-1c037aa14716","resolution":{"observed_at":"2026-05-20T14:23:21.669032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flare: Feed-forward geometry, appearance and camera estimation from uncalibrated sparse views","venue":null,"work_id":"eeb45a39-1881-4e0f-8f45-caf3024bdc0f","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:f2c53d30721e81a07e0c0b8c60620ae194aac8bd1cf7fd4c8091a6d39f04e236","observation_id":"bb634606-bd6f-4bdd-9328-931e055a733e","resolution":{"observed_at":"2026-05-20T14:23:30.756325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23884","last_updated":"2025-05-29T17:50:34Z","snapshot_observed_at":"2026-08-02T10:36:55.936254Z","submitted_at":"2025-05-29T17:50:34Z","title":"Test-Time Training Done Right","version":1},"cited_work":{"arxiv_id":"2505.23884","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23884","snapshot_observed_at":"2026-07-09T18:46:26.540032Z","title":"Test-Time Training Done Right","venue":"cs.LG","work_id":"12c91551-57e9-44df-bd50-62bbfc4b6f67","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2505.23884","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:650365ed784f2c076b8ed5f1e4dc41ba928fc209e112e140492b97ebf032e67d","observation_id":"7b373542-c8e8-41c9-826f-c0f9e2d43f1f","resolution":{"observed_at":"2026-05-20T14:23:21.673893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":"1805.09817","doi":"10.1145/3197517.3201323","metadata_source":"pith","pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","venue":"cs.CV","work_id":"f6abb68f-df5c-4569-af1b-9ede43a44468","year":2018},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:52cc82b33175709b6ae1103c6aab7ed19092dd687a36ab4152c1adf42ff8845f","observation_id":"9c8ee2c2-5d9d-4f66-8626-0f34f0728767","resolution":{"observed_at":"2026-05-20T14:23:21.683799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nice-slam: Neural implicit scalable encoding for slam","venue":null,"work_id":"751685af-8cac-4d58-bcfb-a279f01b219e","year":2022},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:7f6dafe72ca897afcd271c7fc9be9cce4c3ec3a04b9a6d347a0df633e03da29e","observation_id":"7fd74f4b-2e07-4c80-b7ec-736cace572b0","resolution":{"observed_at":"2026-05-20T14:23:30.741392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11539","last_updated":"2026-03-31T10:04:45Z","snapshot_observed_at":"2026-07-06T21:57:41.002474Z","submitted_at":"2025-07-15T17:59:57Z","title":"Streaming 4D Visual Geometry Transformer","version":2},"cited_work":{"arxiv_id":"2507.11539","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11539","snapshot_observed_at":"2026-07-08T23:55:43.019798Z","title":"Streaming 4D Visual Geometry Transformer","venue":"cs.CV","work_id":"76f59477-f3aa-4b45-98cb-ef9f45fab0c5","year":2025},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2507.11539","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:79bd4c60f32b8ef5795e8e194617ef4e865ee94b4aec058454b15dde151818b0","observation_id":"b43877d8-eaa1-4917-b062-4dd104a344a7","resolution":{"observed_at":"2026-05-20T14:23:21.677356Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":20,"verified_fuzzy":20},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2605.17478."}