{"as_of":"2026-08-05T08:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4065e6bfd283a84bb73a5f7e98c4905c8747d8d39acbcf6258fe7701a40bf4db","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:54:13.644019Z","state":"measured"},{"denominator":120,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":120,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:07:07.298312Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T23:55:43.003851Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.06317","last_updated":"2026-06-06T04:13:49Z","snapshot_observed_at":"2026-08-01T16:06:18.480696Z","submitted_at":"2026-05-07T14:16:58Z","title":"NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T13:33:55.535856Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.06317"},"observation_digest":"sha256:0943275be917e745f2acdd9fc8b500c052c19b094f7cce5b477b5e36ecf9ff90","observation_id":"763518fe-b8df-4b12-8d0b-4d4acb764d4d","resolution":{"observed_at":"2026-05-11T18:51:08.593187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.06317","last_updated":"2026-06-06T04:13:49Z","snapshot_observed_at":"2026-08-01T16:06:18.480696Z","submitted_at":"2026-05-07T14:16:58Z","title":"NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T00:50:11.709217Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.06317"},"observation_digest":"sha256:81b12fc5ca7e24191e84bceac2ec4023f474d3dee748b52895c813549716f251","observation_id":"0a217dcf-b29a-41e3-9cd7-4ccf2e4b1380","resolution":{"observed_at":"2026-05-11T00:50:49.552353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.06317","last_updated":"2026-06-06T04:13:49Z","snapshot_observed_at":"2026-08-01T16:06:18.480696Z","submitted_at":"2026-05-07T14:16:58Z","title":"NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T23:13:41.784895Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.06317"},"observation_digest":"sha256:59c5852401b0d3cb74511079a3590ec9887a7a5e65f865f4321cea04df78c1d9","observation_id":"64250608-a83b-43eb-9809-a148d3db096f","resolution":{"observed_at":"2026-05-20T23:13:50.266966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.06317","last_updated":"2026-06-06T04:13:49Z","snapshot_observed_at":"2026-08-01T16:06:18.480696Z","submitted_at":"2026-05-07T14:16:58Z","title":"NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T23:22:52.586386Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.06317"},"observation_digest":"sha256:7d31172a73827a8defdea450f9e39df5f3cdfae157c2173f3738786cf6746d33","observation_id":"210b51cd-3de6-4433-a790-d66644c1c223","resolution":{"observed_at":"2026-06-30T23:25:07.737429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.17249","last_updated":"2026-06-04T15:16:16Z","snapshot_observed_at":"2026-08-02T18:37:17.554035Z","submitted_at":"2026-05-17T04:12:56Z","title":"SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T13:31:16.012419Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.17249"},"observation_digest":"sha256:a7bc90b499aa4e9c344a899150f0311d1f42fd56bfbb39173aa19172937286fa","observation_id":"113334b0-d1e3-405c-ac8e-e97eac779621","resolution":{"observed_at":"2026-05-20T13:33:19.178681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.17249","last_updated":"2026-06-04T15:16:16Z","snapshot_observed_at":"2026-08-02T18:37:17.554035Z","submitted_at":"2026-05-17T04:12:56Z","title":"SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T19:42:41.238072Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.17249"},"observation_digest":"sha256:c2e24eb2955459c856fce8c9c485ccfb81d7e5aa5beeb460882c5ff07bd01ecf","observation_id":"baf80952-7111-4f94-9b2c-568da5c2dfce","resolution":{"observed_at":"2026-06-30T19:45:00.681245Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.17303","last_updated":"2026-05-17T07:41:12Z","snapshot_observed_at":"2026-07-31T09:06:46.556391Z","submitted_at":"2026-05-17T07:41:12Z","title":"LongDPM: Overlap-Aware 4D Reconstruction from Long Monocular Videos","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T14:34:54.528395Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.17303"},"observation_digest":"sha256:ee6e9edb90eb069da70693814f942afd0e546cd0c10ac16ffc5d5fd7c50f1823","observation_id":"7e1b4d02-0052-404a-b899-f29cea6e22c7","resolution":{"observed_at":"2026-05-20T14:38:21.656244Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.17478","last_updated":"2026-05-17T14:34:13Z","snapshot_observed_at":"2026-08-01T05:59:23.587920Z","submitted_at":"2026-05-17T14:34:13Z","title":"Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T14:19:03.850707Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.17478"},"observation_digest":"sha256:cb71b106c78d3c3a532d4fe0cf6dc524d06bcecf627b7f3ccbc46ecd551c04b9","observation_id":"f18cd508-a9f0-449d-8deb-5c7d1652b163","resolution":{"observed_at":"2026-05-20T14:23:21.726832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.23889","last_updated":"2026-05-22T17:50:48Z","snapshot_observed_at":"2026-08-03T03:54:18.940526Z","submitted_at":"2026-05-22T17:50:48Z","title":"HorizonStream: Long-Horizon Attention for Streaming 3D Reconstruction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T04:33:48.127707Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.23889"},"observation_digest":"sha256:7535eab88ce9fbc14ffd69f21ab46598b5ba43251a746fbe51d76f87920b55b2","observation_id":"9a017dcb-d91b-4318-ad12-93d38d1f2ab9","resolution":{"observed_at":"2026-05-25T04:35:20.857053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.23892","last_updated":"2026-05-22T17:55:13Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:55:13Z","title":"Good Token Hunting: A Hitchhiker's Guide to Token Selection for Visual Geometry Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T04:27:19.553379Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.23892"},"observation_digest":"sha256:9157e715de43759d12739035aee1d5bc7930ec682137c64b4315e432f8fed385","observation_id":"ebdd55c1-679b-405a-97c7-fb6340aeec87","resolution":{"observed_at":"2026-05-25T04:30:20.363482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.23993","last_updated":"2026-05-27T23:18:48Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-17T22:46:44Z","title":"Nano World Models: A Minimalist Implementation of Future Video Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T18:52:29.675477Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.23993"},"observation_digest":"sha256:92de1e453a38e0039368008f41d6b968f2afc171654f9e5170ac389212faea9f","observation_id":"e3b18c78-4020-4d98-bf9f-b9f5d27549e3","resolution":{"observed_at":"2026-06-30T18:55:00.272355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.26519","last_updated":"2026-05-28T20:02:52Z","snapshot_observed_at":"2026-07-31T06:02:59.564737Z","submitted_at":"2026-05-26T04:03:38Z","title":"$R^3$: 3D Reconstruction via Relative Regression","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T17:56:05.704750Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.26519"},"observation_digest":"sha256:d61719098a4c968f780d777e4bffe3094385d0228a59b1dfc2851907c5f2909d","observation_id":"4661bad1-3c51-405d-977d-b84ac88d9e8e","resolution":{"observed_at":"2026-06-29T18:03:48.159649Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2605.27367","last_updated":"2026-05-29T09:30:04Z","snapshot_observed_at":"2026-07-06T23:37:08.167449Z","submitted_at":"2026-05-26T17:59:20Z","title":"SpatialBench: Is Your Spatial Foundation Model an All-Round Player?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T17:49:58.532910Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2605.27367"},"observation_digest":"sha256:36d95de4dfe03e866d244139eb164417c2137bdd9ca9f4830c63afe3a4900ab4","observation_id":"53242d8b-565d-43ec-a959-bb2b823d0c1d","resolution":{"observed_at":"2026-06-29T17:53:47.256777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2606.20562","last_updated":"2026-06-18T17:59:51Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-06-18T17:59:51Z","title":"MemoryWAM: Efficient World Action Modeling with Persistent Memory","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T17:00:43.138441Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2606.20562"},"observation_digest":"sha256:5815be33cb999be2662b2e4d424ce778002797fb8ce145d22d69f862020b983b","observation_id":"5f82d311-9c4d-4447-8406-7b8dc860deba","resolution":{"observed_at":"2026-07-04T04:29:34.838395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2607.01753","last_updated":"2026-07-02T06:10:54Z","snapshot_observed_at":"2026-07-07T00:07:19.026006Z","submitted_at":"2026-07-02T06:10:54Z","title":"The Turning Point of 3D Plant Phenotyping: 3D Foundation Models Enable Minute-to-Second Cross-Crop Reconstruction and Beyond","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-03T16:34:17.398245Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.01753"},"observation_digest":"sha256:ffa20d62253a945febcb56e7c5e04777f900e41d0c93e5e851e49052722cf392","observation_id":"fbd891ea-b21f-4608-b512-80f09aab4082","resolution":{"observed_at":"2026-07-03T16:38:39.694613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2604.14141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-08T23:55:43.003851Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","venue":"cs.CV","work_id":"10d3a5e9-9cd1-4878-974c-738dbf4ddd52","year":2026},"citing_paper":{"arxiv_id":"2607.05801","last_updated":"2026-07-14T11:59:09Z","snapshot_observed_at":"2026-08-03T20:46:46.714116Z","submitted_at":"2026-07-07T03:55:13Z","title":"TRIG: Trajectory-Rig Decoupled Metric Geometry Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T23:54:53.463703Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.05801"},"observation_digest":"sha256:3086fac3f52243d2aa5b41752d2ebf47eab68ba05fae3f95fc2350552111dd47","observation_id":"5b35a6ff-1232-4ed8-a8f9-277634bac96b","resolution":{"observed_at":"2026-07-08T23:55:43.005778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-13T01:21:15.228734Z","title":"Geometric context transformer for streaming 3d reconstruction.arXiv preprint arXiv:2604.14141, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09225","last_updated":"2026-07-10T09:18:35Z","snapshot_observed_at":"2026-08-03T17:26:56.605851Z","submitted_at":"2026-07-10T09:18:35Z","title":"Glob3R: Global Structure-from-Motion with 3D Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T01:21:15.228734Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.09225"},"observation_digest":"sha256:e135f1a8f425f29f9fda52da59c449c569c629354b5dbffd7f3dea117a63230c","observation_id":"4e816f02-9bad-47c1-bb5d-4601d6502214","resolution":{"observed_at":"2026-07-13T01:21:15.228734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-14T11:45:09.424370Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10441","last_updated":"2026-07-11T18:58:22Z","snapshot_observed_at":"2026-08-02T12:30:31.763624Z","submitted_at":"2026-07-11T18:58:22Z","title":"Context by Distinct Information: An Auditable Dirichlet-Process Working Memory for Long, Redundant Context Streams","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T11:45:09.424370Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.10441"},"observation_digest":"sha256:cbafe368659c64748acc6632afcae0799ebaed6e46c6153e7a9134f694ef3f43","observation_id":"af5e3c28-3f2e-4c9d-9cb6-426ab42c9670","resolution":{"observed_at":"2026-07-14T11:45:09.424370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-08-01T13:07:07.298312Z","title":"Geometric context transformer for streaming 3d reconstruction.arXiv preprint arXiv:2604.14141, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19228","last_updated":"2026-07-21T16:00:01Z","snapshot_observed_at":"2026-08-03T07:03:11.147217Z","submitted_at":"2026-07-21T16:00:01Z","title":"IGGT4D: Streaming 4D Instance-Grounded Geometry Transformer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T13:07:07.298312Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.19228"},"observation_digest":"sha256:ff00d12e2bdc9769981ccc1d50d14bf65b9d2d6ea873c4150664163fc5d7de76","observation_id":"ead7adfa-cd99-40d0-af7d-67c21abb7d98","resolution":{"observed_at":"2026-08-01T13:07:07.298312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14141","snapshot_observed_at":"2026-07-30T13:50:35.806186Z","title":"arXiv preprint arXiv:2604.14141 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27194","last_updated":"2026-07-29T17:58:04Z","snapshot_observed_at":"2026-08-02T00:28:26.235786Z","submitted_at":"2026-07-29T17:58:04Z","title":"VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T13:50:35.806186Z"},"links":{"cited_paper":"/paper/2604.14141","citing_paper":"/paper/2607.27194"},"observation_digest":"sha256:9543613d208ef95362b46bc5cc304e2c529ad22d975f4c3970229ba8858bb176","observation_id":"77378d27-065b-465f-a0d0-1a196f949afb","resolution":{"observed_at":"2026-07-30T13:50:35.806186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.14141/citation-record","integrity":"/paper/2604.14141/integrity","json":"/paper/2604.14141/citation-record.json","paper":"/paper/2604.14141"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Map-free visual relocalization: Metric pose relative to a single image","venue":null,"work_id":"53c3eea5-1136-48a9-8638-d4e2c7a9b126","year":2022},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:cf7b02cd45da6a8ff134101fbad5950da0d3178f739b5efb1747c40aa0c7668a","observation_id":"fa5d0d2f-8f4b-4b78-b594-80c793228afb","resolution":{"observed_at":"2026-05-18T20:22:52.685083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural rgb-d surface reconstruction","venue":null,"work_id":"9130411a-53e3-4d06-b3bd-4bd46bd3dca2","year":2022},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:a4106e6091839758a5564bd1b7c6ad58023760eaba0811154c128412581fcadb","observation_id":"60ed0500-5dd8-4736-9078-1da28a2b96ca","resolution":{"observed_at":"2026-05-18T20:22:52.688844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":"2001.10773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-07-07T22:24:11.153404Z","title":"Virtual KITTI 2","venue":"cs.CV","work_id":"c0d9c030-aa25-44e7-9cc4-72d7403f1447","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f5fcca0cf45fe883574680998515e8ae86eafc44869a26ceac8b5bfb94e7500a","observation_id":"3e4607d5-0cb8-417e-a185-5e880795e0d3","resolution":{"observed_at":"2026-05-13T16:00:33.810478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam3: An accurate open-source library for visual, visual–inertial, and multimap slam.IEEE transactions on robotics, 37(6):1874–1890","venue":null,"work_id":"f835c702-3c1b-4b2f-b99b-cd2e88536abe","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:155803548f3a8aac8771a83bd4bdcfb9c51921b033b7ed81b4ceab79bb5dc599","observation_id":"a4b55268-d88b-4faa-8aaa-290385b0a1a7","resolution":{"observed_at":"2026-05-18T20:22:52.492148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matterport3d: Learning from RGB-D data in indoor environments","venue":null,"work_id":"913ca72e-3cba-4ca1-8e4e-ec926b9bb0b5","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:d1340831cd4d8d8f427f2255b2ea8b5cbccdd00522bcdbc62e2770246620ee45","observation_id":"e1c3eea8-7ed9-4e6d-9394-e7e7adc3d0ca","resolution":{"observed_at":"2026-05-18T20:22:52.500287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Easi3r: Estimating disentangled motion from dust3r without training","venue":null,"work_id":"309f692f-788d-4a09-a904-ae16f501aede","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:a82c671c9dc99be338cad592bca95f80ea397599cb4c9be903bfb1de354c2406","observation_id":"bd7aa65e-aa96-4f00-834f-2041f13ca329","resolution":{"observed_at":"2026-05-18T20:22:52.498950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ttt3r: 3d reconstruction as test-time training.Int","venue":null,"work_id":"76b74f37-28da-4caf-9b5c-f327ee14c62d","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ecb2609ea208c52231ab777cd468bc3a25a005240cd7d2df5a1bdb267af32071","observation_id":"14107e27-2321-49c1-8bfc-4a5f76918a3b","resolution":{"observed_at":"2026-05-18T20:22:52.509012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long3r: Long sequence streaming 3d reconstruction","venue":null,"work_id":"0f7194cb-1290-446f-bdb8-2e92baef94f6","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:98122c72c868a2adc6ed9a856c4d8161d95dd4dd3853b93fb4190297ff0027e3","observation_id":"ae4f50c5-dc6b-41ef-a128-f87521db5f18","resolution":{"observed_at":"2026-05-18T20:22:52.547610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet: Richly- annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"834cda79-425c-471a-bd9d-2e478c7f7957","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0ac88fe85230411f75e8b3008e66d8cc273dcfbe13b3db44745c9d697a66b5f4","observation_id":"fbeb52d5-8550-4dae-99b7-ea816221b9c6","resolution":{"observed_at":"2026-05-18T20:22:52.540327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"e8a8a6a8-18ab-4eff-b9fc-dfce302753ec","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ae8d5462fc77a1f6ed31b03548b655f9af3b5ebf63217a1751750d729e51333b","observation_id":"f4eacae2-4795-48bb-b2cd-286e36ecb009","resolution":{"observed_at":"2026-05-18T20:22:52.353120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16443","last_updated":"2026-03-16T08:45:25Z","snapshot_observed_at":"2026-08-04T13:08:09.273271Z","submitted_at":"2025-07-22T10:39:04Z","title":"VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences","version":2},"cited_work":{"arxiv_id":"2507.16443","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.16443","snapshot_observed_at":"2026-07-10T20:17:33.710596Z","title":"VGGT-Long: Chunk it, Loop it, Align it -- Pushing VGGT's Limits on Kilometer-scale Long RGB Sequences","venue":"cs.CV","work_id":"7f673068-ecd4-4d78-b994-4ec07cae304f","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2507.16443","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:eed876d5e0211ceabe1f5e53b9dd73bf6de16e065acd48c7d7c2c1d48ae55da4","observation_id":"86902775-bced-450f-ab51-207304980f4c","resolution":{"observed_at":"2026-05-17T08:55:00.688421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superpoint: Self-supervised interest point detection and description","venue":null,"work_id":"6265c21b-fd77-4864-8034-207618d25f38","year":2018},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ed32a95ff211fde0262b721e82e1e20871c0c5293b4cf28c9e3575359db845f8","observation_id":"4dc69e25-2979-49f3-b5df-c6c86964bca5","resolution":{"observed_at":"2026-05-18T20:22:52.280075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"St4rtrack: Simultaneous 4d reconstruction and tracking in the world","venue":null,"work_id":"ad8123da-c17b-4dd4-b9bd-d423b4f622b3","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f075ff6a9d2014bac7ef62155d17c5c1096b1faa42242c482143a3ef7209c84c","observation_id":"890173ad-5d9d-4b4d-9313-73ce744b68ca","resolution":{"observed_at":"2026-05-18T20:22:52.366534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mid-air: A multi-modal dataset for extremely low altitude drone flights","venue":null,"work_id":"e452c2ac-79f6-493d-ae45-8c4cca37d01b","year":2019},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:b2d8e73d9348e2815fff433014756f4099c93c86ddf1470712f4213653b1d33e","observation_id":"1940f9a7-3cf2-4124-830a-61bcd9b69169","resolution":{"observed_at":"2026-05-18T20:22:52.253847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accurate, dense, and robust multiview stereopsis.IEEE transactions on pattern analysis and machine intelligence, 32(8):1362–1376","venue":null,"work_id":"bee4cc5d-16b6-49ce-953d-a5f3f7ff5f08","year":2009},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:28cb84ae3a3f3cc429f66c4d258bbd245dfed8deb4648c53d48e81f114730a9f","observation_id":"071fa672-c65d-43b8-a5ab-2cfaa74204a1","resolution":{"observed_at":"2026-05-18T20:22:52.371771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kubric: A scalable dataset generator","venue":null,"work_id":"e1d048d1-b2ca-4651-a095-bed12cb50840","year":2022},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:5d86904d70d53600beba57adf712c9f922e0bba7763df3a119d1e5cb3718f398","observation_id":"e2f749e9-ca34-45aa-9c83-2b9253fef0d3","resolution":{"observed_at":"2026-05-18T20:22:52.511023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LRM: Large reconstruction model for single image to 3D","venue":null,"work_id":"6fdcb9ad-21cf-4938-b6c0-a454fb734e5f","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:cbb4ec1aeec21498ae5c4e9d02ccedb133265753b40646bd907c58ca2a5a159a","observation_id":"b418b36c-28a0-408a-876f-fd02119ba3b3","resolution":{"observed_at":"2026-05-18T20:22:52.522539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:6cb1c92854881dc04fb96bebda7298f5155d142ac7ebe4fddd7cd2ddf8f38604","observation_id":"14a050be-e210-4603-9078-99cfea916c78","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepmvs: Learning multi-view stereopsis","venue":null,"work_id":"ab222690-9484-4e04-b91c-40a209d84e3e","year":2018},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:b03af1b7351bf17cce5ea0c3cf6cb0a0b78f05c17f035e4ab8d44a7bf38f9048","observation_id":"ef7889d7-c1dd-4110-bc29-f53ae81957cb","resolution":{"observed_at":"2026-05-18T20:22:52.681024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":"2309.14509","doi":"10.48550/arxiv.2309.14509","metadata_source":"pith","pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","venue":"cs.LG","work_id":"bb119d0b-c7f0-412a-a426-f74bd6949a51","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e3727517efc20871b9701dad06af9918a8fb5e60417971434a478efb2ced6521","observation_id":"99b750b4-ed1f-4641-8eab-75a80d4fcb13","resolution":{"observed_at":"2026-05-13T01:07:22.650116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pow3r: Empowering unconstrained 3d reconstruction with camera and scene priors","venue":null,"work_id":"7d29fb3a-31ad-4837-8e59-59126b7be4f2","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:bfe177e5ed751a423ddbe4e358e1df0a99f294593768d2b4a23ce019ff2b8100","observation_id":"49193a2f-5cb3-4786-91a9-41a9ac91f502","resolution":{"observed_at":"2026-05-18T20:22:52.362855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anysplat: Feed-forward 3d gaussian splatting from unconstrained views.ACM Trans","venue":null,"work_id":"c6281daa-02c3-4898-a606-5992d1c9b93b","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:63e35b9adb82383f97a729b3641bb657774462e6aca07771f6c7b05f16e2fa3d","observation_id":"bd29b91c-8012-43ea-acdd-54f582dd39e9","resolution":{"observed_at":"2026-05-18T20:22:52.265720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Barron, Noah Snavely, and Aleksander Hoły´nski","venue":null,"work_id":"3c188fa0-f75b-4263-b8b8-063816deb4ed","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:7b6f8dedceb8664d2a8dbf893569ee42a612060973f0d039787800b99c658368","observation_id":"af0b075e-5846-4cc4-b11d-d728ec872970","resolution":{"observed_at":"2026-05-18T20:22:52.514746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stereo4D: Learning How Things Move in 3D from Internet Stereo Videos","venue":null,"work_id":"563ca247-1844-4418-bd7e-0bbb55dc9ead","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:377849ef790eff5035434cf996f847c595f2a4934f3c95e299d67df76b464579","observation_id":"94fee29c-de4c-4ac2-bf44-77cef8699614","resolution":{"observed_at":"2026-05-18T20:22:52.293105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.13414","last_updated":"2026-01-23T18:59:33Z","snapshot_observed_at":"2026-07-06T22:30:07.020487Z","submitted_at":"2025-09-16T18:00:14Z","title":"MapAnything: Universal Feed-Forward Metric 3D Reconstruction","version":3},"cited_work":{"arxiv_id":"2509.13414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.13414","snapshot_observed_at":"2026-07-09T18:46:26.573653Z","title":"MapAnything: Universal Feed-Forward Metric 3D Reconstruction","venue":"cs.CV","work_id":"cb742a0f-0648-4cb0-904b-180184987f6b","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2509.13414","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:4bdb27b57c4a8bc85f064cb0e1faf7efda247e5a60de83412ec2d76d9801ee45","observation_id":"e5c26eaa-33bc-4e8f-a0f6-4423c39397c4","resolution":{"observed_at":"2026-05-12T11:06:15.374425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tanks and temples: Benchmarking large-scale scene reconstruction.ACM Trans","venue":null,"work_id":"84de7cc4-97cb-4e4b-8917-f8083468ddde","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:fae99b359e365673a3061651f5d8630096f20a20f1ed7a20f20a458c130a01f2","observation_id":"3a8f90fc-d3f8-4f99-b6de-90b9695350a9","resolution":{"observed_at":"2026-05-18T20:22:52.338792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.423236Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"4286b247-177a-4d5f-aa88-c483f25a7dac","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:6eec914c8effe7f3b0a138a19221a9e2d59171c70628c31132440f3ec15da1cd","observation_id":"14c024c1-641e-4754-aae1-9f273e816e96","resolution":{"observed_at":"2026-05-18T20:22:52.366121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"STream3R: Scalable sequential 3D reconstruction with causal transformer","venue":null,"work_id":"eac06cbb-c095-48b6-a1c1-7acf377c6396","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e0c5e4d1fff0d86bb9de01358edfa008e164f0839aab1d75095bb4289a08f76b","observation_id":"b5ddc2f3-e762-4dc4-995f-821cbe604469","resolution":{"observed_at":"2026-05-18T20:22:52.369148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instant3d: Fast text-to-3D with sparse-view generation and large reconstruction model","venue":null,"work_id":"22f24c14-0e76-4076-951b-20d17dce2466","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:6c3f86ea9e56fba168a116114c6bd1c1f6d8294abf51afbd863b2fe87a82d9ed","observation_id":"472facde-5fb5-41c3-ae0b-f86539a3932d","resolution":{"observed_at":"2026-05-18T20:22:52.544307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matrixcity: A large-scale city dataset for city-scale neural rendering and beyond","venue":null,"work_id":"d6ce6639-5f92-4061-98d8-30518d2db16d","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:114955b97a6ab0feb3ae45a571b19f15846d9c2445a5b892dc8915f4d2477101","observation_id":"437d4197-d327-4028-b8bf-fb2332227875","resolution":{"observed_at":"2026-05-18T20:22:52.493934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Megadepth: Learning single-view depth prediction from internet photos","venue":null,"work_id":"142ed79c-84bb-419a-a551-c30dd77c1a7a","year":2041},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:60e2e988b617dc7ddfa569a9b6e28e19c1fcf0d4bbcdc1cacab0a6113bb1f87f","observation_id":"0584824d-3e7c-4514-9ce8-2b12453346d6","resolution":{"observed_at":"2026-05-18T20:22:52.314296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Megasam: Accurate, fast and robust structure and motion from casual dynamic videos","venue":null,"work_id":"d98b9d97-0a55-4ef3-a8e5-c0d9df5d2d18","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:cd6702bdc4613f666b449fb936306e166dadf3879856632d4abd389ce0e16240","observation_id":"7e8ec462-55e3-4237-8af3-ca0bd2fac4c0","resolution":{"observed_at":"2026-05-18T20:22:52.543936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wint3r: Window-based streaming reconstruction with camera token pool","venue":null,"work_id":"31912219-26d7-4553-bd7b-c5887e1ecb54","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:1b1558448da59b0cf506a5fa997d1f5f4a46de78f58888399bf932cfbb945498","observation_id":"e5f3ce6e-1af7-4dc1-8b9e-cb140ec7e3b2","resolution":{"observed_at":"2026-05-18T20:22:52.622058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Torchtitan: One-stop pytorch native solution for production ready LLM pretraining","venue":null,"work_id":"fa200eb2-3ee5-481b-be68-d64879f5f36c","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f38852eee2cfc3e142b4e2ee29f20c4214f571661a399e6f84ed2be19310faa5","observation_id":"115ef8c4-3a48-4d1d-9bf7-2070a2dd7077","resolution":{"observed_at":"2026-05-18T20:22:52.667594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Trans","venue":null,"work_id":"b1799303-7e35-4a77-8f8a-1bc634c02a70","year":2022},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:407fcec6c18be9971720b853272f90e57fbe1b98c2612a7a0749d64567c309cf","observation_id":"93644598-0195-4e50-a79f-055db9809c9d","resolution":{"observed_at":"2026-05-18T20:22:52.671146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longsplat: Robust unposed 3d gaussian splatting for casual long videos","venue":null,"work_id":"76c464f5-0e32-4550-8229-76b86d04568d","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:81d84d609014981c27c829a468b75481af4acabfc27d0dc3f617dfce582e2b50","observation_id":"17e7db54-78ab-4f23-a116-3033904c1f78","resolution":{"observed_at":"2026-05-18T20:22:52.551558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e58c2cc5409ce333840255878d5cb95fbdd16795c92b610df6d01cf638535db7","observation_id":"b2f72a62-b84b-412b-bdb8-94c781572ca9","resolution":{"observed_at":"2026-05-11T02:07:59.495600Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":"822cb28b-bc2b-4389-8ea2-4e8fa6a08e6c","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ac22b67c10f2e898acc042a37e415d156ea54cfe32ffdf64ca184f94ed7fa832","observation_id":"70c0bf23-4991-4eb1-8e61-fe7765cbc2dd","resolution":{"observed_at":"2026-05-18T20:22:52.454947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Slam3r: Real-time dense scene reconstruction from monocular rgb videos","venue":null,"work_id":"5bce8075-0faf-4187-91b2-b1138986440f","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:57d1ea821cd2487aaf5f233494d5f76c2f31dddc788537ecb3b14e1bba26eb70","observation_id":"9f9278f9-a2c4-429c-b47e-1b9bf8fe9942","resolution":{"observed_at":"2026-05-18T20:22:52.540743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align3r: Aligned monocular depth estimation for dynamic videos","venue":null,"work_id":"a5d32a99-4ffc-4f73-983b-6ba5b92bcc0a","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:67153b90f4985c60da86a0f4e0b4778292f8275f8950acb32c4204d3aa47385f","observation_id":"536c4bec-9984-48e0-b655-8141915db963","resolution":{"observed_at":"2026-05-18T20:22:52.554984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matrix3d: Large photogrammetry model all-in-one","venue":null,"work_id":"72e2120a-4088-42bc-836d-9d7a5184fef2","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:6c664d284c95263f4132f57435770e41e2bc5cd4c1061ec61bbe657cbc10d2b3","observation_id":"5eea0d83-2315-465b-91e5-6f21572d7d4b","resolution":{"observed_at":"2026-05-18T20:22:52.536650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vggt-slam: Dense rgb slam optimized on the sl (4) manifold.Adv","venue":null,"work_id":"f7a69f8e-073f-4302-b999-ed081cd02311","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:afb20a09cb21282718132d4064de8bda297f98fba9b03ff7c2fd2f760f029fdb","observation_id":"c1c234d9-e0b4-4043-89b1-f28d311b2399","resolution":{"observed_at":"2026-05-18T20:22:52.407826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scenenet rgb-d: Can 5m synthetic images beat generic imagenet pre-training on indoor segmentation? InInt","venue":null,"work_id":"feb0ef02-1815-4033-931a-98dbcac2ddbb","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0aefffb7bf4538e7fa8c2d83b64c02e5ff5cd86199d372540c5be78a1eba75db","observation_id":"612da0d6-35a0-40b8-9bec-95849f764d78","resolution":{"observed_at":"2026-05-18T20:22:52.360555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam: A versatile and accurate monocular slam system","venue":null,"work_id":"8bbe3a21-e49e-4356-a9b5-b8b8a1dbb325","year":2015},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e5b39b95ef4dcaa0751b4b7d723d2ff91b7bc47235e1bb298a7daecdb8d4dc5b","observation_id":"a2d4d9b0-81b6-4414-844c-795528f57de6","resolution":{"observed_at":"2026-05-18T20:22:52.645134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam2: An open-source slam system for monocular, stereo, and rgb-d cameras.IEEE transactions on robotics, 33(5):1255–1262","venue":null,"work_id":"b8e1c6a6-f1bd-4df7-bfe8-8f17d5183537","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:c880d3e137bdb10b6f0600eeea2978b07dd2e2170ea5d1794e3420db71a767a0","observation_id":"d32c8725-923e-48d4-802b-b3b6b4c93796","resolution":{"observed_at":"2026-05-18T20:22:52.650748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mast3r-slam: Real-time dense slam with 3d reconstruction priors","venue":null,"work_id":"3068fa4b-9355-4e9b-82b4-58827f83914f","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e2f4f985990b0ebf33cb8a5faaf537bf57817c197897f600cc9fe60568f5c2d2","observation_id":"e349d7b0-8c82-4de1-aa2a-a0de5bdbeace","resolution":{"observed_at":"2026-05-18T20:22:52.632199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c5429db4-2c7c-4fe4-b82d-09edee28c494","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e20290bc43a6c77066bb1247f7dceb489f3037cf59636a19e382f79cbb1bb867","observation_id":"00155a2a-767b-4d69-a8a4-46c57573844b","resolution":{"observed_at":"2026-05-18T20:22:52.662044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Global structure-from-motion revisited","venue":null,"work_id":"bafe7b68-4d51-4d17-a7a4-d1ffb62d1166","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:310de9eb327d7b8e4ceb693ddd6e4c38eeb0dbecc863d5d786cbdadfba833808","observation_id":"e52ac131-f8b0-4a28-9886-c7f94ea04ab2","resolution":{"observed_at":"2026-05-18T20:22:52.395159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aria digital twin: A new benchmark dataset for egocentric 3d machine perception","venue":null,"work_id":"22a19c8a-142b-4995-9b3e-f9c9e3336ab2","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0bf1c624e2080095584e522bdfa6babfdac4ee1231cc8984ae43227b0826add5","observation_id":"bbbc1551-7a87-4f30-a0ca-5afa1d229c31","resolution":{"observed_at":"2026-05-18T20:22:52.475962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tartanground: A large-scale dataset for ground robot perception and navigation","venue":null,"work_id":"2a119754-9a1b-4882-b648-dc57d49337ca","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:97925f904eb9d1b8c2ebcca912f3f7078da2cb716b795451f7440b055a9a42f8","observation_id":"76f175ef-ef9b-45b1-a59f-bd965913b604","resolution":{"observed_at":"2026-05-18T20:22:52.450885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chang, Manolis Savva, Yili Zhao, and Dhruv Batra","venue":null,"work_id":"01507081-bf4f-49ab-9355-303a60cc9774","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:12abc32dea1152e1b6f376e636beaace7d032ce532540e841050dd662cd77299","observation_id":"492d794c-0423-4d05-9471-f426a4a8c1aa","resolution":{"observed_at":"2026-05-18T20:22:52.525564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Common objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"273b515a-a981-49f3-8f47-19d1c52049b2","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:63f3f52da22bc3e33c2f078e3bc472d2025bf9eae0237fbb55ba26bd354fa584","observation_id":"09b2add1-59b6-4812-93a7-5dbc9faf6997","resolution":{"observed_at":"2026-05-18T20:22:52.516085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding","venue":null,"work_id":"7967d05e-ea2e-4137-afe2-1f07d6b5fe07","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:dc952d64d67e0318eaefddace2bcda963b792dbf47a68c5915cf047af1857185","observation_id":"9f934fbe-4edc-4dff-bc94-e40bbc1cafde","resolution":{"observed_at":"2026-05-18T20:22:52.524744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superglue: Learning feature matching with graph neural networks","venue":null,"work_id":"93950909-62ef-49f9-a2dd-5e6881ddb06e","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:aff6b62f79026405dcc34a5fcdc424fdde7d7ab0f03635f77ab06c8de511d7e5","observation_id":"4f89c0d1-2ace-4acd-b04f-bb9557673013","resolution":{"observed_at":"2026-05-18T20:22:52.528875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Habitat: A platform for embodied ai research","venue":null,"work_id":"ee7a0983-919f-4fbc-961a-ae125a7754c0","year":2019},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0a8ef980e25738e810bb0e45abd16786cb3b903884c9d96b5f4f0309c1329224","observation_id":"242784e4-874a-4f22-b321-47b50837bfcb","resolution":{"observed_at":"2026-05-18T20:22:52.537129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:20:44.946254Z","title":"Structure-from-motion revisited","venue":null,"work_id":"9b70315d-ed18-4e77-814e-814b02ca1ee4","year":2016},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:47cdb1d9d5cf9c277085eb13c781a001c4e2719e947d8bbc72e87e6932e10271","observation_id":"3c53b42f-644f-428f-8f58-cee208ef1aa1","resolution":{"observed_at":"2026-05-18T20:22:52.502431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixelwise view selection for unstructured multi-view stereo","venue":null,"work_id":"7a926ec6-55d8-4d02-adcb-8939912815fb","year":2016},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:c4cd880d66456e6dd130afad343a46f2211be4f337406b4c578844231eb4e5af","observation_id":"8072b2b3-ed17-4e01-a7ba-e4e449c72e9f","resolution":{"observed_at":"2026-05-18T20:22:52.505716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A multi-view stereo benchmark with high-resolution images and multi-camera videos","venue":null,"work_id":"a24d39ae-8a4d-4525-9d4c-35841e5185ec","year":2017},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:1333801efe8398b20adf29646a3d5f0ef68dd4f4b99f5342500cf4f424e64828","observation_id":"9aca7d24-df72-4a03-971d-679f3ce819cd","resolution":{"observed_at":"2026-05-18T20:22:52.656576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02560","last_updated":"2025-11-09T15:12:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-02T17:54:21Z","title":"FastVGGT: Training-Free Acceleration of Visual Geometry Transformer","version":2},"cited_work":{"arxiv_id":"2509.02560","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.02560","snapshot_observed_at":"2026-07-03T22:39:01.299789Z","title":"FastVGGT: Training-Free Acceleration of Visual Geometry Transformer","venue":"cs.CV","work_id":"bd4c8c8e-568b-4332-93af-99407ca3873a","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2509.02560","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:13ea5ba1d3495e5ad893a56ff45342970a42e0281b11c0e4b58cd5821ef203f1","observation_id":"baf39580-8086-4ceb-b39c-9f80a2f9e267","resolution":{"observed_at":"2026-05-15T23:36:07.097348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene coordinate regression forests for camera relocalization in rgb-d images","venue":null,"work_id":"0247604a-ba29-458d-8ee3-c2c1e3b08559","year":2013},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f274488d43f1606f2be77a02e51bae00042d1a1e9cc6683762fe5560dc7652f4","observation_id":"134d49cd-41b8-4425-ad1d-8d806b4703e4","resolution":{"observed_at":"2026-05-18T20:22:52.548041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13912","last_updated":"2024-08-27T19:06:57Z","snapshot_observed_at":"2026-08-02T00:23:53.513546Z","submitted_at":"2024-08-25T18:27:20Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","version":2},"cited_work":{"arxiv_id":"2408.13912","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13912","snapshot_observed_at":"2026-07-04T13:49:51.641963Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","venue":"cs.CV","work_id":"3950c9e4-deb4-4280-ac8f-08754c3ccf34","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2408.13912","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:e0bcd4f65ddfa52a2e37548e5f631fb9775a2fb35d93813fea679b6ed5cb1ac2","observation_id":"d45ae004-589b-4f8b-aebc-72603eb84df2","resolution":{"observed_at":"2026-05-17T01:16:06.916611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seitz, and Richard Szeliski","venue":null,"work_id":"6ed7d82e-b8f3-43d8-991c-e187a785637c","year":2006},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0125649025ee0b0816e626324034f10c1ccc4ca6d227aa592d139ae2679cde2b","observation_id":"1ac3dbe7-13f8-40da-8cc5-2ad12c32c6a5","resolution":{"observed_at":"2026-05-18T20:22:52.600552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":"1906.05797","doi":"10.48550/arxiv.1906.05797","metadata_source":"pith","pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","venue":"cs.CV","work_id":"8145b3bf-a202-46d8-a3bc-fad366dd5d4a","year":2019},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:259b55f7d2ffa1aa0fe52cbcc5d62aece413bdc4e978ea9822b2f121732125fb","observation_id":"f37778c6-1b97-4f64-8d86-165250774dd9","resolution":{"observed_at":"2026-05-12T16:34:29.536218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T17:23:43.390569+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T17:23:43.390569+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic point maps: A versatile representation for dynamic 3d reconstruction","venue":null,"work_id":"bd52c0f1-f64f-46b3-aed2-115ba3873ce7","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:94e04407fe84689a32dfe59eafc216427e4ee527ca3d0e5a3ab77996b1bf092a","observation_id":"bc526bdf-8111-426e-abdf-0b1e90f06eda","resolution":{"observed_at":"2026-05-18T20:22:52.503765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:35:54.628412Z","title":"Loftr: Detector-free local feature matching with transformers","venue":null,"work_id":"1c5fc292-d33c-4a09-8e95-3514d14ec363","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0a663d8d6e08ab278f486b70bfc78cb2c417c7d3a0d4577c5cb572d6cb1fb11c","observation_id":"9495bfd1-229c-4fd1-8f75-5c192bd69e5e","resolution":{"observed_at":"2026-05-18T20:22:52.507260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":"594af491-5546-4ad5-a53e-9c8f9c9e0a39","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:05b3d15929cf6a0b0a12b948748815f309923ef02907c9b0b397ef0b8e834670","observation_id":"f762456f-f508-45b4-9cfa-be47dd98366c","resolution":{"observed_at":"2026-05-18T20:22:52.479846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LGM: Large multi-view gaussian model for high-resolution 3D content creation","venue":null,"work_id":"b9b3054c-f754-4b48-8590-dd77d55b5ae8","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:b941411a2b2055b1617ee631bf07b9f4682ff10267c35c802e5f36f0e1f70c8f","observation_id":"2390b199-0064-4b9a-97c6-404cb81f6156","resolution":{"observed_at":"2026-05-18T20:22:52.518147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The oxford spires dataset: Benchmarking large-scale lidar-visual localisation, reconstruction and radiance field methods.International Journal of Robotics Research","venue":null,"work_id":"42ff0548-0371-4d13-8a89-17afb5697af9","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:95b704a8033fabfaf42c4b638892261e5e301c88d41f1575b12482d033547829","observation_id":"88624e12-a687-4d07-a6fe-c3edfae61a44","resolution":{"observed_at":"2026-05-18T20:22:52.674789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Droid-slam: Deep visual slam for monocular, stereo, and rgb-d cameras.Adv","venue":null,"work_id":"8b414efe-a41b-421b-b097-3a7f39b0a201","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:bc70a0602c7f3aaa9f5d5edf2270bd262169b7636092046542fa94f4fb7badb5","observation_id":"a9300d73-0121-4391-9480-f01e1c4809d6","resolution":{"observed_at":"2026-05-18T20:22:52.445921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smd-nets: Stereo mixture density networks","venue":null,"work_id":"ce735bb2-d014-410c-a3c0-6daa456ab31c","year":2021},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:4803b5e864d4514f3747e1bf4605c90e46abaacde115969b7915abd6004a9f35","observation_id":"d037963a-2697-40a1-98e6-47d3748b6d78","resolution":{"observed_at":"2026-05-18T20:22:52.455434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Least-squares estimation of transformation parameters between two point patterns.IEEE Trans","venue":null,"work_id":"4df64ff6-ad0c-46b5-9fa9-8db25d3594cb","year":2002},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:c9037e6c2c137ce036cf3ad96c016a8d790bf15cb38895559de982725eb2a8c3","observation_id":"2aaa984e-687c-4b19-8475-01d1aa63a182","resolution":{"observed_at":"2026-05-18T20:22:52.617837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f7cef75ec0e40b107b261e8c89ee5a41b9856fafc6e027db32701297693ade2b","observation_id":"210673f1-0c4d-4927-a0b5-a5fa9c504e54","resolution":{"observed_at":"2026-05-10T13:55:28.766457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d reconstruction with spatial memory","venue":null,"work_id":"ef04f2c6-49de-4266-8509-ca15df9821d6","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:aabf894527f6380da7085814152d16ed4bf3bcd2b60169755474425edc17d147","observation_id":"59020b42-f109-4cdd-9755-349625214790","resolution":{"observed_at":"2026-05-18T20:22:52.485397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialvid: A large-scale video dataset with spatial annotations","venue":null,"work_id":"a97cfda6-8375-40ab-93de-e702de026b91","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:6a7b74c6f93814e2a06d20b6578eadb219f810d738d4d80534cb5f9dae2a3160","observation_id":"f4251df6-839d-4d57-b87a-39c63cfcb98c","resolution":{"observed_at":"2026-05-18T20:22:52.462854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":"c43e1c10-ef01-4724-8d8d-24191aa49338","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:64781781fb91431380857fe36304185288414062f0a2c0efacd784f6c5d09a6a","observation_id":"94dc25d2-6655-44c7-9c41-b19456d41da7","resolution":{"observed_at":"2026-05-18T20:22:52.420781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vggsfm: Visual geometry grounded deep structure from motion","venue":null,"work_id":"cde89c2b-650c-44a9-b818-ab61aae930b2","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:5cbc6171477231175ff719f189dc306c7b7572023505b5abf74b49369d378aaa","observation_id":"51775605-29a5-460b-a7fe-db97863a716d","resolution":{"observed_at":"2026-05-18T20:22:52.425421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow-motion and depth network for monocular stereo and beyond.IEEE Robotics and Automation Letters, 5(2):3307–3314","venue":null,"work_id":"c88bffbd-7d4e-4787-a2d4-209e02ddff69","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ce6524a0336f800d37d11fde7658e543fd684be4d8d28029fc8170e0ce45e341","observation_id":"9035b9ee-3c10-4e73-b4c4-2df251e9ee23","resolution":{"observed_at":"2026-05-18T20:22:52.414026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PF-LRM: Pose-free large reconstruction model for joint pose and shape prediction","venue":null,"work_id":"97e126cb-6e27-431f-a864-109953d9ffdd","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:8cd2a6cd36cfa2a2b7a49dc887c72163805188937cd650ce22b73c04f2e6ec70","observation_id":"3567a891-aa06-48a0-a997-5c10e84a98e5","resolution":{"observed_at":"2026-05-18T20:22:52.607342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efros, and Angjoo Kanazawa","venue":null,"work_id":"b4c66f01-4b91-42eb-b09e-adfc02373782","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:049dd6afe0a67b376a50726c41f89f16d9e0e2281e17b95562181450259fa56f","observation_id":"68488113-5386-436b-8cdf-6f4291ed10e2","resolution":{"observed_at":"2026-05-18T20:22:52.611105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous 3d perception model with persistent state","venue":null,"work_id":"aeef13d0-c814-488f-8a61-6eab53c105ae","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:94605ea60cfc6ae90fae742783c1002a9db5ca330ea98c9b4c81d9a16c1900f0","observation_id":"d1960e2b-743e-44c0-8c82-dec43d3bbbe4","resolution":{"observed_at":"2026-05-18T20:22:52.628785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":"79781aa0-4025-433e-bb78-2d4b9171bd72","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:0eaf1a240983c000e90e198b63146d25c38a1a6890b039892e17032778b755a3","observation_id":"ab53510c-e8cc-472f-af04-93fc5f57e35d","resolution":{"observed_at":"2026-05-18T20:22:52.641951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tartanair: A dataset to push the limits of visual slam","venue":null,"work_id":"3f6cabe7-6fdd-4553-96ff-9f9f85186f60","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:b64dcee5ae22bf2fbcf1f94e9effeb4b82c80c56c8ea31326b824de169b661fb","observation_id":"418d1a20-5439-4b2a-89ae-12f20a0d1bc8","resolution":{"observed_at":"2026-05-18T20:22:52.397181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":"2507.13347","doi":"10.48550/arxiv.2507.13347","metadata_source":"pith","pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","venue":"cs.CV","work_id":"8ab9cfd6-a60d-45e6-a572-9b4db82b8527","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:50c95c8736016670576b9cab088cb2b68c0c6c2b7f396d153ad5bef03df73da3","observation_id":"208934b4-9125-48d6-bd46-6102b51a06cb","resolution":{"observed_at":"2026-05-12T17:14:22.853753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zamir, Zhiyang He, Alexander Sax, Jitendra Malik, and Silvio Savarese","venue":null,"work_id":"b9349ea7-49fe-4e7b-bafc-ea1569ca239b","year":2018},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:19ac2e9fb485e7fbf1a24d3a9e9cf600e80ccfdc5cf1c817ff7e431a8cc3ec6a","observation_id":"70c95b65-352f-4507-97a2-65d2647dde87","resolution":{"observed_at":"2026-05-18T20:22:52.590027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rgbd objects in the wild: Scaling real-world 3d object learning from rgb-d videos","venue":null,"work_id":"82aaea7e-1566-4c71-9e4f-77313d5c4bac","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:7731b0bc42a74411ce574b57247374477f5bba47821927fca673c5bd3bd5d9d2","observation_id":"2e13e931-1bdc-4df5-b041-2414af00f1c4","resolution":{"observed_at":"2026-05-18T20:22:52.593883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialtrackerv2: 3d point tracking made easy","venue":null,"work_id":"8a8e0fd2-c41c-44da-a951-f0707d0eef78","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:a9d846ea1a3f8b60a5b7065c16dc99ab2507b3512a6d73e6c2f5035b42839388","observation_id":"281a1098-a2f1-4742-9ec9-23fc85d9d61b","resolution":{"observed_at":"2026-05-18T20:22:52.432014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scal3r: Scalable test-time training for large-scale 3d reconstruction","venue":null,"work_id":"9f48aa8b-8b3b-4540-b055-cfa0d9f810e3","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:ef33230e76fd5a5427f55328b7b27a2e30e7b64b7c7ea9b73276117130e112b8","observation_id":"d928b326-d492-4b2b-a6cc-69957c8e8d57","resolution":{"observed_at":"2026-05-18T20:22:52.581976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GRM: Large gaussian reconstruction model for efficient 3d reconstruction and generation","venue":null,"work_id":"a7140058-392d-45de-85b4-4f82f3e98277","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:fb83d6f4b5f379f28938d21ddbaef9466ac2f2dbe37a2e4c826488f6197771d5","observation_id":"f75b2d54-32d6-4ec6-95cd-dcf1cb18d0bf","resolution":{"observed_at":"2026-05-18T20:22:52.550850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DMV3D: Denoising multi-view diffusion using 3D large reconstruction model","venue":null,"work_id":"53c3b4b2-dee7-4bd1-8f3d-78998b8f67f7","year":2024},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:381017084af29ca00aff84b5fd857a02049284567ed9b3e5f124df5becac90ad","observation_id":"06268585-ffa8-483d-978b-1f5fb9e3ab5e","resolution":{"observed_at":"2026-05-18T20:22:52.578058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast3r: Towards 3d reconstruction of 1000+ images in one forward pass","venue":null,"work_id":"577c221d-e253-4638-981d-fb83c926b71a","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:c6f11bc15cab4b3ec58c411fa057a1ff86b0f41d83fa5c8ec0cd3ddcc03f8151","observation_id":"0940ae0e-e58c-47e9-813e-03f46a52e41f","resolution":{"observed_at":"2026-05-18T20:22:52.597482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":"705e199a-f062-428d-9abc-b2708c51c914","year":2018},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:b2d8a45e40cae2b3b16442e281ef2009505187b535ed73a6f1d4461f490a35e1","observation_id":"9f49bd1c-1b67-4e9c-abce-49415d7056e1","resolution":{"observed_at":"2026-05-18T20:22:52.570497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent mvsnet for high-resolution multi-view stereo depth inference","venue":null,"work_id":"27716ca6-b999-4fd8-8732-3b1b5a79a90a","year":2019},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:5e8e10c708ae864be171d75b998a815f328fadb802b2c0e227053e8eaf975b20","observation_id":"4c5742a9-a0dd-4f63-920e-a840aab4c3ef","resolution":{"observed_at":"2026-05-18T20:22:52.404023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blendedmvs: A large-scale dataset for generalized multi-view stereo networks","venue":null,"work_id":"14fa75a8-81b3-4b72-a53d-71b71dd8edbb","year":2020},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:3daddc62f1c3cc037a682a88aea8553787a33f5e963f6fe315e5f7d205fa3815","observation_id":"b3b2e18d-955f-4290-b411-6134acdb6590","resolution":{"observed_at":"2026-05-18T20:22:52.416599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No pose, no problem: Surprisingly simple 3d gaussian splats from sparse unposed images","venue":null,"work_id":"d6687666-0a5b-405e-9b7c-ec99cd0068ba","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:88db4585befea3a3c85efad6f595aff20e4ec595eb9bd7ceef0dd0138308e6f6","observation_id":"92ce4e80-d1f1-49a0-a6bf-068f693bb944","resolution":{"observed_at":"2026-05-18T20:22:52.562873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01005","last_updated":"2025-04-21T20:10:11Z","snapshot_observed_at":"2026-07-06T20:15:36.280948Z","submitted_at":"2025-01-02T02:02:20Z","title":"FlashInfer: Efficient and Customizable Attention Engine for LLM Inference Serving","version":2},"cited_work":{"arxiv_id":"2501.01005","doi":"10.48550/arxiv.2501.01005","metadata_source":"pith","pith_arxiv_id":"2501.01005","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FlashInfer: Efficient and Customizable Attention Engine for LLM Inference Serving","venue":"cs.DC","work_id":"a153885b-2460-4177-9053-8d0011adfcb9","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2501.01005","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:1092543d5224942c33be19da222d0dccbc8c7cf22f0d0b0e79484b9c10ad2164","observation_id":"7ce282e1-d508-4f0f-97e1-20ef00eac9ab","resolution":{"observed_at":"2026-05-16T13:26:34.840430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"902d3593-31d3-4d83-8b04-1af9502fb3af","year":2023},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:90b6111595c2906c1966f076b54d960236ecc19ed93d19961a089b3d67ac458f","observation_id":"f09e2938-85c2-4550-9818-4f2265268b20","resolution":{"observed_at":"2026-05-18T20:22:52.467183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.02281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:17:09.613803Z","title":"InfiniteVGGT: Visual geometry grounded transformer for endless streams","venue":null,"work_id":"2534bd49-88ba-4e9b-9574-4d3c88f540db","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:bf6fb24012438171e7d3eb5f53d2688749d528a15746cb0c44ee697baf1398be","observation_id":"911ff603-7502-41f3-9029-6548f5db47e3","resolution":{"observed_at":"2026-05-10T13:55:28.739497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monst3r: A simple approach for estimating geometry in the presence of motion","venue":null,"work_id":"75c37364-e1a2-452f-81b6-e8500112f3da","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:074ebcdfdf6f5e91fae179b59348e1d06c04a9c04aa41f7de55dfb7271010797","observation_id":"dda3a2d2-fddd-416a-aec0-52c171821dc0","resolution":{"observed_at":"2026-05-18T20:22:52.443649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.03269","last_updated":"2026-04-27T16:46:35Z","snapshot_observed_at":"2026-07-06T22:47:41.997192Z","submitted_at":"2026-03-03T18:55:37Z","title":"LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory","version":2},"cited_work":{"arxiv_id":"2603.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.03269","snapshot_observed_at":"2026-07-04T06:49:37.496039Z","title":"LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory","venue":"cs.CV","work_id":"cf6731b8-f718-41ca-b15e-a88e301684c9","year":2026},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2603.03269","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:5cad3a7139389bf8a71bede6749c0188bd687297af3c9509f0f8e4161a454251","observation_id":"1b4820e7-8fad-4ec5-a02e-41a3b4f96c6d","resolution":{"observed_at":"2026-05-10T13:55:28.743882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flare: Feed-forward geometry, appearance and camera estimation from uncalibrated sparse views","venue":null,"work_id":"ebcb58bd-c3a7-4ca1-9d51-d0d422332db5","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:cf096d09fc138478053d33a3f5dd6af06edbdadaaec83da2f38b3ee6a9b59ffe","observation_id":"40b5cd4a-ece8-4812-a00f-8c53b79be863","resolution":{"observed_at":"2026-05-18T20:22:52.559337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":13,"verified_fuzzy":85},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 20 inbound Pith citation observations for arXiv:2604.14141."}