{"as_of":"2026-08-21T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1bc62d487f797e3256f034a3576135ae2db65fd880faa2423c1848d50f8e6d7","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:25:14.207952Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:51:02.218012Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:48:02.557709Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"cited_work":{"arxiv_id":"2602.14021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.14021","snapshot_observed_at":"2026-07-28T02:22:27.700778Z","title":"Flow4R: Unifying 4D reconstruction and tracking with scene flow","venue":null,"work_id":"3347e703-a8ff-40c1-adf2-92d6ad9b2cf1","year":2026},"citing_paper":{"arxiv_id":"2605.08000","last_updated":"2026-05-08T16:56:24Z","snapshot_observed_at":"2026-08-02T17:13:51.758028Z","submitted_at":"2026-05-08T16:56:24Z","title":"Rethinking Dense Optical Flow without Test-Time Scaling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T03:00:46.735360Z"},"links":{"cited_paper":"/paper/2602.14021","citing_paper":"/paper/2605.08000"},"observation_digest":"sha256:40926971a8c8ce8e489120816dbba6e66e2e2adaf99244947ca306c276de0d95","observation_id":"e2d2fb40-1905-433f-a687-b8b3a06329a1","resolution":{"observed_at":"2026-07-28T02:22:27.700778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"cited_work":{"arxiv_id":"2602.14021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.14021","snapshot_observed_at":"2026-07-28T02:22:27.700778Z","title":"Flow4R: Unifying 4D reconstruction and tracking with scene flow","venue":null,"work_id":"3347e703-a8ff-40c1-adf2-92d6ad9b2cf1","year":2026},"citing_paper":{"arxiv_id":"2605.23892","last_updated":"2026-05-22T17:55:13Z","snapshot_observed_at":"2026-08-19T19:21:00.778445Z","submitted_at":"2026-05-22T17:55:13Z","title":"Good Token Hunting: A Hitchhiker's Guide to Token Selection for Visual Geometry Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-25T04:27:19.553379Z"},"links":{"cited_paper":"/paper/2602.14021","citing_paper":"/paper/2605.23892"},"observation_digest":"sha256:469bbb4dbaf6e5a963cfde02505db2eddb27f36b5fd9793dd492afcdf67cdb3b","observation_id":"c124ab2b-7e4a-40ed-a6e8-76b819c37f67","resolution":{"observed_at":"2026-07-28T02:22:27.700778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"cited_work":{"arxiv_id":"2602.14021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.14021","snapshot_observed_at":"2026-07-28T02:22:27.700778Z","title":"Flow4R: Unifying 4D reconstruction and tracking with scene flow","venue":null,"work_id":"3347e703-a8ff-40c1-adf2-92d6ad9b2cf1","year":2026},"citing_paper":{"arxiv_id":"2606.03287","last_updated":"2026-06-02T07:51:14Z","snapshot_observed_at":"2026-08-13T18:10:52.488614Z","submitted_at":"2026-06-02T07:51:14Z","title":"BA-T: An Iterative Transformer for Two-View Bundle Adjustment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:25:47.256701Z"},"links":{"cited_paper":"/paper/2602.14021","citing_paper":"/paper/2606.03287"},"observation_digest":"sha256:a328affabf85ef9f3afdb35c2e2b3dbf07445379f653eff2e8ba55b68579c0b2","observation_id":"ffa88eb4-6ac4-458f-ba05-f7d2b8bd6a55","resolution":{"observed_at":"2026-07-28T02:22:27.700778Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"cited_work":{"arxiv_id":"2602.14021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.14021","snapshot_observed_at":"2026-07-28T02:22:27.700778Z","title":"Flow4R: Unifying 4D reconstruction and tracking with scene flow","venue":null,"work_id":"3347e703-a8ff-40c1-adf2-92d6ad9b2cf1","year":2026},"citing_paper":{"arxiv_id":"2606.12189","last_updated":"2026-06-10T15:13:14Z","snapshot_observed_at":"2026-08-02T07:26:05.303660Z","submitted_at":"2026-06-10T15:13:14Z","title":"DynaTok: Token-Based 4D Reconstruction from Partial Point Clouds","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T09:50:09.378585Z"},"links":{"cited_paper":"/paper/2602.14021","citing_paper":"/paper/2606.12189"},"observation_digest":"sha256:c16ddeef2ca8a78b9ee90ef1c5b77f67fc0a41705091c50a3230493e35269501","observation_id":"8ca4de5a-98f6-4fcf-be6a-5087f9cf7665","resolution":{"observed_at":"2026-07-28T02:22:27.700778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.14021","snapshot_observed_at":"2026-08-04T16:51:02.218012Z","title":"Flow4r: Unifying 4d reconstruction and tracking with scene flow,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02006","last_updated":"2026-08-06T02:18:15Z","snapshot_observed_at":"2026-08-09T23:10:03.885825Z","submitted_at":"2026-08-03T10:06:45Z","title":"ASTRA: Asynchronous Spatio-Temporal Reconstruction via Trajectory Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T16:51:02.218012Z"},"links":{"cited_paper":"/paper/2602.14021","citing_paper":"/paper/2608.02006"},"observation_digest":"sha256:6e16203b49fe388906d909df41ddcd1359c8ae7a456650dcdc093422213f4f6d","observation_id":"e4f70217-0660-435b-a7d7-c4fe819f3bb3","resolution":{"observed_at":"2026-08-04T16:51:02.218012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.14021/citation-record","integrity":"/paper/2602.14021/integrity","json":"/paper/2602.14021/citation-record.json","paper":"/paper/2602.14021"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.231075Z","title":"Map-free visual relocalization: Metric pose relative to a single image","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.231075Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:bb794195a76e324f581b765d451eabd30632553deafaad5015bf513fb357e321","observation_id":"928a1d6e-a8bf-4616-9975-12a322d3d30a","resolution":{"observed_at":"2026-08-02T23:25:07.231075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.374481Z","title":"L4P: Towards unified low-level 4D vision perception","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.374481Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:33e2cb08c3e64fbada193ac20c03dfe71847fe2c09ec74d0d8f677c5cb9cc3c6","observation_id":"23cb95b5-ff67-45c1-b80e-392f6daca59b","resolution":{"observed_at":"2026-08-02T23:25:07.374481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.488627Z","title":"Arkitscenes: A di- verse real-world dataset for 3d indoor scene understanding using mobile rgb-d data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.488627Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:718ba43578758b3d6a6da2e27921219229045f80c5f52a618f10c2cd40febcc1","observation_id":"dfcffde1-7ec8-4bc8-a4ff-bb23b6e27e48","resolution":{"observed_at":"2026-08-02T23:25:07.488627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-08-02T23:25:07.613874Z","title":"Vir- tual kitti 2.arXiv preprint arXiv:2001.10773, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.613874Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:435940fa876554822bc17cfa4c709602baec45e724a8af77f6915f45372b3d60","observation_id":"04a90892-04f3-40b8-a9f9-77b4d53c0b8b","resolution":{"observed_at":"2026-08-02T23:25:07.613874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.728431Z","title":"MUSt3R: Multi-view network for stereo 3D recon- struction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.728431Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:85e00d0963af9e710fbd9442f0eb4b8cdcacd3e2f48820ddbee5113dd1d42129","observation_id":"00e00b7a-8a12-4b78-ada8-dc621c94d480","resolution":{"observed_at":"2026-08-02T23:25:07.728431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.847404Z","title":"Back on track: Bundle adjustment for dynamic scene re- construction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.847404Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:77757d2c61d8eb6a8615d5a667f3ce8d7d314d8ded2dfff3d22364de5877302f","observation_id":"0ee02e54-1dd2-4caf-8813-5db42c6ec3b4","resolution":{"observed_at":"2026-08-02T23:25:07.847404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:07.971309Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:07.971309Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:9a6c97a8f3cff9fcc5d40528bdd3944587fb12becf039dc937bf16886462ce9e","observation_id":"b776a70c-6bcb-404b-84b3-93e8baf0e33c","resolution":{"observed_at":"2026-08-02T23:25:07.971309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.090960Z","title":"Light3r- sfm: Towards feed-forward structure-from-motion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.090960Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:1b62e88f55c17bb8ae9b56cca604105e28e88801193dd94ce4c41b478d6010ad","observation_id":"feca1364-0d69-4ef4-a61a-fe33cd976411","resolution":{"observed_at":"2026-08-02T23:25:08.090960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.237498Z","title":"Black, Trevor Darrell, and Angjoo Kanazawa","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.237498Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:f6bfaeab357f806c8f4b3a919bfbaecdc1f2db137ad7828f5fd2a2047b986eed","observation_id":"bd151fdf-8ab9-4b91-8b56-b94a132a3b5b","resolution":{"observed_at":"2026-08-02T23:25:08.237498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.376660Z","title":"Kubric: A scalable dataset generator","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.376660Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:b6a7ef0c363843bf875e71f376d6e2779c5f3540389431d21f2fe235a888e559","observation_id":"93756e9d-aaef-4e2e-81f4-bbc110bb9507","resolution":{"observed_at":"2026-08-02T23:25:08.376660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.493096Z","title":"Enhancing 3d reconstruction for dynamic scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.493096Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:faea536c5677c847cfd32b31e5808768cca48e17d69c95dffbe27f7bb0b6b94c","observation_id":"32498246-7173-4a9d-a559-4ad07398607e","resolution":{"observed_at":"2026-08-02T23:25:08.493096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.574344Z","title":"Vggt4d: Mining motion cues in visual geometry transformers for 4d scene reconstruction.arXiv preprint arXiv:2511.19971, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.574344Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:9c4815f72b8188cc5f44402547ee9f95b8d58d11d5aa0a4779a180e31e5ba4bf","observation_id":"2cc08fef-946f-4c22-bec0-1b4c2d0d0dcb","resolution":{"observed_at":"2026-08-02T23:25:08.574344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.707293Z","title":"Panoptic studio: A massively multiview system for social motion capture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.707293Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:b9cd426d0d131cd0678dcb02fc5da1bd51ef487f44c47a64af7e741fabe78176","observation_id":"27355fe3-71b1-4684-b553-f138832d2ae1","resolution":{"observed_at":"2026-08-02T23:25:08.707293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.833579Z","title":"Dy- namicstereo: Consistent dynamic depth from stereo videos","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.833579Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:bf2b91b2ab93b15f0de6010a0412e24b427f4af3b43201b22015de61175929d5","observation_id":"fb83e0a2-4f0f-41a7-aaec-e676d58c30c2","resolution":{"observed_at":"2026-08-02T23:25:08.833579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:08.953123Z","title":"Co- tracker: It is better to track together","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:08.953123Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:9d4b9d07b1e20006289f0a769bd7f830dda03bab8f462540309b6a1bf6300ab4","observation_id":"e04ea691-123d-4582-91e6-0739956300f3","resolution":{"observed_at":"2026-08-02T23:25:08.953123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.083722Z","title":"Any4d: Unified feed-forward metric 4d reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.083722Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:7529b37d08b47869e42f4b082438a34e8879b9c1751f261121b55362dfdc1806","observation_id":"39963620-32d9-4e06-881f-26478060ca89","resolution":{"observed_at":"2026-08-02T23:25:09.083722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.210831Z","title":"MapAnything: Universal feed- forward metric 3D reconstruction","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.210831Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:64e2a6335ece609c3b6025d2f8da5fdd3857b4a2eef3644113626044ee6065d9","observation_id":"fc25e465-6671-47fe-8b6a-b8046d39fb5e","resolution":{"observed_at":"2026-08-02T23:25:09.210831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.311068Z","title":"Ro- bust consistent video depth estimation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.311068Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:04e60e4bd160501aefa8566c5d2e00b8f3d2f97b673e08b503a7db66a0dbe175","observation_id":"b848890d-23ff-47eb-865a-9c6c8faed1d3","resolution":{"observed_at":"2026-08-02T23:25:09.311068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.402394Z","title":"Ground- ing image matching in 3D with MASt3R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.402394Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:1a2ae59bc1141284310d04aa985956b790c44e7e79bb374758f37852bbd5d1d0","observation_id":"ece14ddf-a5f6-4309-8fcd-49ad8c541c4a","resolution":{"observed_at":"2026-08-02T23:25:09.402394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.477950Z","title":"Megadepth: Learning single- view depth prediction from internet photos","venue":null,"work_id":null,"year":2041},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.477950Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:f8e8c65fdb1e4fcb8064722fc8271b4b031aba1f963eda26fbb9819bee833764","observation_id":"f4b8d76f-8d01-4e1c-831e-8aa77ffcc9af","resolution":{"observed_at":"2026-08-02T23:25:09.477950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.545731Z","title":"Megasam: Accurate, fast and ro- bust structure and motion from casual dynamic videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.545731Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:28db97f3cfa77ccdbb4ea46d9412e559347365ad7f43da8c27c09e24c2b13ef6","observation_id":"c106d368-6dd3-4107-b945-f9461f4fd8ce","resolution":{"observed_at":"2026-08-02T23:25:09.545731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.601532Z","title":"Zero-shot monocular scene flow estima- tion in the wild","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.601532Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:726f673b2477cdd31bcc48125024257f1152caac48df9ea2c8c9e5cf34bc28fa","observation_id":"fd8c1812-1b03-4b01-94c8-25d6ca89268e","resolution":{"observed_at":"2026-08-02T23:25:09.601532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.669202Z","title":"Pixel-perfect structure-from- motion with featuremetric refinement","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.669202Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:ecfb96e2000694b899b5436129a5584077c952e683dd69f1a2091ee72857534e","observation_id":"a4950935-117c-4c37-aa26-5cb0ac4172c3","resolution":{"observed_at":"2026-08-02T23:25:09.669202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.779084Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.779084Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:a22105a9620c4c1f57ca5e3bc81345fa386157535c9366e1fa9797332f3ad375","observation_id":"73a26565-03d8-46f6-aadf-ddb4388810a7","resolution":{"observed_at":"2026-08-02T23:25:09.779084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.861881Z","title":"Trace any- thing: Representing any video in 4d via trajectory fields","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.861881Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:4db908cd206d2a3dc82d68bf73e8cad3cf127b275d1058c268b98a2f9f0f5d14","observation_id":"fb7175c6-4060-4a6f-a72a-1ef95483d4d9","resolution":{"observed_at":"2026-08-02T23:25:09.861881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:09.942085Z","title":"A large dataset to train convolutional networks for disparity, optical flow, and scene flow estimation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:09.942085Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:7eacbb6c107c29a2529a4d936a92e6fee863ba215214c631789394e766f379cf","observation_id":"094a89cb-78f6-4731-a1fb-24cb51b1bed0","resolution":{"observed_at":"2026-08-02T23:25:09.942085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.030920Z","title":"Spring: A high-resolution high- detail dataset and benchmark for scene flow, optical flow and stereo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.030920Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:02e1c82364e7a8a8bef65aac7a82f01cd2e22485c740cd3c22db76e6f4270029","observation_id":"74731109-d182-484a-b740-8f4a9cd03434","resolution":{"observed_at":"2026-08-02T23:25:10.030920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.108166Z","title":"Openmvg: Open multiple view geometry","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.108166Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:977116bdf1e527b88bb3c6f5b6443df0b1fa9a170deaaf0ef9312c483b596385","observation_id":"65584d82-e5b9-43e5-b8c2-968eafa4e7db","resolution":{"observed_at":"2026-08-02T23:25:10.108166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.189983Z","title":"Newcombe, Dieter Fox, and Steven M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.189983Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:df5b3ab85fe686909594d79243bc47d40d8792bf0f50bca2d4348230bc568ca7","observation_id":"6233369c-34fe-4c4b-95ef-f954d3c6baa3","resolution":{"observed_at":"2026-08-02T23:25:10.189983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.281239Z","title":"Delta: Dense efficient long-range 3d track- ing for any video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.281239Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:9c5a13fd025744518426c2487d861f0c10c090f06ab5a5552327f3def33b511b","observation_id":"ea5cf366-88a1-44de-b4e8-fb78aa110f06","resolution":{"observed_at":"2026-08-02T23:25:10.281239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.361183Z","title":"Global structure-from-motion revisited","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.361183Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:cf7ee3e459db57a91073cd6765815419fa408e903c02d99498b3052da68c5d3b","observation_id":"b6ed488a-ac43-4b74-95ab-bcf2b88f8f0c","resolution":{"observed_at":"2026-08-02T23:25:10.361183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.449954Z","title":"Aria digital twin: A new benchmark dataset for egocentric 3d machine perception","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.449954Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:dddad320d9d5d91f76399e8f2031f16b32af4889190a3e89aa57cb99b3d2a819","observation_id":"d1a36a8b-d44e-4038-a784-9619c986d177","resolution":{"observed_at":"2026-08-02T23:25:10.449954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.534075Z","title":"A benchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.534075Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:4b6c7e98794309892bf15306bdbeab89a7e3b66e7d52d7bee463abee7ac57f54","observation_id":"3236d0d3-15e9-4bc3-a025-a2898abe1590","resolution":{"observed_at":"2026-08-02T23:25:10.534075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.620890Z","title":"Habitat 3.0: A co-habitat for humans, avatars and robots, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.620890Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:e7a271e638293f25201892d1ce76795fb5601b16eddbdd63b6609bc90df10f19","observation_id":"09f12d68-4693-4ce6-9677-e136fb1d42d3","resolution":{"observed_at":"2026-08-02T23:25:10.620890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.725437Z","title":"Com- mon objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.725437Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:da8a0cde6af9dbd3e18a0c7cf0af6e9dfa50ce6aa55d4da74c92f16e860cf544","observation_id":"a4871dc6-20c7-46a8-a7a6-c796f47a2b07","resolution":{"observed_at":"2026-08-02T23:25:10.725437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.803267Z","title":"Hypersim: A photorealistic syn- thetic dataset for holistic indoor scene understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.803267Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:2efe5ebb5c774fe6911de6b95ab2f59f64799946097d0646dab0aa57f4ab86b4","observation_id":"900eeae9-5bda-4094-b02d-405b4fec38c2","resolution":{"observed_at":"2026-08-02T23:25:10.803267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:10.907486Z","title":"Habitat: A Platform for Embodied AI Research","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:10.907486Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:afeeab0d094440bab07f15d83651133d144e30e744b95ab49589af8a6069c956","observation_id":"037020f2-596f-40f8-b6c7-fcee44c189fe","resolution":{"observed_at":"2026-08-02T23:25:10.907486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.019194Z","title":"Structure- from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.019194Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:49bbaf9a2ffaf38ed4ff76982299af8b4426fcac4639f2a31d28ccdabaccb282","observation_id":"21021b42-eb1f-459a-ba3b-d2e6d8a62617","resolution":{"observed_at":"2026-08-02T23:25:11.019194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.142645Z","title":"A benchmark and a baseline for robust multi- view depth estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.142645Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:024ee9c3fd511246432209268b67c334a949ffba778e94564bec1b51a70cf020","observation_id":"c6ce43a4-948c-41ec-b159-4daa6bfe2a37","resolution":{"observed_at":"2026-08-02T23:25:11.142645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.252293Z","title":"A benchmark for the evalua- tion of rgb-d slam systems","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.252293Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:14fe6c64615914293b0aa8b9924bed3f5876412d71ddb7801b8614d189256aa7","observation_id":"746ef207-b8e2-402a-badc-de0801e480a0","resolution":{"observed_at":"2026-08-02T23:25:11.252293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.368641Z","title":"Dynamic point maps: A versatile representation for dynamic 3d reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.368641Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:c161107816543578ea9305e05320ee6f3150b1cb5f12f98ecb71fcf77939df04","observation_id":"3732f497-33d3-47e4-a559-798cfa7435a1","resolution":{"observed_at":"2026-08-02T23:25:11.368641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.434986Z","title":"V-dpm: 4d video reconstruction with dynamic point maps.arXiv preprint arXiv:2601.09499, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.434986Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:dc4c4de43f8effb134c131299e37238cbe1b136deb36e95fb082f72d165fc37c","observation_id":"453d76b9-d8d9-4a60-9e6d-82740aacc12e","resolution":{"observed_at":"2026-08-02T23:25:11.434986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.529863Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.529863Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:666766283a5598f2c69cbf8d5d97d962050de0ca6ac68fa9b2f46971c6bbb5ff","observation_id":"a957f363-0c0f-4242-aeb2-d4d39680d432","resolution":{"observed_at":"2026-08-02T23:25:11.529863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.642291Z","title":"Theia: A fast and scalable structure-from-motion library","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.642291Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:98418023d15d6948802b8ee250c1fd2650871eb82ea2d9fa188a7354e97cd8c0","observation_id":"68d5d5ba-59c3-466f-bf7a-4fca9f964d09","resolution":{"observed_at":"2026-08-02T23:25:11.642291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.715071Z","title":"Habitat 2.0: Training home assistants to rearrange their habitat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.715071Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:37212f2d6091713e8f2e9cd40ff71c79e954657d683ef96160333571a6ed6e0f","observation_id":"48ab5943-96b7-44c2-ab3c-13bbf66011c5","resolution":{"observed_at":"2026-08-02T23:25:11.715071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.793788Z","title":"Mv-dust3r+: Single-stage scene reconstruction from sparse views in 2 seconds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.793788Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:e532852c9e1313c3383a473ad8ad3f05e157fc49f849868eaa5d8845a37b810c","observation_id":"30fdf59c-1288-4619-86dc-5b4b1e664d3c","resolution":{"observed_at":"2026-08-02T23:25:11.793788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.873757Z","title":"Smd-nets: Stereo mixture density networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.873757Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:21ad6ac60ba4b3332a054b47220eef16188104c8e3b6289541a611392c525bde","observation_id":"6da907e6-7a62-4600-a734-969d27b6c492","resolution":{"observed_at":"2026-08-02T23:25:11.873757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:11.988298Z","title":"Piece- wise rigid scene flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:11.988298Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:4e2c6e02497aa48763b712764204958c90d67e72be965fd0678fa5bfefff9668","observation_id":"fdbd1ff7-e18b-4bf2-a6c2-2a1cf2795570","resolution":{"observed_at":"2026-08-02T23:25:11.988298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.099749Z","title":"3D reconstruction with spatial memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.099749Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:54505b87a5e930417bd0d715ccf4d7e1c88f573e62c5501cae99ef2bfabc03b3","observation_id":"e79c5462-f94a-4e77-bae7-5efd0923298f","resolution":{"observed_at":"2026-08-02T23:25:12.099749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.201833Z","title":"4d-vggt: A general foundation model with spatiotemporal awareness for dynamic scene geometry estimation.arXiv preprint arXiv:2511.18416, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.201833Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:778cb253113b7a0a937ea28ae0be7328346ea6c77b757a54dc9d43de68d7018f","observation_id":"074dfd58-1010-4071-8182-c8e39f5120b0","resolution":{"observed_at":"2026-08-02T23:25:12.201833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.299740Z","title":"Vggsfm: Visual geometry grounded deep structure from motion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.299740Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:f5b367390fc3b94b52cd07f844572ba3da7e4bcff1fde5486d54575ed57d5006","observation_id":"c9112e56-2917-4726-b929-11628ce4abf2","resolution":{"observed_at":"2026-08-02T23:25:12.299740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.364849Z","title":"Vggt: Vi- sual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.364849Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:c209a0d4189e694cb42eed6f8b64394e6aa02169c397b73ecc45c8cd150ba3a3","observation_id":"cc8b611e-9541-4240-8347-b476c4aa1897","resolution":{"observed_at":"2026-08-02T23:25:12.364849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.469988Z","title":"Continuous 3D per- ception model with persistent state","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.469988Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:2f2666313f15165e8af8b6df030cbc36eb264b029c80958ff6508812aa6c0b15","observation_id":"b29e9ec2-582c-4cb9-a3c9-4ca27c0b668b","resolution":{"observed_at":"2026-08-02T23:25:12.469988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.551259Z","title":"DUSt3R: Geometric 3D vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.551259Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:3e266696692a8326b6538ca61b0a314119d842661cecedaaadb2b6d6b90cde1d","observation_id":"dcb6a87f-40d6-4dcb-bccd-2ca64220d9a5","resolution":{"observed_at":"2026-08-02T23:25:12.551259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.623576Z","title":"Tartanair: A dataset to push the limits of visual slam","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.623576Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:519142575f8347c1231b4412a6e512cd530e7954f78c4be6b36207fff272addf","observation_id":"baa2bdc1-dc49-4f78-8539-9f3f223a557f","resolution":{"observed_at":"2026-08-02T23:25:12.623576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.721789Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.721789Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:3a4b4d0d6bc24347b1d5cce7bcca6177da94e5e7f36001929d5362687a9e5e63","observation_id":"561a3514-def3-42d4-a4b6-2dac71390457","resolution":{"observed_at":"2026-08-02T23:25:12.721789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.779929Z","title":"Springer Science & Business Media,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.779929Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:1c9a237bcc8ba3a625990641a898c945de6e7e7fa7bc3e8b166d3c3019b8183a","observation_id":"2c8de555-065a-45ed-8ac3-3709c2548746","resolution":{"observed_at":"2026-08-02T23:25:12.779929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.838805Z","title":"Efficient dense scene flow from sparse or dense stereo data","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.838805Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:519d8acf22e72dd29068ab3d1e4cec0635275483d5b18244845e724980571cd3","observation_id":"c36db779-06ac-4e9f-aadf-3404c46a175b","resolution":{"observed_at":"2026-08-02T23:25:12.838805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.905906Z","title":"CroCo v2: Improved cross-view completion pre- training for stereo matching and optical flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.905906Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:a9b9ecf27855a88b96c7366be6bad88ebeb9258efc8c347ce3b2876b7d1ab567","observation_id":"7258e413-5ae0-4a58-8885-56b3fa1d03e8","resolution":{"observed_at":"2026-08-02T23:25:12.905906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:12.972325Z","title":"CroCo: Self- supervised pre-training for 3D vision tasks by cross-view completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:12.972325Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:caaac9e13dced12d69e54ea195ab8bf46b26c657e33188ecb8f48fc5ab73f3a0","observation_id":"2eeb1499-5b5c-4cb5-9a8e-c9e10cd54ec8","resolution":{"observed_at":"2026-08-02T23:25:12.972325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.071532Z","title":"Rgbd objects in the wild: Scaling real-world 3d object learning from rgb-d videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.071532Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:ff6f34416b908f88d24eacc6a0664f5d6711e0dda749ad56f4ac181d1520b116","observation_id":"3fc3e292-804f-44ae-8a9b-e5b7371348ec","resolution":{"observed_at":"2026-08-02T23:25:13.071532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.163536Z","title":"Spatialtracker: Tracking any 2d pixels in 3d space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.163536Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:274249434fc3c0a811f7dca2680cda8a2fccd60325f83985010e30dd4859800c","observation_id":"08077fed-1f3c-4794-bc20-4f19c2f77335","resolution":{"observed_at":"2026-08-02T23:25:13.163536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.257126Z","title":"Spatialtrackerv2: 3d point tracking made easy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.257126Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:9e48c3f829c4b073a99f48df11011db20f56573ba3d20011d9039f6f3010f7f5","observation_id":"0fe61477-5f8a-43cd-be55-715ac8aa35ce","resolution":{"observed_at":"2026-08-02T23:25:13.257126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.337715Z","title":"Liang, Mikael Henaff, Hao Tang, Ang Cao, Joyce Chai, Franziska Meier, and Matt Feiszli","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.337715Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:1a4db1c7163200b85defa5b5c18f912f0d31d0a8602b001924c16688eb91f48b","observation_id":"35e564b8-7cb3-48d9-bd33-11fbf07c1d87","resolution":{"observed_at":"2026-08-02T23:25:13.337715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.412560Z","title":"Blendedmvs: A large- scale dataset for generalized multi-view stereo networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.412560Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:10fa47f82600eb966675f280b8f22367ef6313f2af8f8571775cba3106b0994c","observation_id":"5ddb7095-a137-4218-a8e4-7b1791e8e9ab","resolution":{"observed_at":"2026-08-02T23:25:13.412560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.490312Z","title":"Scannet++: A high-fidelity dataset of 3d in- door scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.490312Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:0d2ca61ae8c1a18918e4c9eca16d27ba9c6f0d65cf0961b1c7c4bd03c65d03c1","observation_id":"7b45a5eb-aafc-4eb2-bbb7-37ce60acde7b","resolution":{"observed_at":"2026-08-02T23:25:13.490312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.548680Z","title":"Tapip3d: Tracking any point in persistent 3d geome- try","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.548680Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:8d6b0738db4e2b78e980f9ae25ceebda63c53f3b1e9d707838e887afa75d37fc","observation_id":"c9c1f9db-12d5-482a-99c7-cb97452543e5","resolution":{"observed_at":"2026-08-02T23:25:13.548680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.624234Z","title":"Ef- ficiently reconstructing dynamic scenes one d4rt at a time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.624234Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:1d960164ef599ac4ba8a793bc754aeadd7b8d2f0cfc3dd682c65df6293465329","observation_id":"ac731b5e-3e0c-49c1-b8da-8fc8628081bc","resolution":{"observed_at":"2026-08-02T23:25:13.624234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.729673Z","title":"MonST3R: A simple approach for estimating geometry in the presence of motion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.729673Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:5b1c96a9015b717c72b2d89fe264c506938453227b5a7eb516eabcb773c10344","observation_id":"c479167c-21f2-407d-a1ea-3fbc5151075f","resolution":{"observed_at":"2026-08-02T23:25:13.729673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.809260Z","title":"Pomato: Marrying 11 pointmap matching with temporal motion for dynamic 3d re- construction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.809260Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:0b32c73751ea44a16fac56829e954d8f9fdc39e55ccba6034fab5ca72aacfd72","observation_id":"b9cb7a2e-3721-4ee4-b1f8-5d61ec8734c0","resolution":{"observed_at":"2026-08-02T23:25:13.809260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:13.917515Z","title":"Structure and motion from casual videos","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:13.917515Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:3eab74938542acc85e549ec84bea9a84a933f6661ca5e02381e0928a5ec634e9","observation_id":"ae389a51-11fd-43f3-afef-d17af18ed923","resolution":{"observed_at":"2026-08-02T23:25:13.917515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:14.010993Z","title":"Pointodyssey: A large-scale synthetic dataset for long-term point tracking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:14.010993Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:6e38e78412b91f6e65fefdab244fd3bd61ae5ca6d6b75d669a03889f666d688d","observation_id":"23922df4-b1ba-40b3-bcc2-1aa918d5d82c","resolution":{"observed_at":"2026-08-02T23:25:14.010993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17568","last_updated":"2026-08-04T12:59:26Z","snapshot_observed_at":"2026-08-13T14:04:11.974540Z","submitted_at":"2025-10-20T14:17:16Z","title":"PAGE-4D: Disentangled pose and geometry estimation for vggt-4d perception","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17568","snapshot_observed_at":"2026-08-02T23:25:14.086136Z","title":"Page-4d: Disentangled pose and ge- ometry estimation for 4d perception.arXiv preprint arXiv:2510.17568, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:14.086136Z"},"links":{"cited_paper":"/paper/2510.17568","citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:a73ccd392fcbca432885e00a1e9b96b272cf02ee446aa6e93ae2707005a742ed","observation_id":"aa439fae-6a79-4d9b-aa09-4de07978fc83","resolution":{"observed_at":"2026-08-02T23:25:14.086136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:14.147056Z","title":"Omniworld: A multi-domain and multi-modal dataset for 4d world modeling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:14.147056Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:542ccd11c190e205c3dfb3975dc5c79f308177cb570254184be6dbcead93784e","observation_id":"7923ca84-d550-4404-b17e-1043e298542e","resolution":{"observed_at":"2026-08-02T23:25:14.147056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:25:14.207952Z","title":"Streaming 4d visual geometry transformer","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T23:25:14.207952Z"},"links":{"citing_paper":"/paper/2602.14021"},"observation_digest":"sha256:2f0636e7605f48427186e785dc8b6536482f5e7971427addec223eb9041bdc77","observation_id":"a0ed5681-01f2-46ef-bb5a-ac69be72dd06","resolution":{"observed_at":"2026-08-02T23:25:14.207952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.14021","last_updated":"2026-07-26T14:06:15Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:10:00.924742Z","submitted_at":"2026-02-15T06:58:08Z","title":"Flow4R: Unifying 4D Reconstruction and Tracking with Scene Flow"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 5 inbound Pith citation observations for arXiv:2602.14021."}