{"as_of":"2026-08-06T18:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f1e46f87c514607a47b2c7ce9d78afb56e9cdf4518936cf40d70c9a6e354328","coverage":[{"denominator":91,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":91,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T16:41:08.620285Z","state":"measured"},{"denominator":156,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":156,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":65,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:39:28.517132Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T13:29:51.199853Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2509.26645","last_updated":"2026-03-03T12:58:09Z","snapshot_observed_at":"2026-07-30T21:37:36.891851Z","submitted_at":"2025-09-30T17:59:51Z","title":"TTT3R: 3D Reconstruction as Test-Time Training","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T06:41:16.306593Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2509.26645"},"observation_digest":"sha256:0bb286d99a8e6a622f3d67d78dd870cc0fdc9e9d2c4ba41da99b85b1387f2aa5","observation_id":"fe823054-bcf8-4751-8993-533368d00226","resolution":{"observed_at":"2026-05-17T06:41:16.427936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T23:01:13.546110Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2511.00062"},"observation_digest":"sha256:65a8f0cc8b9252976e66ec5a0f19c474454da329ee4cd7c36d5ca92dfdc0e805","observation_id":"f9dcd7e3-e2e4-4e43-8037-dba17d16ab2d","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:c656eb8ba80a236cf0f4f4cfab97178018ed9e3664e470f2258ffbc48ae22e6c","observation_id":"cdce8967-421a-45db-97ec-d4585303b9ab","resolution":{"observed_at":"2026-05-17T20:02:04.189139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2512.10226","last_updated":"2026-04-14T00:44:42Z","snapshot_observed_at":"2026-08-02T07:00:45.391301Z","submitted_at":"2025-12-11T02:22:07Z","title":"Latent Chain-of-Thought World Modeling for End-to-End Driving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T23:16:41.916869Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2512.10226"},"observation_digest":"sha256:29e49b21752c15b3a4574d17f3f22888de7c7a6ddfc857aa72a1c18543f65c31","observation_id":"5a9a2057-7ebd-4459-be85-8f8cebf1f2fb","resolution":{"observed_at":"2026-05-16T23:18:39.792987Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T14:29:56.348733Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2512.14614"},"observation_digest":"sha256:925b23f33bb90d2b2102cc6220f53cf6158a19d2e20242635c1d6077cb821d72","observation_id":"98bd44c7-ac2e-49d8-83a6-593f5a4cdd3b","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-03T16:11:12.209268Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:11:12.209268Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2512.14614"},"observation_digest":"sha256:881c841c6c31854bc73403ca4c5ed38a4b9ba185cf89d02cac0ca3851aac4bda","observation_id":"19499c28-c7be-43e3-b350-1997e229f9dc","resolution":{"observed_at":"2026-08-03T16:11:12.209268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-03T01:20:05.068180Z","title":"Generating long- take videos via effective keyframes and guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10104","last_updated":"2026-05-26T06:14:19Z","snapshot_observed_at":"2026-08-06T04:50:12.381147Z","submitted_at":"2026-02-10T18:58:41Z","title":"Olaf-World: Orienting Latent Actions for Video World Modeling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T01:20:05.068180Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2602.10104"},"observation_digest":"sha256:c95e33dab1212abe634c1718f03ebf1841f891ab8039ad0104a5e92ea3818519","observation_id":"736ddd35-5f3e-4def-83fe-e5cc57226648","resolution":{"observed_at":"2026-08-03T01:20:05.068180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2602.19035","last_updated":"2026-04-25T01:52:58Z","snapshot_observed_at":"2026-07-29T18:53:57.313605Z","submitted_at":"2026-02-22T04:18:29Z","title":"OpenVO: Open-World Visual Odometry with Temporal Dynamics Awareness","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T20:52:28.543570Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2602.19035"},"observation_digest":"sha256:497c7c9781d5d08768abf78bfda5625d7feb49cce362702e2f462707236cbd7c","observation_id":"46dd4b27-ce47-4b4b-bf7b-0c0414f22040","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-14T20:50:44.778323Z","title":"arXiv preprint arXiv:2508.10934 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.14965","last_updated":"2026-06-30T12:43:25Z","snapshot_observed_at":"2026-08-06T02:08:39.510366Z","submitted_at":"2026-03-16T08:23:00Z","title":"GeoNVS: Geometry Grounded Video Diffusion for Novel View Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T20:50:44.778323Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2603.14965"},"observation_digest":"sha256:0ff03a0137ee79b194a41b90781cdd65fd3ab5a78dbe2c3a04cb84f73f530503","observation_id":"2fa27f52-0388-4e41-9bfd-76dfd4ce7085","resolution":{"observed_at":"2026-07-14T20:50:44.778323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.07348","last_updated":"2026-04-08T17:59:22Z","snapshot_observed_at":"2026-07-06T22:55:37.787732Z","submitted_at":"2026-04-08T17:59:22Z","title":"MoRight: Motion Control Done Right","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T17:38:03.776766Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.07348"},"observation_digest":"sha256:cb6aed01f809f7997412d74d7a693ed2bcbe757acca455dc36c84722c926f645","observation_id":"e177a3f2-f27a-4298-b21f-51f05922528a","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:14.349469Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.08995"},"observation_digest":"sha256:0075607979bac0bf4bcd05ff1d41a3538ded6ca3f17b7c24db3677181b5aa3b8","observation_id":"bde3a741-9281-4042-a037-bd804a70569a","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.11038","last_updated":"2026-04-13T06:06:23Z","snapshot_observed_at":"2026-07-06T22:59:32.051572Z","submitted_at":"2026-04-13T06:06:23Z","title":"EgoFun3D: Modeling Interactive Objects from Egocentric Videos using Function Templates","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T16:33:59.344264Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.11038"},"observation_digest":"sha256:6c9dd1b5ed9f917ef19847bcef38aa2681321b59c09b14042aa62a105368d8ba","observation_id":"a46156a4-93c8-4e18-87e2-6fba1f914d55","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.13036","last_updated":"2026-04-14T17:59:44Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:59:44Z","title":"Lyra 2.0: Explorable Generative 3D Worlds","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T15:30:57.712342Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.13036"},"observation_digest":"sha256:eee1afa957102f3856eb5432aebbb7dbd59e4b8fc2b9a2fa427c9adf45f67069","observation_id":"924b60ce-37d0-4579-98e7-a75124c21fe0","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.13793","last_updated":"2026-07-01T12:10:20Z","snapshot_observed_at":"2026-07-12T20:34:29.325299Z","submitted_at":"2026-04-15T12:32:25Z","title":"From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T13:23:35.738229Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.13793"},"observation_digest":"sha256:7afacbb9916182af82753bfec9ecf43323138fdca8852128be44c14d7e499f78","observation_id":"d88aa84b-c6c0-4fc0-8d76-f87343e6452c","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-12T20:34:35.048469Z","title":"arXiv preprint arXiv:2508.10934 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.13793","last_updated":"2026-07-01T12:10:20Z","snapshot_observed_at":"2026-07-12T20:34:29.325299Z","submitted_at":"2026-04-15T12:32:25Z","title":"From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T20:34:35.048469Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.13793"},"observation_digest":"sha256:d3ff760f025a7257630adae42f7101f692670afe6c32d03ef60ff7860e8925b4","observation_id":"d30c7b7e-2f84-458f-bc57-53376164561d","resolution":{"observed_at":"2026-07-12T20:34:35.048469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.14141","last_updated":"2026-04-16T16:44:56Z","snapshot_observed_at":"2026-07-31T19:16:11.204600Z","submitted_at":"2026-04-15T17:58:13Z","title":"Geometric Context Transformer for Streaming 3D Reconstruction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T13:54:13.644019Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.14141"},"observation_digest":"sha256:f995bfca7fcef8ef62c9f2ea71374b269686fe4ff162a8f07861938576b6cab0","observation_id":"14a050be-e210-4603-9078-99cfea916c78","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.21776","last_updated":"2026-04-24T04:18:46Z","snapshot_observed_at":"2026-07-06T23:08:19.446684Z","submitted_at":"2026-04-23T15:32:56Z","title":"Reshoot-Anything: A Self-Supervised Model for In-the-Wild Video Reshooting","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T23:00:45.496971Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.21776"},"observation_digest":"sha256:bbdfdb669fb18a860fdad5b9e8638a80f40835f1113e9ec8aff3d07224d4cec5","observation_id":"4480e94b-3b1f-4254-bc5d-28604128b5ac","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2604.26067","last_updated":"2026-04-28T19:09:09Z","snapshot_observed_at":"2026-08-05T20:24:20.627703Z","submitted_at":"2026-04-28T19:09:09Z","title":"RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:40:25.188693Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2604.26067"},"observation_digest":"sha256:c754008c619f276640b2d6d3dde96879a8ee2e7e0e954a3a7f80881f47f600c8","observation_id":"c51eae14-a887-4f5f-9c07-3e8e6ef5fd88","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.06051","last_updated":"2026-05-07T11:36:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-07T11:36:29Z","title":"RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-09T15:22:04.387900Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.06051"},"observation_digest":"sha256:14c22b4b47e8708dc917a27780dbd28655cda921e3677208d0f8805660e714ee","observation_id":"0d459c10-10b5-434e-9492-38d182d3f11f","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-02T15:32:07.680099Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T05:42:31.717412Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:5d5726fa023e6fa8ca6c169cfab074713eaec5a4a99178da6edf08cb0130db48","observation_id":"fc642e96-7291-4fed-92aa-ec088a312722","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-02T15:32:07.680099Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:34431caea54806172b80cb9dfb5546b6c56c17d3c5b650ca04365b7d1188db92","observation_id":"5cf90b1b-1953-4d4d-9852-c4afb696a49d","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.12587","last_updated":"2026-05-12T17:59:27Z","snapshot_observed_at":"2026-07-06T23:24:13.851504Z","submitted_at":"2026-05-12T17:59:27Z","title":"TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D Tracking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T21:28:12.151547Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.12587"},"observation_digest":"sha256:6cc2bbad44becdfec60cfcb95a7df7a8f76b114b74451846ae3c5d91da9a3281","observation_id":"efe88b6a-8903-4811-b4a7-36b2f4f6cd34","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.12774","last_updated":"2026-05-12T21:39:44Z","snapshot_observed_at":"2026-08-01T07:26:57.201783Z","submitted_at":"2026-05-12T21:39:44Z","title":"WildPose: A Unified Framework for Robust Pose Estimation in the Wild","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T20:38:04.312214Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.12774"},"observation_digest":"sha256:2d50cea6ffa0135f600e23c0cd68b3cee99ef013feb163c883f75b26b31002c8","observation_id":"c14119f9-5ffc-41df-aeeb-b3afed685d85","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.14615","last_updated":"2026-05-14T09:32:12Z","snapshot_observed_at":"2026-08-02T05:33:32.333560Z","submitted_at":"2026-05-14T09:32:12Z","title":"CalibAnyView: Beyond Single-View Camera Calibration in the Wild","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T06:00:29.995089Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.14615"},"observation_digest":"sha256:007b69b62b6bcbb2f2a5dd5f403518e901be675196cb8783a83e78b6fe68f6e8","observation_id":"7bc2d33c-0815-4f24-a80a-928e62a7857a","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.15178","last_updated":"2026-05-14T17:58:03Z","snapshot_observed_at":"2026-08-06T16:58:37.665408Z","submitted_at":"2026-05-14T17:58:03Z","title":"SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T13:56:17.912350Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.15178"},"observation_digest":"sha256:185d55d7b74f9a826e87167cb8e152b9810cadacc367434c28108bafe685369c","observation_id":"a9b94b1c-b109-4d55-bedd-ae86499edad7","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.15195","last_updated":"2026-05-14T17:59:51Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:59:51Z","title":"VGGT-$\\Omega$","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T20:31:32.625856Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.15195"},"observation_digest":"sha256:997c1735c020a7dd78ca61290e51213dddc791898aa79c536de9f0e1be6e43fd","observation_id":"63e52114-0a67-477f-b1c0-123fb27c628f","resolution":{"observed_at":"2026-06-30T20:35:02.598894Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.15477","last_updated":"2026-05-25T20:56:59Z","snapshot_observed_at":"2026-07-06T23:26:46.595393Z","submitted_at":"2026-05-14T23:35:54Z","title":"EgoExo-WM: Unlocking Exo Video for Ego World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T14:32:27.920029Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.15477"},"observation_digest":"sha256:f3a64929b028761a472de99c7b7e72930d86f61b358e755d648bcb28c1b3d577","observation_id":"cc8fb31f-3ec8-42d7-9950-86815f730c50","resolution":{"observed_at":"2026-05-19T14:32:36.093269Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.15477","last_updated":"2026-05-25T20:56:59Z","snapshot_observed_at":"2026-07-06T23:26:46.595393Z","submitted_at":"2026-05-14T23:35:54Z","title":"EgoExo-WM: Unlocking Exo Video for Ego World Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T20:26:11.104536Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.15477"},"observation_digest":"sha256:59e473a797fb1ab052fc062627ea22486a9ada69fb61890db99a598cfca15eef","observation_id":"0e45ac6e-de20-44f6-8767-21554c9d1685","resolution":{"observed_at":"2026-06-30T20:35:03.031088Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.22819","last_updated":"2026-07-23T02:53:47Z","snapshot_observed_at":"2026-08-02T13:29:27.256254Z","submitted_at":"2026-05-21T17:59:45Z","title":"Cambrian-P: Pose-Grounded Video Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T05:47:13.493461Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.22819"},"observation_digest":"sha256:83c148d862cad902dd9cbd1e15b87a858243f4ea1cfb53c89e1d085b6cd8d6e5","observation_id":"f9427464-5463-40b2-b35b-1d6698f1e9ce","resolution":{"observed_at":"2026-05-22T05:51:09.097764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-02T13:29:35.718413Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22819","last_updated":"2026-07-23T02:53:47Z","snapshot_observed_at":"2026-08-02T13:29:27.256254Z","submitted_at":"2026-05-21T17:59:45Z","title":"Cambrian-P: Pose-Grounded Video Understanding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T13:29:35.718413Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.22819"},"observation_digest":"sha256:98bb98aa521cf2791645444ae548ddeeff2242406077c294e592eb47de3f9d3e","observation_id":"847adbd2-7467-4954-9236-3ea91bec5b9d","resolution":{"observed_at":"2026-08-02T13:29:35.718413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.23672","last_updated":"2026-05-22T14:20:39Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T14:20:39Z","title":"RiGS: Rigid-aware 4D Gaussian Splatting from a Single Monocular Video","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T04:41:42.521496Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.23672"},"observation_digest":"sha256:3eb565284749762f16c0889e587cf737482982e8e0f55ddbc778ef5c1a151d28","observation_id":"e93c5ff6-ab45-4547-b5a3-e261e17c762a","resolution":{"observed_at":"2026-05-25T04:45:20.595872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.23903","last_updated":"2026-05-22T17:59:43Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:59:43Z","title":"Geo-Align: Video Generation Alignment via Metric Geometry Reward","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-25T04:15:58.667672Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.23903"},"observation_digest":"sha256:0bad5e7a2a94ebb9a0e5fef30d91b57ee654b751f27ae0aaa3399859dc77efea","observation_id":"f2c7e811-6a7c-4f78-b2a5-67e99b1566c1","resolution":{"observed_at":"2026-05-25T04:16:35.990491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.25077","last_updated":"2026-05-24T13:40:42Z","snapshot_observed_at":"2026-08-06T15:22:41.271853Z","submitted_at":"2026-05-24T13:40:42Z","title":"WorldCraft: From Camera Navigation to Object Manipulation in Interactive Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T12:03:06.701175Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.25077"},"observation_digest":"sha256:cbbb9aed24eae874f987d3d494dcbf4fbf90499941184c00236f2cb3a7e4e406","observation_id":"5d77e762-e407-4cea-a097-45489e86467a","resolution":{"observed_at":"2026-06-30T12:04:38.677539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.25449","last_updated":"2026-06-08T06:26:00Z","snapshot_observed_at":"2026-08-02T23:36:38.077200Z","submitted_at":"2026-05-25T06:00:01Z","title":"Pantheon360: Taming Digital Twin Generation via 3D-Aware 360{\\deg} Video Diffusion","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T22:46:55.049969Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.25449"},"observation_digest":"sha256:1af3ec18fa2094dbee3fcde85424b3dbe81a6f69ea6a0df964d3591d726d427c","observation_id":"da87fadc-2b8b-4049-afdd-e683ef0aa5d4","resolution":{"observed_at":"2026-06-29T22:54:01.258423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.26316","last_updated":"2026-05-25T20:13:16Z","snapshot_observed_at":"2026-08-01T03:37:55.526828Z","submitted_at":"2026-05-25T20:13:16Z","title":"E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T22:24:38.389294Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.26316"},"observation_digest":"sha256:5284ef027833dd700682c12129a9d071f61670e3a76ca725200ec38d747acbd3","observation_id":"efd13db0-9838-44ad-b89a-de5b1a5fe1ec","resolution":{"observed_at":"2026-06-29T22:34:02.518078Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.27367","last_updated":"2026-05-29T09:30:04Z","snapshot_observed_at":"2026-07-06T23:37:08.167449Z","submitted_at":"2026-05-26T17:59:20Z","title":"SpatialBench: Is Your Spatial Foundation Model an All-Round Player?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T17:49:58.532910Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.27367"},"observation_digest":"sha256:ed5530f0a63ef257826bbef6f3935e98360bf7f8017c1ab63f31c3edc95d6f92","observation_id":"b7c3623e-bb06-438f-b00d-135e96df0176","resolution":{"observed_at":"2026-06-29T17:53:47.231792Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.30215","last_updated":"2026-05-29T15:11:53Z","snapshot_observed_at":"2026-07-06T23:39:34.232661Z","submitted_at":"2026-05-28T16:47:48Z","title":"D\\'ej\\`a View: Looping Transformers for Multi-View 3D Reconstruction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T07:53:47.182428Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.30215"},"observation_digest":"sha256:a8c5de96c08652621ca5df66bcb44e8d7ead572570f38b9846be9602f3f1ff54","observation_id":"621d0eac-5e7b-483f-9c53-92522c5d6725","resolution":{"observed_at":"2026-06-29T08:03:14.806190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.00299","last_updated":"2026-05-29T19:28:07Z","snapshot_observed_at":"2026-08-02T16:30:13.912725Z","submitted_at":"2026-05-29T19:28:07Z","title":"Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T22:41:00.915004Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.00299"},"observation_digest":"sha256:85e9b4c613aea3cdec72896d68429eca147577be5c507386573102ebf34be716","observation_id":"4fafd784-67b3-4655-a3ac-c8a82bec463b","resolution":{"observed_at":"2026-06-28T22:42:46.305020Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:58dd4ea24744c4a5f8db7c110823540f267e996ad727fb489e199204336dd85d","observation_id":"9019bc42-fd4a-447f-957b-cc5754fa7688","resolution":{"observed_at":"2026-07-01T22:26:16.859130Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.06761","last_updated":"2026-06-04T22:57:34Z","snapshot_observed_at":"2026-08-02T22:20:29.410137Z","submitted_at":"2026-06-04T22:57:34Z","title":"AxisGuide: Grounding Robot Action Coordinate System in RGB Observations for Robust Visuomotor Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T00:47:21.667833Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.06761"},"observation_digest":"sha256:9aae2b3b1e789627fb29a2e634bd223b5fec1f84d0f4b583b7fc93eddec88fb3","observation_id":"5851a2c9-c424-4eb4-b171-47e9ec4bf249","resolution":{"observed_at":"2026-07-02T13:56:59.956973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.07967","last_updated":"2026-06-06T03:50:45Z","snapshot_observed_at":"2026-07-06T23:47:33.680573Z","submitted_at":"2026-06-06T03:50:45Z","title":"DisCo: World Models with Discrete Camera Motion Control","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T20:21:20.257532Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.07967"},"observation_digest":"sha256:e2e6ef7e41abfe481ebc4c47d9ec4a2a550e235b56c9a08621af578f4ed55ce4","observation_id":"a0127a6e-6cdd-4cae-b422-9250a04e44e0","resolution":{"observed_at":"2026-07-02T20:37:22.483395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.09828","last_updated":"2026-06-08T17:59:54Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-08T17:59:54Z","title":"Latent Spatial Memory for Video World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:42.761342Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.09828"},"observation_digest":"sha256:8d88fd64b7b386e68d25571da2e63ab9ab86cdfcd336969ed0c56105931e18c6","observation_id":"fdea7b39-f900-4423-9899-f08518edf7b8","resolution":{"observed_at":"2026-07-03T01:07:30.512664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-02T11:59:13.661355Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.661355Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:53fcadc4bd0409ccbb56b64419e189a8ef7840ff06958dc69d12edfe081d32f0","observation_id":"00cd2fe4-f483-448b-980b-3c74cc225bf5","resolution":{"observed_at":"2026-08-02T11:59:13.661355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.11628","last_updated":"2026-06-10T03:49:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T03:49:01Z","title":"LUCID: Learning Embodiment-Agnostic Intent Models from Unstructured Human Videos for Scalable Dexterous Robot Skill Acquisition","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T10:02:54.183839Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.11628"},"observation_digest":"sha256:33a01bef8747fdb3f19fbc9804f2eb4c5fa9d4fcab5537e8cb70c446090af3da","observation_id":"2a42b90b-6bee-4b8e-bf7b-51aca9257bf0","resolution":{"observed_at":"2026-07-03T10:27:56.256556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.17200","last_updated":"2026-06-15T18:40:18Z","snapshot_observed_at":"2026-08-04T22:44:21.289174Z","submitted_at":"2026-06-15T18:40:18Z","title":"ACE-Ego-0: Unifying Egocentric Human and Robotic Data for VLA Pretraining","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T03:25:39.450667Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.17200"},"observation_digest":"sha256:198c95bdce151cf8370049185c26cbb560d16ba7967f7b5c2e0e3b8a6039f767","observation_id":"bb2e2d18-f469-431a-8500-140a4fbd3f53","resolution":{"observed_at":"2026-07-03T17:58:47.609130Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.17730","last_updated":"2026-06-16T09:47:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-16T09:47:32Z","title":"ActWorld: From Explorable to Interactive World Model via Action-Aware Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T01:22:12.771098Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.17730"},"observation_digest":"sha256:1efd236186d1e7a5d4f8106ccc9f99bae46e76043e84a39a9fe6b1c89556c1ae","observation_id":"e427c711-aad7-4a2e-a3e2-eb0a3a550b22","resolution":{"observed_at":"2026-07-03T20:28:55.419026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.18478","last_updated":"2026-06-23T08:04:55Z","snapshot_observed_at":"2026-08-05T20:33:40.212920Z","submitted_at":"2026-06-16T20:38:30Z","title":"Data-Forcing Distillation: Restoring Diversity and Fidelity in Few-Step Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T00:55:20.691480Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.18478"},"observation_digest":"sha256:eb443d80124f91d90e6ce81ddcb351e1a2d255a37f8ec1745b2afaf76bba0536","observation_id":"8b687c3f-6c14-4bb0-87d2-286a6db8365e","resolution":{"observed_at":"2026-07-03T21:08:58.066777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.18558","last_updated":"2026-06-17T00:19:00Z","snapshot_observed_at":"2026-07-06T23:53:59.519305Z","submitted_at":"2026-06-17T00:19:00Z","title":"MolmoMotion: Forecasting Point Trajectories in 3D with Language Instruction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T21:27:47.702578Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.18558"},"observation_digest":"sha256:73385503d4560a40bb5e1fb40a9d4b6424e5588f8b9eb52c50fa6fe4d78a3897","observation_id":"0d251bab-5258-4fab-abb3-fce1e3724403","resolution":{"observed_at":"2026-07-04T00:09:14.683704Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T05:14:02.088474Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:2bf8642d09869166a78f5e9468d7d0a0ccbe6022a51bf1691477729360650a4a","observation_id":"d37e6d7a-ba9a-47b9-a2bf-5c46fe64613a","resolution":{"observed_at":"2026-07-04T13:29:51.201029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:c0c4cbe89fb8cbd09b59d2bdc90b480dd7ecfa9201f532b575234fd7335fb280","observation_id":"dd5ffa46-a47f-4bb6-bd16-89516db5d2fe","resolution":{"observed_at":"2026-06-29T20:03:57.034678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2607.00033","last_updated":"2026-06-22T22:54:33Z","snapshot_observed_at":"2026-08-02T14:44:29.433999Z","submitted_at":"2026-06-22T22:54:33Z","title":"Learning Dexterous Manipulation Using Contact Wrench Guidance From Human Demonstration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-02T21:23:41.550666Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.00033"},"observation_digest":"sha256:e9634477eaeedd08b1f4e5e43129008ae45e1286e05e0a47a5730cfcbe83d005","observation_id":"e97d636b-4074-4783-b4d0-d2870357e2ab","resolution":{"observed_at":"2026-07-02T21:27:24.147481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2607.01202","last_updated":"2026-07-01T17:41:00Z","snapshot_observed_at":"2026-08-02T00:15:40.296985Z","submitted_at":"2026-07-01T17:41:00Z","title":"World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T13:21:51.983252Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.01202"},"observation_digest":"sha256:32213d003f57fb7f8815fe12c1b742cf345339ce12d3ff8627c68e5f385a48a2","observation_id":"ce6876d3-711d-41f6-aff8-84a244a2b748","resolution":{"observed_at":"2026-07-02T13:26:58.547644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2607.01962","last_updated":"2026-07-02T09:56:50Z","snapshot_observed_at":"2026-07-07T00:07:28.231599Z","submitted_at":"2026-07-02T09:56:50Z","title":"NeoMap: Training-free Novel-View Synthesis from Single Images and Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T15:45:57.331627Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.01962"},"observation_digest":"sha256:e827df80d5be656a05e1145721c967ed0c848266ea6cf4ba36d7d6b62fe4d20f","observation_id":"545f1f90-fd40-4e63-97e2-a15d201685dc","resolution":{"observed_at":"2026-07-03T15:48:34.941777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Vipe: Video pose engine for 3d geometric perception","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-01T16:41:46.594733Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:839f0a0342d2ab12fa30919a4851ace6de1c5abe8fc14534c573716bb023dc86","observation_id":"73d02371-1657-4b9d-8436-ca6763d504ee","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-12T05:16:19.750976Z","title":"arXiv preprint arXiv:2508.10934 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03043","last_updated":"2026-07-03T07:33:28Z","snapshot_observed_at":"2026-08-02T22:57:10.179879Z","submitted_at":"2026-07-03T07:33:28Z","title":"Natural Language Camera Movement Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T05:16:19.750976Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.03043"},"observation_digest":"sha256:e9f456993d6fa929f3be8ae5f3d2312a03f188377c311624f2dff7930d0d005b","observation_id":"6e909dc1-1cde-4dce-8b22-1afaed5412f1","resolution":{"observed_at":"2026-07-12T05:16:19.750976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-03T09:38:13.465849Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:c3799bb4c929217d1bb8b22f23374232cd345e4e2258d9397e51e57807c30878","observation_id":"f03ed958-acec-4046-9f5b-a3ccd858fc16","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-13T01:26:27.220907Z","title":"Vipe: Video pose engine for 3d geometric perception","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09655","last_updated":"2026-07-10T17:54:14Z","snapshot_observed_at":"2026-08-03T01:51:05.041314Z","submitted_at":"2026-07-10T17:54:14Z","title":"OpenLongTail: Generative Scaling of Long-Tail Driving Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T01:26:27.220907Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.09655"},"observation_digest":"sha256:12a4e0a82ecd1e5e19d1c8c22e87073f68103eda37d8ae7f8d24cf2edb61eeeb","observation_id":"72dc13b1-f268-403a-8f4b-f115cf2a3f16","resolution":{"observed_at":"2026-07-13T01:26:27.220907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-14T06:12:39.874258Z","title":"doi:10.48550/arXiv.2508.10934 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11221","last_updated":"2026-07-13T08:13:42Z","snapshot_observed_at":"2026-07-16T23:19:16.213386Z","submitted_at":"2026-07-13T08:13:42Z","title":"HandFlow: Fully Generative 4D Hand Recovery with Flow Matching","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-14T06:12:39.874258Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.11221"},"observation_digest":"sha256:ffc1d5a3c0cf671d7fe9d518118260b095351b7d4b11750a164f9fef00351638","observation_id":"0b95c27a-663c-4565-a43f-92b15bb87d51","resolution":{"observed_at":"2026-07-14T06:12:39.874258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-02T08:26:46.009177Z","title":"In: NVIDIA Research Whitepapers arXiv:2508.10934 (2025) 2, 4, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12214","last_updated":"2026-07-29T11:22:32Z","snapshot_observed_at":"2026-08-02T08:26:44.633089Z","submitted_at":"2026-07-07T04:35:58Z","title":"Robust 4D Driving Scene Reconstruction from Imperfect Visual Priors","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:26:46.009177Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.12214"},"observation_digest":"sha256:b1ecfe3f09ab9f8929684e09d6a80353609065b8343d54a72731ccc23ee7c555","observation_id":"feec1ee8-8fed-4c79-8831-a959acd8aa3d","resolution":{"observed_at":"2026-08-02T08:26:46.009177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-02T06:34:26.997724Z","title":"Vipe: Video pose engine for 3d geometric perception","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12503","last_updated":"2026-07-15T03:49:06Z","snapshot_observed_at":"2026-08-02T06:34:23.419238Z","submitted_at":"2026-07-14T08:35:07Z","title":"DynTrace: Tracking Dynamic Object Evidence for 4D Spatio-Temporal Reasoning in MLLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:26.997724Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.12503"},"observation_digest":"sha256:f9690fb153ac75e2c1f6376d5f778550d9191f105cf7df18491cdee02d3d4e98","observation_id":"baddc748-00ff-4ac2-b4ba-89d73ecf2f26","resolution":{"observed_at":"2026-08-02T06:34:26.997724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-01T15:48:25.392523Z","title":"Huang, Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18367","last_updated":"2026-07-20T17:15:41Z","snapshot_observed_at":"2026-08-04T03:34:54.349986Z","submitted_at":"2026-07-20T17:15:41Z","title":"AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:48:25.392523Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.18367"},"observation_digest":"sha256:90f69bb60cc444f94f93cdd2b02b5b378628ad2ccd9b195258efbbd3a28a2f71","observation_id":"033b55f8-43ca-4739-9a05-dcdb41d00f9a","resolution":{"observed_at":"2026-08-01T15:48:25.392523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-01T11:30:23.320268Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19880","last_updated":"2026-07-29T15:29:23Z","snapshot_observed_at":"2026-08-01T23:36:16.294330Z","submitted_at":"2026-07-22T08:10:49Z","title":"EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:30:23.320268Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.19880"},"observation_digest":"sha256:6584b16971d24b166f216d3f7ad2d266d226df4694d0c51f73681729fda12cd3","observation_id":"31dc67c3-1838-4793-98a2-adf005e3c265","resolution":{"observed_at":"2026-08-01T11:30:23.320268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-31T11:10:41.534992Z","title":"CoRRabs/2508.10934(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24591","last_updated":"2026-07-27T15:55:08Z","snapshot_observed_at":"2026-08-05T09:57:44.458785Z","submitted_at":"2026-07-27T15:55:08Z","title":"CameraAnything: Refilming Videos with Arbitrary Camera Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T11:10:41.534992Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.24591"},"observation_digest":"sha256:51add261ad28e0e623b11601070ae21deec4c16aa686a8ddbbff956857fb7b7e","observation_id":"f0baae83-eb91-4d95-b77b-1bfcd4f1f48e","resolution":{"observed_at":"2026-07-31T11:10:41.534992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-30T13:50:35.848047Z","title":"arXiv:2508.10934 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27194","last_updated":"2026-07-29T17:58:04Z","snapshot_observed_at":"2026-08-02T00:28:26.235786Z","submitted_at":"2026-07-29T17:58:04Z","title":"VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T13:50:35.848047Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.27194"},"observation_digest":"sha256:2d3122fbf74203a6a6a3631e149d2032ad2468c48089ca730fe45dbebc754bf3","observation_id":"4ad8219b-8733-473a-adff-699b5e121b8e","resolution":{"observed_at":"2026-07-30T13:50:35.848047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-06T18:39:28.517132Z","title":"Vipe: Video pose engine for 3d geometric perception","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04701","last_updated":"2026-08-05T11:10:52Z","snapshot_observed_at":"2026-08-06T18:32:04.849899Z","submitted_at":"2026-08-05T11:10:52Z","title":"UniWorld-View: Large-Baseline View Synthesis via Video Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:39:28.517132Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2608.04701"},"observation_digest":"sha256:e38f63e1f287070239e4970a93aacf0365003061ac6c217d96eb106c09262716","observation_id":"dc20168e-7ce9-4952-a3ef-a3f10fd3146e","resolution":{"observed_at":"2026-08-06T18:39:28.517132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.10934/citation-record","integrity":"/paper/2508.10934/integrity","json":"/paper/2508.10934/citation-record.json","paper":"/paper/2508.10934"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:4a238fd9b54d5b630bc47b335269292e57e7f0c7914119e6049d10b688170bed","observation_id":"9183893f-1457-4eb2-9d8f-cea04e2bebd3","resolution":{"observed_at":"2026-05-16T16:41:08.695393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14492","last_updated":"2025-04-01T21:14:20Z","snapshot_observed_at":"2026-07-06T20:54:50.337775Z","submitted_at":"2025-03-18T17:57:54Z","title":"Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control","version":2},"cited_work":{"arxiv_id":"2503.14492","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.14492","snapshot_observed_at":"2026-07-04T04:09:35.034771Z","title":"arXiv preprint arXiv:2503.14492 (2025)","venue":null,"work_id":"f6758fe8-a1a6-4b00-9094-edba697f4c67","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.14492","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:0a4a9f28a55da8c07702c6bb7c93ddf1bbe7fa299867841cd6fc0315e26ad944","observation_id":"3ba50032-e5d0-456e-979a-531c29d79df5","resolution":{"observed_at":"2026-05-16T16:41:08.660028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.13078","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L4P: Low-level 4D vision perception unified","venue":null,"work_id":"bd61ab0e-c22e-42a4-98c2-c3d9d91f1b5c","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e7eb4553e215c31694f15ffc63e8aec6be4114707010471e5746665abaf7c166","observation_id":"b5aa1de4-235a-486d-8b9c-9c140ce4df57","resolution":{"observed_at":"2026-05-16T16:41:08.698598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08897","last_updated":"2022-01-12T08:19:29Z","snapshot_observed_at":"2026-07-06T12:09:19.763667Z","submitted_at":"2021-11-17T04:27:01Z","title":"ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data","version":3},"cited_work":{"arxiv_id":"2111.08897","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.08897","snapshot_observed_at":"2026-07-04T06:19:37.435697Z","title":"ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data","venue":"cs.CV","work_id":"0ce910be-ca1c-44c7-b7b1-c5353759d85e","year":2021},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2111.08897","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:84df21d7a1178ade26ddfa789f3af585afbbfa2bf4e1c6f4ec904d98cca42e24","observation_id":"7166d083-23dd-440e-9ff0-bc3fc06dcdeb","resolution":{"observed_at":"2026-05-16T16:41:08.712162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":"2410.02073","doi":"10.48550/arxiv.2410.02073","metadata_source":"pith","pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","venue":"cs.CV","work_id":"0b67883b-1901-45f1-9d58-1ef7a928df23","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:754bc17f45929d85e37644474fe9623f100e95df4c25c37032e05eed7ebbda44","observation_id":"d962698f-7479-43e5-b69b-777656682563","resolution":{"observed_at":"2026-05-16T16:41:08.743749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ea2953c-7765-45b4-8155-bfc5039ed53e","year":2012},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:6371cf8ff1b45da77b711680687815c50db568a67fe78c402c8b83c885f5c2a2","observation_id":"24e431f6-d8cc-4063-a02b-83e50ee6a9e7","resolution":{"observed_at":"2026-05-16T16:41:08.825112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cabon, L","venue":null,"work_id":"ef4c3043-3147-4043-869b-67f16283c3b3","year":null},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:5cabc3a01893ad21280b46312baa175819f5f89e9916ef01b7eed1c59bdf3dae","observation_id":"c6085d88-6492-41f3-ad45-59440f72aee8","resolution":{"observed_at":"2026-05-16T16:41:08.827455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Campos, R","venue":null,"work_id":"63f94830-acc2-4a97-835a-bd505128bcfd","year":2021},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:d302eefb7ecb06cc202fc1a205927eac3442ccdefdf0613b6fd264b06ff97604","observation_id":"826f05cc-ad41-4330-bcaa-d6e128e78835","resolution":{"observed_at":"2026-05-16T16:41:08.829418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12375","last_updated":"2025-06-15T03:50:49Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:53:30Z","title":"Video Depth Anything: Consistent Depth Estimation for Super-Long Videos","version":3},"cited_work":{"arxiv_id":"2501.12375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12375","snapshot_observed_at":"2026-07-04T20:00:07.459591Z","title":"Video depth anything: Consistent depth estimation for super-long videos","venue":null,"work_id":"83e140fd-6eb9-4d1c-a155-d86ac7e58124","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2501.12375","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:7b2051429daad7f8dbdf773ddacc0fbb38a31059252712ab21aaf3229f0d999e","observation_id":"3a193b00-fc7b-44d1-a0ab-53127283cb3e","resolution":{"observed_at":"2026-05-16T16:41:08.727344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"19400849-32ad-4dda-b745-76a474b8ba05","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:815c3570740ee2dbc370753c64d042a60a1f7dbf203de19d8610eab09a448b45","observation_id":"f72fa84d-12e7-4ede-bbb3-744c49bc2b58","resolution":{"observed_at":"2026-05-16T16:41:08.831286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.24391","doi":"10.48550/arxiv.2503.24391","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Easi3r: Estimating disentangled motion from dust3r without training.arXiv preprint arXiv:2503.24391","venue":"arXiv (Cornell University)","work_id":"9b470754-5abe-4d7b-9432-7a5af17ec3de","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:0d90c10bafd76109e60de2edcd771f978d1b2e40083aae844580efce5f17d977","observation_id":"6452d8fc-d695-4335-b7d1-eb413e225c8e","resolution":{"observed_at":"2026-05-16T16:41:08.772801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"627dd7e2-c907-40e3-a832-a8e1418fedd8","year":2022},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:18bdc2a78f50f7adc38d2e251afcc20a052e4633b0db558d736197a3ad365d6c","observation_id":"77f5bed1-a780-4a53-911c-01b7a2225cf8","resolution":{"observed_at":"2026-05-16T16:41:08.833625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06558","last_updated":"2023-05-11T04:33:08Z","snapshot_observed_at":"2026-08-03T19:49:16.800693Z","submitted_at":"2023-05-11T04:33:08Z","title":"Segment and Track Anything","version":1},"cited_work":{"arxiv_id":"2305.06558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.06558","snapshot_observed_at":"2026-06-29T18:13:49.304240Z","title":"arXiv preprint arXiv:2305.06558 (2023)","venue":null,"work_id":"3adaf7b1-65ed-4639-bb5a-f427052b8b58","year":2023},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2305.06558","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:c77eb4c61dda540fb88a6353356d3fbcf14be9e6ed391ee8c0f715c8420596cb","observation_id":"f9e0e54b-bce0-41ea-a5b5-a435ff99900e","resolution":{"observed_at":"2026-05-16T16:41:08.664360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07093","last_updated":"2025-05-30T21:03:14Z","snapshot_observed_at":"2026-07-06T21:06:50.056353Z","submitted_at":"2025-04-09T17:59:31Z","title":"FlashDepth: Real-time Streaming Video Depth Estimation at 2K Resolution","version":2},"cited_work":{"arxiv_id":"2504.07093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07093","snapshot_observed_at":"2026-06-29T23:24:02.096945Z","title":"Flashdepth: Real-time streaming video depth es- timation at 2k resolution.arXiv preprint arXiv:2504.07093","venue":null,"work_id":"e4752a57-77ba-4ab6-90df-9b191b773b7b","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.07093","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e4a594d0c25f9a2b648eb5072c98e9e215985f5833834cb676c8c4aeabe288e5","observation_id":"b810851c-6cef-429e-8408-c33ae60a7652","resolution":{"observed_at":"2026-05-16T16:41:08.668835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01933","last_updated":"2025-07-10T17:55:35Z","snapshot_observed_at":"2026-07-06T21:35:12.872021Z","submitted_at":"2025-06-02T17:53:09Z","title":"E3D-Bench: A Benchmark for End-to-End 3D Geometric Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.01933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01933","snapshot_observed_at":"2026-06-29T17:53:47.161627Z","title":null,"venue":null,"work_id":"e4e6a748-92cf-45b8-87db-46338bbdb410","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2506.01933","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:a2ee6fcf265a9b30b588a20414a57bd8d1ea0f8164b21de2df40cb109d49436c","observation_id":"3c0444e5-78c2-4a3f-a7cc-1c5b2ce80026","resolution":{"observed_at":"2026-05-16T16:41:08.672657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf675488-812d-425e-9c38-af600df92310","year":2004},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:6a037949171eea4802c39ed2395d9d5396b012652bf44e8c1b872c8d5679b1af","observation_id":"c32c3178-cf42-45ee-83ef-3ae0b9bc7415","resolution":{"observed_at":"2026-05-16T16:41:08.835697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9188f82c-4933-46fc-bb6c-71599a1a331b","year":2007},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:7e9c00582cd24d35b344067fd0fa99a86897ffd44b5a87aea610d2f94c59f56e","observation_id":"4cd61abe-c21e-4b3c-9d97-3a8d50201db7","resolution":{"observed_at":"2026-05-16T16:41:08.837638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19152","last_updated":"2024-09-27T21:29:58Z","snapshot_observed_at":"2026-08-04T22:29:38.303623Z","submitted_at":"2024-09-27T21:29:58Z","title":"MASt3R-SfM: a Fully-Integrated Solution for Unconstrained Structure-from-Motion","version":1},"cited_work":{"arxiv_id":"2409.19152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.19152","snapshot_observed_at":"2026-07-02T08:16:48.422892Z","title":"Mast3r- sfm: a fully-integrated solution for unconstrained structure- from-motion","venue":null,"work_id":"9a1f3a5b-a34a-4b71-a3b9-d85ecdeb30b5","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2409.19152","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:39366b8ed354c5df208e33860148ca12718562f4a7978c36a6392c55482c5bfe","observation_id":"e3d5ec84-9ab6-45e4-a168-d1273a78ab9a","resolution":{"observed_at":"2026-05-16T16:41:08.724694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elflein, Q","venue":null,"work_id":"9f0352da-5e13-4cb0-bf58-b5374c8310f8","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:ad75d81e8fd0837a9eab8122db674b5131a8ff2e45dbca42ee188b9ce3d5d422","observation_id":"8d4af2a0-f24c-44f9-b0a4-517590ff0a21","resolution":{"observed_at":"2026-05-16T16:41:08.839769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Engel, V","venue":null,"work_id":"4a255ae8-bb6e-491f-a10a-fe19074bbe46","year":2017},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:a127fb415bceda4a9af14b1795f3cf7f49c43e9d9a9f128524558b0deba8c1b2","observation_id":"9b493929-0b1a-43ce-b05b-ed003012fa2e","resolution":{"observed_at":"2026-05-16T16:41:08.841792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13152","last_updated":"2025-04-17T17:55:58Z","snapshot_observed_at":"2026-07-06T21:11:05.749637Z","submitted_at":"2025-04-17T17:55:58Z","title":"St4RTrack: Simultaneous 4D Reconstruction and Tracking in the World","version":1},"cited_work":{"arxiv_id":"2504.13152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13152","snapshot_observed_at":"2026-07-04T00:09:14.685799Z","title":"St4rtrack: Simultaneous 4d reconstruction and tracking in the world.arXiv preprint arXiv:2504.13152","venue":null,"work_id":"fa447280-9ed8-4247-923b-15611ad5d4d5","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.13152","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:f7a820b05d44aff34e1b5528ac90f02b6b30baa47e678fab66e2a22558cc0356","observation_id":"1f51c017-601f-46eb-9970-c7f4b3a90529","resolution":{"observed_at":"2026-05-16T16:41:08.759482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":"2405.10314","doi":"10.48550/arxiv.2405.10314","metadata_source":"pith","pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","venue":"cs.CV","work_id":"16da851d-11ab-482c-8a09-2978d97a967c","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:0aaebe81e071a574d8f890540e46f8d1e863f338653bfd9e9e0d4d5fca050066","observation_id":"400e9a2a-3fad-42ef-bb16-89b3daf26435","resolution":{"observed_at":"2026-05-19T21:29:51.322354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geiger, P","venue":null,"work_id":"553f9562-8c08-4041-8101-d379693cee7e","year":2012},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:3832eb8dc948267d731c3107ab9dbc2364386cdf40f94f79c4df0cabf2d92a5d","observation_id":"98bcb9fa-885b-46f3-8e09-2c35e314d2bf","resolution":{"observed_at":"2026-05-16T16:41:08.843891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18650","last_updated":"2024-11-27T01:09:56Z","snapshot_observed_at":"2026-08-02T18:37:49.450385Z","submitted_at":"2024-11-27T01:09:56Z","title":"RoMo: Robust Motion Segmentation Improves Structure from Motion","version":1},"cited_work":{"arxiv_id":"2411.18650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18650","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fleet, Saurabh Saxena, and Andrea Tagliasacchi","venue":null,"work_id":"bf2183ca-4af1-4060-a06a-0ffd6cdf0c35","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2411.18650","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:495ed5d33eae4c440b5911d509e6416ce6ccb580b0be3e74ad2be8074b2dd382","observation_id":"6337ad44-b4ed-402d-a017-08de411ead96","resolution":{"observed_at":"2026-05-16T16:41:08.803452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Greff, F","venue":null,"work_id":"f171a479-c665-46ee-a9f8-be5fb8aae0c7","year":2022},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:5732feda406521a0dd36b04854c83dacb69a37adff0645bc6ed92375ba611ebe","observation_id":"be87dce9-eece-4835-bc13-2b976573d9f5","resolution":{"observed_at":"2026-05-16T16:41:08.845990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hagemann, M","venue":null,"work_id":"b217cb48-549b-446a-a10d-309fabc10ff9","year":2023},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:3c0120a60760d9f41ef5a576d2a8af048227d595a69b19d1f6bc9429a48d9454","observation_id":"ba62415d-a62b-4fc9-9fcc-85f2d744ab6c","resolution":{"observed_at":"2026-05-16T16:41:08.848249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cc0df9db-20aa-4ee7-bcc5-38bea6996cd4","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e267b9affd1c518b0fe0af1548e4bb837159fcbaeb02a6e5a0e1f7464faea9d2","observation_id":"cae54642-59fc-45b0-8d61-39228b08234f","resolution":{"observed_at":"2026-05-16T16:41:08.850331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Huang, Z","venue":null,"work_id":"393d433b-8a18-4a2c-9ece-fb15e64a129c","year":2023},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:721e91cc85d29a5162f3194be4d17ef2f295d5b3f09a761bd3e0189f42416bdf","observation_id":"e60f33b9-f93b-4175-bbd7-b726add6099a","resolution":{"observed_at":"2026-05-16T16:41:08.852322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22268","last_updated":"2025-04-14T05:34:33Z","snapshot_observed_at":"2026-07-06T21:00:12.835346Z","submitted_at":"2025-03-28T09:34:11Z","title":"Segment Any Motion in Videos","version":2},"cited_work":{"arxiv_id":"2503.22268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.22268","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Huang, W","venue":null,"work_id":"de29ae91-96b1-4cb7-aa78-35a516e0444c","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.22268","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e2f4d0465af48991d8112d3dcc3be611508685db650a8d7143cde3ce77948019","observation_id":"8a4d1647-1cab-484b-b7c7-49b81f032a82","resolution":{"observed_at":"2026-05-16T16:41:08.691831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Izquierdo, M","venue":null,"work_id":"09ef2f67-961e-443b-9123-468fa59002de","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:9c26a3895e06b285c73c77893fb59363376b89f2196b79c5b874823fe2ee402a","observation_id":"c2a1dd6e-9744-42b8-af77-1d93896df6a4","resolution":{"observed_at":"2026-05-16T16:41:08.854559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07961","last_updated":"2025-08-19T17:06:41Z","snapshot_observed_at":"2026-07-06T21:07:29.062389Z","submitted_at":"2025-04-10T17:59:55Z","title":"Geo4D: Leveraging Video Generators for Geometric 4D Scene Reconstruction","version":2},"cited_work":{"arxiv_id":"2504.07961","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07961","snapshot_observed_at":"2026-07-02T03:16:34.893073Z","title":"Geo4d: Leveraging video generators for geometric 4d scene reconstruction","venue":null,"work_id":"21d72b6e-c886-4f7a-8b2b-8fda9e23a9de","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.07961","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:9aeaca46f7c30d02b05d09253016f0cdbdcfbd85302fb7b3745171a8c9edcbbf","observation_id":"f96d2c12-6e58-42c6-9cab-5232b417407e","resolution":{"observed_at":"2026-05-16T16:41:08.702096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17242","last_updated":"2025-04-02T21:12:32Z","snapshot_observed_at":"2026-08-02T01:59:04.180455Z","submitted_at":"2024-10-22T17:58:28Z","title":"LVSM: A Large View Synthesis Model with Minimal 3D Inductive Bias","version":2},"cited_work":{"arxiv_id":"2410.17242","doi":"10.48550/arxiv.2410.17242","metadata_source":"pith","pith_arxiv_id":"2410.17242","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lvsm: A large view synthesis model with minimal 3d inductive bias","venue":"cs.CV","work_id":"c5e225cf-22b3-4efa-a3c4-5346587616d0","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2410.17242","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:785534fb04f2c647ecb71b69779947941f42d40db805b9aec830da73c40d3a25","observation_id":"58f12c8b-28f3-439e-a3fb-a9387c13fdb5","resolution":{"observed_at":"2026-05-16T16:41:08.705461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09621","last_updated":"2025-04-30T17:59:59Z","snapshot_observed_at":"2026-07-06T20:06:09.333397Z","submitted_at":"2024-12-12T18:59:54Z","title":"Stereo4D: Learning How Things Move in 3D from Internet Stereo Videos","version":2},"cited_work":{"arxiv_id":"2412.09621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09621","snapshot_observed_at":"2026-07-04T00:09:14.742412Z","title":"Stereo4d: Learning how things move in 3d from internet stereo videos","venue":null,"work_id":"60386724-ce3e-4172-8cb8-535714f65c33","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2412.09621","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:7de4be9cfdcc269c7c096aeb202011c1e1b0146ed8d0707576abbded8c553850","observation_id":"24163c13-7020-473e-be21-f1c24a2d0b35","resolution":{"observed_at":"2026-05-16T16:41:08.708909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kirillov, E","venue":null,"work_id":"9e6163d2-30a2-4432-b701-3087e85f892f","year":null},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:920655f2c7abe58d6a15e783e4fa20556eb489066b944467841be1a5cfde6cbb","observation_id":"2d426b25-98a9-4471-8e2c-9a6e67dfb945","resolution":{"observed_at":"2026-05-16T16:41:08.856802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04359","last_updated":"2025-07-08T16:53:53Z","snapshot_observed_at":"2026-08-02T10:58:35.732937Z","submitted_at":"2025-06-04T18:20:17Z","title":"cuVSLAM: CUDA accelerated visual odometry and mapping","version":3},"cited_work":{"arxiv_id":"2506.04359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04359","snapshot_observed_at":"2026-06-30T05:54:18.364459Z","title":"Korovko, D","venue":null,"work_id":"c61a3ec7-8e40-426e-97ad-0199e6bbf81d","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2506.04359","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:75ab2c2d87094b093a7535266118dda4da5b8c8215936c7b7d25be7f1b8349c2","observation_id":"5e408a9c-6af0-4e7f-9064-0fe9c404145b","resolution":{"observed_at":"2026-05-16T16:41:08.718654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Leroy, Y","venue":null,"work_id":"6942b8d6-b8e2-4ead-a6d3-d4d4d6daca59","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:68eeee448f1287e0942b74a0a8381e7daf72ef0867b14766b17d16bc8d476d3b","observation_id":"d8ff1649-cc65-4145-b5d5-8e3ed0366ddb","resolution":{"observed_at":"2026-05-16T16:41:08.858812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6f711223-b9f0-4a09-9c65-c8e63c8097a7","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:aa1caa64c6b0d4a49c8dbcd349e6739c60addddf71b601fda7d002f4a88cd916","observation_id":"401f1122-0d54-4176-b6f1-413ca36d2186","resolution":{"observed_at":"2026-05-16T16:41:08.860807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.03526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T04:37:36.941611Z","title":"Feed-forward bullet-time reconstruction of dynamic scenes from monocular videos.arXiv preprint arXiv:2412.03526","venue":null,"work_id":"6573079c-d826-4be0-bfab-a0187e928bb8","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:50f27ace7a0370c602820d4cffa141015ff59df2e07cbc2cd2b955b8cd97083e","observation_id":"b2b8966b-0b2e-46e8-8b3f-904c4cbf4fd1","resolution":{"observed_at":"2026-05-16T16:41:08.737265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15376","last_updated":"2025-08-29T09:26:15Z","snapshot_observed_at":"2026-07-06T21:12:41.611519Z","submitted_at":"2025-04-21T18:34:57Z","title":"Towards Understanding Camera Motions in Any Video","version":2},"cited_work":{"arxiv_id":"2504.15376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15376","snapshot_observed_at":"2026-07-04T17:40:00.919006Z","title":"arXiv preprint arXiv:2504.15376 , year=","venue":null,"work_id":"02d0d7d7-77ca-4683-b667-97635c707650","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.15376","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:1e7c025886da2f14c12957c1f0318bd914d5eb278e3e060319e281f63ecf8c9c","observation_id":"580e7ed0-d1f7-4435-968c-c454c2334b5e","resolution":{"observed_at":"2026-05-16T16:41:08.740824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lindenberger, P.-E","venue":null,"work_id":"69260d6e-a4af-4313-b764-6000d4ddc132","year":2023},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:855ad7feffdc01355c7feef52967f79d2bdb677b4de3d8d383f57c6344ed82f5","observation_id":"19220db6-059d-43f7-9459-7afea01c6083","resolution":{"observed_at":"2026-05-16T16:41:08.862538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.12356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c20b6963-61de-46b6-84e6-20e754b55bb1","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:f0a1ccd58f753f10266eab3634bd978781921797b1f32f02d706ce8ad015614f","observation_id":"3b2ea880-ce01-4969-83eb-c0f163632237","resolution":{"observed_at":"2026-05-16T16:41:08.750098Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f9f6e1f1-217f-4e0e-b603-5f14460a5d3f","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:6372c6b158030a65ccda7f765160389aeaa3f1e611ea4794fbf0be60b79fb42c","observation_id":"8346d5c3-8c9e-4c31-b133-6e5cf6243637","resolution":{"observed_at":"2026-05-16T16:41:08.864479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e75e1e52-47e2-406d-8a11-0136d6853a79","year":null},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:7ea6f1b5d85468a84a01eeec77127580a0910d1e5116fc01fbb37413d37dbb85","observation_id":"1b99981e-5b7c-497b-b8e9-b302b4cf8c64","resolution":{"observed_at":"2026-05-16T16:41:08.866630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cef36a04-85ae-4e6c-96a0-73bf58a7aeb2","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:fa50ac27e3d9e39099b0c440dab30d3358c27a21123017debc0ae974cdb60017","observation_id":"35628c4a-fc7a-4b5b-8755-c68dc7c868a7","resolution":{"observed_at":"2026-05-16T16:41:08.868473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03934","last_updated":"2025-06-26T03:10:09Z","snapshot_observed_at":"2026-07-06T20:01:59.108032Z","submitted_at":"2024-12-05T07:32:20Z","title":"InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models","version":2},"cited_work":{"arxiv_id":"2412.03934","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03934","snapshot_observed_at":"2026-07-04T15:19:56.464733Z","title":"Infinicube: Unbounded and controllable dynamic 3d driving scene generation with world-guided video models","venue":null,"work_id":"e9dc93b7-8e48-4f74-9686-a7457d46e994","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2412.03934","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:9e532bde47c1cc8957b89821cf9ed97c104472d8ce3ff0387083e3c5f560d614","observation_id":"dc688e9b-1c9e-417b-b76d-f2753adc3feb","resolution":{"observed_at":"2026-05-16T16:41:08.783877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d61ff353-8004-4534-9819-8dd0a091a071","year":1981},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:2e5587394d610c59430f8fa52a409493642463b759e0a8d5866415a55c9f5a52","observation_id":"68632b7a-9809-407e-a4fb-d82020fbf972","resolution":{"observed_at":"2026-05-16T16:41:08.870675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12549","last_updated":"2025-05-23T11:59:20Z","snapshot_observed_at":"2026-07-06T21:25:56.796553Z","submitted_at":"2025-05-18T21:33:09Z","title":"VGGT-SLAM: Dense RGB SLAM Optimized on the SL(4) Manifold","version":2},"cited_work":{"arxiv_id":"2505.12549","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12549","snapshot_observed_at":"2026-07-03T20:08:56.102340Z","title":"VGGT-SLAM: Dense RGB SLAM Optimized on the SL(4) Manifold","venue":"cs.CV","work_id":"01d7329c-ee37-4f18-a3e3-4e786084b162","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2505.12549","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:50c4a4c8cfd10244cbc77176d784f2539e95d297145855ed64dccf2325c8f882","observation_id":"f32a0497-d0e1-4107-b50d-2c73333e6c27","resolution":{"observed_at":"2026-05-20T21:03:14.770801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mei and P","venue":null,"work_id":"6c8800af-f321-4fe9-8e2f-e03f9a602d04","year":2007},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:601d19b1ea0242e6943713c518100032924b25c04691830cc693940ed3e95ff1","observation_id":"d56d6f06-29fc-420c-9266-534d02fcd280","resolution":{"observed_at":"2026-05-16T16:41:08.872968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mur-Artal, J","venue":null,"work_id":"bc92d07d-82d6-4981-843c-b05a278ce686","year":2015},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:d9fa3342f79ea423357d33e6f376a01a2b066e9e14a35ac06b16e24dd83b4083","observation_id":"aa081869-6a29-4736-88b0-5e62e84f9413","resolution":{"observed_at":"2026-05-16T16:41:08.875128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Murai, E","venue":null,"work_id":"902f05f4-de9d-4f90-be71-1e0b3ac450e4","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:bd051e57fdddbf8131b56bd5cf70c945917e4a5e52ec55c33b5fd70a6e365ebd","observation_id":"37f1c6ec-7e7d-4190-a1b2-811cd6937216","resolution":{"observed_at":"2026-05-16T16:41:08.877539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eee443b5-ba13-4092-8750-dbd20b7053bd","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e77fba992acd031702eeb5f263e19b8fe5569578a470c2f78c50d822d0f11b57","observation_id":"136d2961-74d5-4d9a-a36f-24e1f1970b75","resolution":{"observed_at":"2026-05-16T16:41:08.879451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16591","last_updated":"2025-03-20T17:49:23Z","snapshot_observed_at":"2026-07-06T20:56:18.361337Z","submitted_at":"2025-03-20T17:49:23Z","title":"UniK3D: Universal Camera Monocular 3D Estimation","version":1},"cited_work":{"arxiv_id":"2503.16591","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16591","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Piccinelli, C","venue":null,"work_id":"bcc47de4-c7b0-47fa-b060-e1b256f3381f","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.16591","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:0ad7936cc1f3921e9c37c356b1b488befbf8e00816156c7d9fa2333f4f601613","observation_id":"fd46f335-7ac0-41aa-bb2f-0bd93c2ff181","resolution":{"observed_at":"2026-05-16T16:41:08.676220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20110","last_updated":"2025-12-18T09:32:11Z","snapshot_observed_at":"2026-08-02T05:41:31.119340Z","submitted_at":"2025-02-27T14:03:15Z","title":"UniDepthV2: Universal Monocular Metric Depth Estimation Made Simpler","version":2},"cited_work":{"arxiv_id":"2502.20110","doi":"10.48550/arxiv.2502.20110","metadata_source":"pith","pith_arxiv_id":"2502.20110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UniDepthV2: Universal Monocular Metric Depth Estimation Made Simpler","venue":"cs.CV","work_id":"6454ebe4-40bc-4417-99b5-30dfb09f7a37","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2502.20110","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:f5384824b60dddbb9c77efa95eb52c9b0d3af1569b9af00bedfb0ab782c9a0ff","observation_id":"eed8ffc0-253e-4091-b1c1-66c31de15c3c","resolution":{"observed_at":"2026-05-17T09:11:04.541213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00783","last_updated":"2017-08-02T14:50:02Z","snapshot_observed_at":"2026-08-01T20:18:09.568313Z","submitted_at":"2017-08-02T14:50:02Z","title":"InfiniTAM v3: A Framework for Large-Scale 3D Reconstruction with Loop Closure","version":1},"cited_work":{"arxiv_id":"1708.00783","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.00783","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InfiniTAM v3: A Framework for Large-Scale 3D Reconstruction with Loop Closure","venue":"cs.CV","work_id":"93b3042e-d34e-49ac-8fc9-769d09b6c8eb","year":2017},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/1708.00783","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:dbfcf2266afb3590c567759a26307b26e48f1925afe64c1ab5d38f9278da4b2b","observation_id":"406936ec-8ca0-4bcf-bad1-9aa8eafbb3eb","resolution":{"observed_at":"2026-05-16T16:41:08.684248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09042","last_updated":"2025-06-18T17:37:28Z","snapshot_observed_at":"2026-08-06T16:08:28.837096Z","submitted_at":"2025-06-10T17:58:17Z","title":"Cosmos-Drive-Dreams: Scalable Synthetic Driving Data Generation with World Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.09042","doi":"10.48550/arxiv.2506.09042","metadata_source":"pith","pith_arxiv_id":"2506.09042","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, and Björn Ommer","venue":"cs.CV","work_id":"af51168b-8b82-45d2-bf85-e3d07f99492b","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2506.09042","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:8bfca79444f829ca4679ba3cc1b863f2ce628daf58f297c371c9c1effe5fe21e","observation_id":"6f8dc082-48a1-4e7e-b8e1-cd49056b9f8f","resolution":{"observed_at":"2026-05-16T16:41:08.688457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b862fd02-d177-4f1e-a8f4-ea99a838f211","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:7c8d3d2f05ecff6fe47df864db825d443477bbf6e8d1573664557b6c1311b9e8","observation_id":"1453e98a-45a5-457a-92e0-729f3cb25b3f","resolution":{"observed_at":"2026-05-16T16:41:08.881266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f77799a5-33cc-4af8-aac2-62ebfc1a90e3","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:b0993d398396ed85096f95c452fccc5b773b41d99b7fb5f57a8edb5f354f4ea3","observation_id":"adb28525-6395-44b8-b126-c3f6d85a64f0","resolution":{"observed_at":"2026-05-16T16:41:08.823259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rockwell, J","venue":null,"work_id":"9c2046e0-d60f-49b2-a54d-9e2a021b2957","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:6d746cd6fc3808ceedd52c4ac2bbea7246a5a7e79b8940976b710937a9dea6c6","observation_id":"eefc41d3-7e80-4b30-b622-36d78c33d11f","resolution":{"observed_at":"2026-05-16T16:41:08.883014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba9903d7-76df-44cf-a871-07feef1fb100","year":2016},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:909a2a59a185d5d1e94303ac5d511a308f70c444e0652a43ddf7ffffded6a42c","observation_id":"6600acbd-593c-442b-adb6-b023fb00443d","resolution":{"observed_at":"2026-05-16T16:41:08.884871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schops, T","venue":null,"work_id":"c628bd80-db0e-499e-935a-8e9507846591","year":2019},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:b403a34c82cbef85cc9df14bd0b6b6795f12a8393362e3f0f0f27282ec4c594e","observation_id":"02250345-73d3-4996-969d-c8ebf95876f6","resolution":{"observed_at":"2026-05-16T16:41:08.887075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shi et al","venue":null,"work_id":"bdc628b0-be3f-4c48-b7a5-a309b8ec077d","year":1994},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:41642027f923914f372620814c1fc7265d560fc0d0e580b9773b291da7502cca","observation_id":"a3266679-63e6-4907-b6f9-e6a9e668151b","resolution":{"observed_at":"2026-05-16T16:41:08.889102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sturm, N","venue":null,"work_id":"e043c89b-7520-45c4-8287-f62246963ca4","year":2012},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:e4e63be0fad6b561b346d74794f42d3beaf53fe966ff09b3bba0233f65468b03","observation_id":"7b697756-b698-4271-b5fb-f5ba85947e81","resolution":{"observed_at":"2026-05-16T16:41:08.891157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16318","last_updated":"2025-03-20T16:41:50Z","snapshot_observed_at":"2026-07-06T20:56:09.656767Z","submitted_at":"2025-03-20T16:41:50Z","title":"Dynamic Point Maps: A Versatile Representation for Dynamic 3D Reconstruction","version":1},"cited_work":{"arxiv_id":"2503.16318","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16318","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic point maps: A versatile representation for dynamic 3d reconstruction.arXiv preprint arXiv:2503.16318","venue":null,"work_id":"e2073fe9-f82a-4209-a77e-f2f9b0427f0b","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.16318","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:1147f47328e06cee8f5c4e13eb14f892239c476fa2baf05edb77bf851da33631","observation_id":"45161057-96c2-490f-8b81-4a9abee665ba","resolution":{"observed_at":"2026-05-16T16:41:08.715182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"49ff0b26-643b-49b5-9a28-775fb7594fc3","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:eeab9def1150b119b6d44077217536188b88fa96ceaceaa67af317bbe1f512f8","observation_id":"1d5e1d36-58e3-46f3-b5a8-503ec12b7b05","resolution":{"observed_at":"2026-05-16T16:41:08.892970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18945","last_updated":"2025-07-28T15:42:31Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:59:51Z","title":"Aether: Geometric-Aware Unified World Modeling","version":3},"cited_work":{"arxiv_id":"2503.18945","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.18945","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aether: Geometric-aware unified world modeling","venue":null,"work_id":"94b0c09b-afcc-4543-9462-3ac023a5fabd","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.18945","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:263d283ce1b00d8dd32ae06fb1582036db4376de7418ea06b114d4e78a3107f0","observation_id":"0efbcef6-b8fb-480a-b6f9-4bfa7ebf4626","resolution":{"observed_at":"2026-05-16T16:41:08.721717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Teed and J","venue":null,"work_id":"35636ce4-68b6-4753-a153-16e281fafb2b","year":2021},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:55ee0e300a6c643d9fa5d62248286c63cc8249a64de7fd7ba4721e4bdc02803b","observation_id":"82f444f6-26c6-4151-a5e2-6eeddd4a87e4","resolution":{"observed_at":"2026-05-16T16:41:08.894905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Veicht, P.-E","venue":null,"work_id":"7a31ade6-a627-443f-ba9a-46bc6702ce42","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:88a88f7baf2ef99ca6f997f21a6c8b5ef8d960bb89c847ef7a36c67cc35ed456","observation_id":"3cbd83ea-3d8c-4038-be51-d3bfffa15de7","resolution":{"observed_at":"2026-05-16T16:41:08.896689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:84e4fc44b850b490ff8bbe8d42dd29ecd31ad074ce34550f3bb9767a56f8affe","observation_id":"0dcaf460-6d5a-4cee-b4f1-14f52aba68e1","resolution":{"observed_at":"2026-05-16T16:41:08.730604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16061","last_updated":"2024-08-28T18:01:00Z","snapshot_observed_at":"2026-08-06T09:17:41.634492Z","submitted_at":"2024-08-28T18:01:00Z","title":"3D Reconstruction with Spatial Memory","version":1},"cited_work":{"arxiv_id":"2408.16061","doi":"10.48550/arxiv.2408.16061","metadata_source":"pith","pith_arxiv_id":"2408.16061","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"3D Reconstruction with Spatial Memory","venue":"cs.CV","work_id":"5d192969-560a-44a0-b0d1-6f8af326ea84","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2408.16061","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:d92d6f891507bb96506a172149e65b5441424e833279d125203bce67503aeb25","observation_id":"9dbfe11d-ab48-4c69-90ff-96f7b61a5e6d","resolution":{"observed_at":"2026-05-17T07:31:59.308367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f236c2a7-3859-46ea-bbcf-b8f29b139dfc","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:f8efbda018e8a5591e3dcef38876f4545cbb6fead8e9a2c63f993bb285e579af","observation_id":"cba543a7-1fc2-44b3-88a3-45ee8e9cafaa","resolution":{"observed_at":"2026-05-16T16:41:08.898676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2ac949d8-7365-49a1-be0b-07801333bbc5","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:86242d4b7fccd58d3a9f81a7c919c7c754be43ee98b61541c1b17eacc65c38fe","observation_id":"e9da61bd-c121-4ff9-b181-6eb3371c38d5","resolution":{"observed_at":"2026-05-16T16:41:08.900597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d561cc5d-6b93-4281-915f-b9f44b4d8b8a","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:314284a99c879e38f3511a9e1208ef4ff2508fc7262dbb083379443bd5170027","observation_id":"32f1b1b9-5055-4301-bda9-2c9ba6201526","resolution":{"observed_at":"2026-05-16T16:41:08.902358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12387","last_updated":"2025-01-21T18:59:23Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:59:23Z","title":"Continuous 3D Perception Model with Persistent State","version":1},"cited_work":{"arxiv_id":"2501.12387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12387","snapshot_observed_at":"2026-07-01T19:16:00.367749Z","title":"Continuous 3d perception model with persistent state","venue":null,"work_id":"8d986612-4394-40fe-9f03-67dc1da1fad8","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2501.12387","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:ab61b71c48eb3941a3099458cc160aceac329c05cb3e0316eee9ab5b6d788e4b","observation_id":"828105d5-e35a-4321-a2a3-7724d65b1a7f","resolution":{"observed_at":"2026-05-16T16:41:08.747228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"afeccf0a-305d-4f0f-94f8-f9a13174bb42","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:2cc5650ca993dff929b9f73dc1c5863cd1050164f2f07a30d37641904e5828c1","observation_id":"f0a35fb6-de26-4e0c-9f1b-1577e6252118","resolution":{"observed_at":"2026-05-16T16:41:08.904158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":"2507.13347","doi":"10.48550/arxiv.2507.13347","metadata_source":"pith","pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","venue":"cs.CV","work_id":"8ab9cfd6-a60d-45e6-a572-9b4db82b8527","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:3189f4f7a31afa85db09e11194572cc89b518c6470dddd46115ead64cb5cb325","observation_id":"5501d4ba-5bba-44fc-9448-9845f39c6d04","resolution":{"observed_at":"2026-05-16T16:41:08.753090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10565","last_updated":"2025-05-15T17:59:50Z","snapshot_observed_at":"2026-07-06T21:24:34.845524Z","submitted_at":"2025-05-15T17:59:50Z","title":"Depth Anything with Any Prior","version":1},"cited_work":{"arxiv_id":"2505.10565","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.10565","snapshot_observed_at":"2026-07-07T22:24:11.134049Z","title":"Depth anything with any prior","venue":"cs.CV","work_id":"eef7e0d5-2243-4708-9a72-4c2ef9789516","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2505.10565","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:b4ef843608b8a2eb2d55a136e9d1f59584e1ffc294e0f2ef373a3409acb55d63","observation_id":"f82a0ab7-e857-420c-962b-02f8763319cc","resolution":{"observed_at":"2026-05-16T16:41:08.756605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wimbauer, W","venue":null,"work_id":"9c2e5dea-818c-4055-8521-6854d68f954a","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:d6a55d9d913811134c10caff9482a4e46d3d7873dd19f7661f670f283ad2ac75","observation_id":"a08cba70-25ad-42a8-8278-c38eb612fd45","resolution":{"observed_at":"2026-05-16T16:41:08.906318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb0f8713-629e-4887-a9fd-07e092fdc09e","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:f49bf25203fe8fbe44637bc421bb72e7f522014caf4e44d1835e69c0864c15e7","observation_id":"2f49d24b-8e3c-42ad-8f4b-26a0a3b1bf4a","resolution":{"observed_at":"2026-05-16T16:41:08.908041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12462","last_updated":"2025-07-19T02:07:12Z","snapshot_observed_at":"2026-08-06T16:42:48.194262Z","submitted_at":"2025-07-16T17:59:03Z","title":"SpatialTrackerV2: 3D Point Tracking Made Easy","version":2},"cited_work":{"arxiv_id":"2507.12462","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.12462","snapshot_observed_at":"2026-07-10T18:47:31.614330Z","title":"Spatialtrackerv2: 3d point tracking made easy","venue":"cs.CV","work_id":"68991c49-0dac-4fd8-a260-37dc1721dec8","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2507.12462","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:c44424ba3ee131e4b808fe076efa4956582bba356039aed60aefbf9d58150fb7","observation_id":"82f8db8b-8b5e-46b3-b674-a8235feab4e1","resolution":{"observed_at":"2026-05-16T16:41:08.765709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01016","last_updated":"2025-04-01T17:58:03Z","snapshot_observed_at":"2026-07-06T21:02:33.351709Z","submitted_at":"2025-04-01T17:58:03Z","title":"GeometryCrafter: Consistent Geometry Estimation for Open-world Videos with Diffusion Priors","version":1},"cited_work":{"arxiv_id":"2504.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.01016","snapshot_observed_at":"2026-07-02T13:56:59.197030Z","title":"Geome- trycrafter: Consistent geometry estimation for open-world videos with diffusion priors","venue":null,"work_id":"7aae14a1-892b-413a-ac39-f483e09f5010","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.01016","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:d2344ed643d9d597d4f938fa26ff8b6988336498c3ec11430caee15df2b07af3","observation_id":"1aa4a81c-b431-4a9d-adca-5559ee43f908","resolution":{"observed_at":"2026-05-16T16:41:08.768693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95296efb-ccf6-4a15-b422-80e0b07c6705","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:34835d8fe6328d3f9e8bfa242bdc62c9488240fa616563dd09c98c69430d6757","observation_id":"373a0bc7-0d60-4c4a-81d8-94501c84b32d","resolution":{"observed_at":"2026-05-16T16:41:08.909752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13928","last_updated":"2025-03-19T19:35:52Z","snapshot_observed_at":"2026-07-06T20:25:08.527025Z","submitted_at":"2025-01-23T18:59:55Z","title":"Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass","version":2},"cited_work":{"arxiv_id":"2501.13928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13928","snapshot_observed_at":"2026-06-30T16:54:59.263569Z","title":"arXiv preprint arXiv:2501.13928 (2025)","venue":null,"work_id":"926b9b2f-e6e8-40a2-8816-ceea11d1d49d","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2501.13928","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:20cc36c26642aeacb4ed631be76fcd6337de650693aa78b5e1fe68ef7d330602","observation_id":"9b0b2930-7903-4346-aac8-09794055f62c","resolution":{"observed_at":"2026-05-16T16:41:08.778171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b2e022cf-86cc-41d2-ab70-90649aee112b","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:42449497a21ab2bae75798c8a3e5ebfab3e0d11ff7dfcbb3363833808855079c","observation_id":"94532a9c-9d58-46e5-8959-e51d099fccfe","resolution":{"observed_at":"2026-05-16T16:41:08.817213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13291","last_updated":"2024-11-20T13:01:16Z","snapshot_observed_at":"2026-07-06T19:53:08.203405Z","submitted_at":"2024-11-20T13:01:16Z","title":"DATAP-SfM: Dynamic-Aware Tracking Any Point for Robust Structure from Motion in the Wild","version":1},"cited_work":{"arxiv_id":"2411.13291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13291","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bdaab051-e557-40aa-b6d1-6dab0dc3e38a","year":null},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2411.13291","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:a69eec618d2f396402503e40358fc3d60c8da4d1fd825aac39d67ce2f6ba6f17","observation_id":"6501187c-d849-4565-b3ea-dc082d48644f","resolution":{"observed_at":"2026-05-16T16:41:08.788852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05638","last_updated":"2025-03-07T17:57:53Z","snapshot_observed_at":"2026-08-03T18:13:43.768525Z","submitted_at":"2025-03-07T17:57:53Z","title":"TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models","version":1},"cited_work":{"arxiv_id":"2503.05638","doi":"10.48550/arxiv.2503.05638","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.05638","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trajectorycrafter: Redirecting camera trajectory for monocular videos via diffusion models","venue":"arXiv (Cornell University)","work_id":"a82fed40-e96b-4d33-834b-f0ab36c82d56","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.05638","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:a5d13525a28c62b0a9177e35a6a1cfe48b75b842f5f9059bdf9a9806840c80ac","observation_id":"50df9e86-185a-4fe2-bdee-72e93f5d67ec","resolution":{"observed_at":"2026-05-16T16:41:08.792734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03825","last_updated":"2025-05-08T08:32:16Z","snapshot_observed_at":"2026-07-06T19:28:08.374354Z","submitted_at":"2024-10-04T18:00:07Z","title":"MonST3R: A Simple Approach for Estimating Geometry in the Presence of Motion","version":2},"cited_work":{"arxiv_id":"2410.03825","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03825","snapshot_observed_at":"2026-07-04T21:00:08.933119Z","title":"MonST3R: A Simple Approach for Estimating Geometry in the Presence of Motion","venue":"cs.CV","work_id":"eb8020a2-8be2-40c3-92cc-0feca979f95e","year":2024},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2410.03825","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:11d8367a375fc2f01ba68047b2d107a1e28563c190f174e17447195b89c348af","observation_id":"24e4deeb-d45d-430f-adad-5ef388d9d999","resolution":{"observed_at":"2026-05-16T16:41:08.796530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05692","last_updated":"2025-08-08T07:01:59Z","snapshot_observed_at":"2026-07-06T21:05:54.748502Z","submitted_at":"2025-04-08T05:33:13Z","title":"POMATO: Marrying Pointmap Matching with Temporal Motion for Dynamic 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2504.05692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.05692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, Y","venue":null,"work_id":"0466c52c-c379-4e83-96e6-0ef009d135d7","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2504.05692","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:81c0396adadf8f50ca9e56af04bca592572bc1af097b6a48d8eab14490732922","observation_id":"af0ee854-90f6-443c-acef-c363ab43ef2d","resolution":{"observed_at":"2026-05-16T16:41:08.799705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, F","venue":null,"work_id":"f0ad2d22-81b4-430d-910f-2fe54c90d67b","year":2022},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:a2e65cd5608aa1fa4ad5f4f00a63bb880b6f4003d374310bbfa9cdc8c1f4db94","observation_id":"892e72bc-cb58-4b77-bf9b-42cb1fb2e52b","resolution":{"observed_at":"2026-05-16T16:41:08.819261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05473","last_updated":"2025-05-08T17:59:47Z","snapshot_observed_at":"2026-07-06T21:21:05.912197Z","submitted_at":"2025-05-08T17:59:47Z","title":"DiffusionSfM: Predicting Structure and Motion via Ray Origin and Endpoint Diffusion","version":1},"cited_work":{"arxiv_id":"2505.05473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05473","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e600a977-84b2-4851-9df1-9b21a8a616a3","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2505.05473","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:0409a631d8b4288a3eb988bb7ab08afddca616df15dbfe448f5b8647bc3b8011","observation_id":"11cca074-46bf-4390-bc07-7fca6dd1327c","resolution":{"observed_at":"2026-05-16T16:41:08.807193Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c088c7e-9de4-494d-b51a-e0ffb17f77ae","year":2022},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:453a66ad023afdbcd0ecb5cd2f46c9720fb2fcc307ed2911111335fb7380b894","observation_id":"53189347-00e2-47b4-932b-13b75b5149f1","resolution":{"observed_at":"2026-05-16T16:41:08.821388Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14489","last_updated":"2025-04-01T18:22:54Z","snapshot_observed_at":"2026-07-06T20:54:50.337775Z","submitted_at":"2025-03-18T17:57:22Z","title":"Stable Virtual Camera: Generative View Synthesis with Diffusion Models","version":2},"cited_work":{"arxiv_id":"2503.14489","doi":"10.48550/arxiv.2503.14489","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.14489","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"arc left","venue":null,"work_id":"72bba5bf-fe95-4b18-8c99-5742ab45bc25","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2503.14489","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:603d21a729b65fb1560abcce13783bcc6d21ad5a15da9cf9b39e766110a9f7f0","observation_id":"c7cdf93c-0040-44aa-91e9-516e5447c48e","resolution":{"observed_at":"2026-05-16T16:41:08.814706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception"},"reference_resolution":{"displayed":91,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":44,"verified_fuzzy":23},"total_outbound_references":91},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 91 of 91 outbound references and 65 inbound Pith citation observations for arXiv:2508.10934."}