{"as_of":"2026-08-10T10:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f4a67a28391fe64953215b4c2215e2fcf080356a240ced58b82f6a4e88c9ed0","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T19:36:21.514445Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.26087/citation-record","integrity":"/paper/2606.26087/integrity","json":"/paper/2606.26087/citation-record.json","paper":"/paper/2606.26087"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:b4be24126a3e373365137ad50bb0dc53b8513b8262b1d80f19c1812b1dce2794","observation_id":"6c5393e6-7b9f-48c7-836a-99d2251c8fde","resolution":{"observed_at":"2026-07-04T20:50:11.201707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Met3r: Measuring multi-view consistency in generated images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:0eac73a632acf8a253538b8882137cd819696f7ada28bce3077d04a0bed585b5","observation_id":"4375c282-6dbd-4017-b675-3bee419ede9a","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Recammaster: Camera-controlled generative rendering from a single video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:91a138e8baabf326b2d5e78bc0af326787728c6d06a932b8baa3bb799cdb99d2","observation_id":"7e7d1dde-2099-40e0-ba8c-28fc71d3e080","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:cc92ce15f165b56dbafabce269f98b17919607974cbe1ee6fe3f5c9babdeb938","observation_id":"f8580c1d-c135-4cf5-9ae6-3a3d1b0e95d3","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:18cba006b564bc80fab6cecbb1969469e5c79653bccbf44dffd3203c83570d69","observation_id":"6aa8f129-0b26-4a52-87f4-cccea54346f6","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Gs-dit: Advancing video generation with dynamic 3d gaussian fields through efficient dense 3d point tracking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:d2ef2d71b198fe8da4951266560a6999ed4718822aacebfead3820f70c02674c","observation_id":"b7ed8440-c6cc-496c-9c8e-0c5d9e283b70","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:6f727673cd6aa98427bd3a3eca767d47c861a020a31e6c98e10d04cb01d0bad6","observation_id":"e661be42-d8d6-4c4c-93a7-c28408f51238","resolution":{"observed_at":"2026-07-04T20:50:11.210892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Uni3c: Unifying precisely 3d-enhanced camera and human motion controls for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:7e7632dd814d50fbda258ba273cffcaf1bbf22f922b3dff1db7bc3bdda177bc9","observation_id":"cb45df44-70c0-42cf-9c16-35f80a3c6546","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.12646","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.196990Z","title":"Reconstruct, inpaint, test-time finetune: Dynamic novel-view synthesis from monocular videos","venue":null,"work_id":"6615124d-11e9-42d4-9e4a-e09a51d2a14f","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:7481907980c3818497b2be83bdb305aa5731e97f20ba0007e6fbfb3416ea4666","observation_id":"ee54e652-682d-40b6-a33a-974b7a470c50","resolution":{"observed_at":"2026-07-04T20:50:11.198933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":"2511.17185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-04T20:50:11.187124Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query- Shared Cross-Attention","venue":"cs.CV","work_id":"973efba6-3687-421f-aa3e-0986acf3283b","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:de387279ef161ee9497da081082ba144bb9024f7200fabf5377f36551daad75a","observation_id":"2c79a029-c315-43c2-8609-1506297fdf73","resolution":{"observed_at":"2026-07-04T20:50:11.188941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Local all-pair correspondence for point tracking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:9908c1a7acc5ba5d1a95c163cd434e6c97d7c68e3e90074b89aa0edfa2008c05","observation_id":"fd46e00a-509a-4498-81e0-97489b67b5ee","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Tap-vid: A benchmark for tracking any point in a video.Advances in Neural Information Processing Systems, 35:13610–13626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:c5f86ccd67e12300295cc021a492da367f51d10c23dcb839936ca7cac47fd87d","observation_id":"84711f3d-0e99-4c4b-aa3d-b2d2c9640fa1","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Tapir: Tracking any point with per-frame initialization and temporal refinement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:f80d448f9fef7652160a389b05a229f11f45c7ccbfbd1bc3f2c8bf245ab502fb","observation_id":"0f15d73d-9d18-4fc2-9976-c3fe26f70990","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.10940","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.180635Z","title":"Omniview: An all- seeing diffusion model for 3d and 4d view synthesis","venue":null,"work_id":"b9708b3d-2ad0-4838-a523-bc7b59c6cfde","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:f10757bb9877bd55ec3845379a44151c2618f3197b68cfdfb39204f2518afad9","observation_id":"5629bf62-48f2-42c3-a0e1-2d039ab25ab4","resolution":{"observed_at":"2026-07-04T20:50:11.182478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Monocular dynamic view synthesis: A reality check.Advances in Neural Information Processing Systems, 35:33768–33780, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:2c323b9ca563ac44f6c0993e772d6c9c401554a960781d6b14ce5cc6103f4593","observation_id":"bfaea402-2dd8-426f-a79b-a213302d802f","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Kubric: A scalable dataset generator","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:c3377ad2d937a6f2d7cf85f26817228fbf72a4898281e62b66f3441625a32be7","observation_id":"9fc1c29a-8c13-4aa0-bb5d-0588c16ff62a","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Particle video revisited: Tracking through occlusions using point trajectories","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:8d3599f0a169c96dc0427ee9008ab2623128845669f7127502b478e5d7ea4540","observation_id":"4e16fde4-14dc-494b-b3f3-0152c687c93e","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Vivid4d: Improving 4d reconstruction from monocular video by video inpainting, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:959dcc8e6d3015b5984feddf2372c6a723363e85703d2548a03a6c07ace9f2d0","observation_id":"8c7fa96d-e5af-4c44-a33e-603b1255960c","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.25075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.177322Z","title":"arXiv preprint arXiv:2512.25075 (2025)","venue":null,"work_id":"4c7b6061-8c3d-494e-ae1a-2da67964fc5c","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:fc1ff7358424da89d4594aad778edd763cb5d838bdbdb24a9858374f1d13dce4","observation_id":"ee349a8f-f295-4cab-a2ec-496ff49007a4","resolution":{"observed_at":"2026-07-04T20:50:11.179191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:442f466b5a6d4f33dfc6977e6e8e70fdb09ba649045a4b2eb9f04c6f3356cf47","observation_id":"a59916a2-f929-44e2-b2b3-564d3d9ce174","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Robust estimation of a location parameter","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:47ded450cc9fb2141f1bfc9c3b70a91180de73c14e335230abb2ef5f82f72efb","observation_id":"3685d739-dc71-4962-ad00-11e2fca654cd","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Reangle-a-video: 4d video generation as video-to- video translation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:29fefb69fbdc610a0444ff8d22b52500cff381e811fe897a310cdd0e75a2892b","observation_id":"48251277-32a0-4955-bcbe-a8da1dde3569","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Egox: Egocentric video generation from a single exocentric video","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:b44c0f524d1efdf778b9c72a2e8dd2b28e1d463c3eaaf8a2895e49d8f26b4ae3","observation_id":"d6a6ef55-afae-4986-a6fb-68c381cbccc5","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Cotracker3: Simpler and better point tracking by pseudo-labelling real videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:e1163ef52f95f7120185e1413b3186f3d289a5b5857f42efe362556c45264b0f","observation_id":"b329b824-ea0e-426c-9aed-efba97106515","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Cotracker: It is better to track together","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:1f59989b4bf6afad37b2db7f7348e87fc0e1b5d29c158251668c8f937178570b","observation_id":"24b01e5c-9573-49c6-ae1d-2a1e802e95e4","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.219122Z","title":"Infinite-homography as robust conditioning for camera-controlled video generation.arXiv preprint arXiv:2512.17040, 2025","venue":null,"work_id":"0bbdd768-98da-400d-8ade-19648ba5a023","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:f916bc9a635a8bbef3e1348a251dc4cda908a283e0609af657e92116c74eb193","observation_id":"94a50c4e-9f92-4e9e-9c52-cf335af83b68","resolution":{"observed_at":"2026-07-04T20:50:11.221323Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:938a0ae081d9024e6ed056532d01b7be160d3f4b3ea17d6e5d0d5aa6a21636aa","observation_id":"7094f940-6cb2-48a8-92cc-584d6be20fc2","resolution":{"observed_at":"2026-07-04T20:50:11.217563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Mv-tap: Tracking any point in multi-view videos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:5fbdd2dfa909cda45bb60861921895bd4291e21fec640f42c4fc41e5f7c222e6","observation_id":"f6befae9-0930-4e57-a816-7f9f37215577","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14945","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.193443Z","title":"3d scene prompting for scene-consistent camera-controllable video generation","venue":null,"work_id":"27bfd13a-ebf8-4f5e-bda9-5b7427e359bd","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:0317d02d3f07cfe07731ee7d6b3c3f9724fac1657bcdf6c87f26a5f39e23b609","observation_id":"03544541-ca95-4713-8532-f45c92dbf7cf","resolution":{"observed_at":"2026-07-04T20:50:11.195613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:53592df198829b3a052c2b94f7248c67443744e33ec039ad14aade9bff109cf7","observation_id":"606a7e46-68ba-465c-9f6b-09600ddd7803","resolution":{"observed_at":"2026-07-04T20:50:11.204570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:e8023573aeda1f94054d17827bc51b356cc3f0138ad459b98f523983e02fa45a","observation_id":"0771d7c6-2134-443f-a5d5-30e81c1f5e56","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Emergent temporal correspondences from video diffusion transformers, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:ab1c1dbfda82cadbf255317c3d9a74c0944266515862188b94657e78c10ebdf2","observation_id":"1e6c33d6-699f-4d64-9985-d1c3016d9442","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19827","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.190206Z","title":"Redirector: Creating any-length video retakes with rotary camera encoding","venue":null,"work_id":"49486dac-da5c-4452-ab9c-3dec9551195c","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:26e5702432489be135f1968701feda44f4aa401c5227c16ec7cc0df9fa7f03b9","observation_id":"eb4e9876-6716-42e7-9216-e541df8edd3a","resolution":{"observed_at":"2026-07-04T20:50:11.191910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"A benchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:dd8be20daf9f986b4cf1460f08d021c0c06258593fbdc7fdd571661d13ff8200","observation_id":"642bfbb8-ac49-4865-b2bb-d17a442cdb09","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Multi-view 3d point tracking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:cf525e0a1e0f6d686d058dcbd7c5dc507a7087e227d65bc7bbc089c7c3608536","observation_id":"ba378338-1771-49bb-962f-e012655ae8d3","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:ea87a5bf2f5a614b73f45bb093c4d3c05a5ffc44846480632fb96805bfa49af6","observation_id":"b69a655c-444d-4d7d-a9c0-76ff9ff5ab97","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Light field networks: Neural scene representations with single-evaluation rendering.Advances in Neural Information Processing Systems, 34:19313–19325, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:2c02c00a4c49b05ca606578a6574c3d33599e34f2a178be0db52470b8a6b413a","observation_id":"f1a60e98-debc-42d3-ac60-c05eab44fbaa","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.16982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.205883Z","title":"arXiv preprint arXiv:2601.16982 (2026)","venue":null,"work_id":"b29aa2e0-00bd-4409-bcb0-6d797894181c","year":2026},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:506d7222f63997c355df9cbe28b82b0645354df0e1192c5e8ef05b866b5b56f6","observation_id":"1b713e39-508c-406b-8f30-6c82a3e6a6f0","resolution":{"observed_at":"2026-07-04T20:50:11.207708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Generative camera dolly: Extreme monocular dynamic novel view synthesis.European Conference on Computer Vision (ECCV), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:dcc203067a099c20d0d71cf029cf5b1c741b4f594c337e4aacd121d4d53ad10d","observation_id":"93f54a42-21d9-4b93-ac6f-ef02842f314a","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Wan: Open and advanced large-scale video generative models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:e3fab9f2f25b2ffa4f7cf8bd7a419f66be3e2f29e243cf27e73933ea11a140dc","observation_id":"019c3bc0-a54b-4a79-a7d6-82c1cf9fd35a","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01481","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.183725Z","title":"arXiv preprint arXiv:2512.01481 (2025)","venue":null,"work_id":"ea247df2-0e10-4fc2-87d1-06f57a4fdd83","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:ec18b9b893421e81acbf9697f6bc2f4cc658654604f7a9a79a6fb5c165fdd773","observation_id":"06423e7c-25ca-493f-8da3-f6c3f190adae","resolution":{"observed_at":"2026-07-04T20:50:11.185724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Cat4d: Create anything in 4d with multi-view video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:bab836334d589f19c41c30e041421a4835c141d8013b441c82567d162b3b5e4e","observation_id":"eabbfd68-2af5-4cbc-80cb-d728db879ffe","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.00393","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:11.212321Z","title":"NeoVerse: Enhancing 4D World Model with in-the-wild Monocular Videos, January 2026","venue":null,"work_id":"1715e14a-e944-439f-bb45-3586b54a9cf2","year":2026},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:8c7ce6f6260d0b22f843b0ee7d2f395cb30e3e6e176d7b6a634f50c132508300","observation_id":"a83bd9bb-5607-4e97-b8f1-66cbba43da95","resolution":{"observed_at":"2026-07-04T20:50:11.213906Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:e2630fd469fd9117b9f27520308312dd37a34b867c8fe8969f01829430c14ee5","observation_id":"f3bf68ca-0abe-4cca-86b4-6cfcb55313d8","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Trajectorycrafter: Redirecting camera trajectory for monocular videos via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:07c28623d5e1fa0c06b362583f99b0d705f788efaf3d06ac8592d75c6bb222da","observation_id":"dab4dbe8-571a-4d6a-aa1b-731112b4de47","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T19:36:21.514445Z","title":"Spatia: Video generation with updatable spatial memory","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:6a012fe4a63a6624c45425f6b8ddc7db9e71e9f4f999a1201a9ffeea010b845d","observation_id":"60d3fb24-9e59-43bc-99d0-0a25631c9211","resolution":{"observed_at":"2026-06-25T19:36:21.514445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":14,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2606.26087."}