{"as_of":"2026-08-08T08:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:352e21731073171930835caaf1c9d29023a25619f0341399f40f549ca8de64f8","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:54.341611Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19306/citation-record","integrity":"/paper/2505.19306/integrity","json":"/paper/2505.19306/citation-record.json","paper":"/paper/2505.19306"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.914350Z","title":"Seitz, and Richard Szeliski","venue":null,"work_id":"2e9fa110-3514-41a6-8536-71c471642739","year":2009},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.169082Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:569780ea05eef70b82a50a053f8a57dac801f17d0ea137743a733683cb7ff583","observation_id":"9b5356ad-f92f-4ca7-9e58-5201c70543f6","resolution":{"observed_at":"2026-08-07T14:22:54.919623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.174145Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.174145Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:58992636c204d9e3b3e69df40983cc2d054ed3f58c1730f1c7047fab31d334df","observation_id":"6538d3f3-ebe3-4395-a575-09273f78bf8b","resolution":{"observed_at":"2026-08-07T14:22:54.174145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.884993Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"06c44664-fe87-4157-96a3-1a2f30f02aca","year":2023},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.178565Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:7f3df7a50ae715d964e5f10b544886fb95f01ed45663e3272481c840fda24792","observation_id":"7c55932a-e0bc-4db9-b5e9-0a253e871d44","resolution":{"observed_at":"2026-08-07T14:22:54.890958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.182988Z","title":"Splatam: Splat, track & map 3d gaussians for dense rgb-d slam","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.182988Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:e4619b69406ffe29997857080caf86cb8ea1b0fa2e4b17471c21d5b24d22c334","observation_id":"6d6f8388-b169-4aef-99bb-c7077d90a917","resolution":{"observed_at":"2026-08-07T14:22:54.182988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.860563Z","title":null,"venue":null,"work_id":"44aa9892-a772-426e-b346-d2023ba026f6","year":2017},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.187498Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:81d572dbe1f2b2bb7afcf2e86cc9f1735b5be41ce5997a97fc2ec9faca302446","observation_id":"c909a015-ad45-4005-8d26-0a814a819b9b","resolution":{"observed_at":"2026-08-07T14:22:54.865083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.193179Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.193179Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:47439e65b7d8c3b2844a4b4cf1c81e51bc1a13ebc572d640bdda12db9149ea3f","observation_id":"42f4b9ad-e964-497f-9567-3eafc0492f5d","resolution":{"observed_at":"2026-08-07T14:22:54.193179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.834156Z","title":"Ratliff, Jan Issac, Daniel Kappler, Stan Birchfield, and Dieter Fox","venue":null,"work_id":"36a00263-09f2-47b4-bce4-65fc80217039","year":2018},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.198787Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:325342dcc0287b82c04a6cbcc16fb18999f583735aaad664fed0861ea07d5814","observation_id":"467ebaf3-6f5d-493e-a627-e2f2b5ed53df","resolution":{"observed_at":"2026-08-07T14:22:54.839794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.818308Z","title":"Diffeomorphic transforms for generalised imitation learning","venue":null,"work_id":"b532ec1e-9309-4aa6-9dbb-68552d47727a","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.203192Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:4962bb7ba341cb87cb3727b5fbe640f47e877471aa4483cbe1a63f21d0611dfb","observation_id":"6027171e-74ac-4944-825b-25cd37c82542","resolution":{"observed_at":"2026-08-07T14:22:54.823867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.802135Z","title":"Depth anything v2","venue":null,"work_id":"51f97219-3269-4003-aeea-d2e422262e08","year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.208133Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:40481e19f8d39009b984decbcd4b6a1fc70a6d231cc722edc29aabf08eadde0e","observation_id":"c3dc5f50-ca66-4cd3-aeff-bf193e70f504","resolution":{"observed_at":"2026-08-07T14:22:54.807365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.213421Z","title":"Repurposing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.213421Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:683fd5fda64d095fd155b27a5949c3055da2f453bbead3f8a2bed7a336f313d9","observation_id":"a7fd77e8-09f3-4926-b0de-d0d2d3b79063","resolution":{"observed_at":"2026-08-07T14:22:54.213421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.217600Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.217600Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:f6db441e787d082f705285706c2b3d4ce413c858790726259dd31d49562631d7","observation_id":"d672a51f-47f0-43d9-bd80-dbde1e2a7171","resolution":{"observed_at":"2026-08-07T14:22:54.217600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.766499Z","title":"The interpretation of structure from motion","venue":null,"work_id":"24f7a40f-0232-4fc0-8b05-13df2537c4ae","year":1979},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.222181Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:4cf1c5d05c9490d73f22d06d369c515781f7f7b2637a32df3578768ae5b15cc4","observation_id":"ec1f3e51-2dc9-4343-9bac-a1a564e4d60f","resolution":{"observed_at":"2026-08-07T14:22:54.772082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.750324Z","title":"Structure-from-motion revisited","venue":null,"work_id":"4746d5ac-c810-4112-bf83-6795dec4ce92","year":2016},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.227067Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:4285ea3378a688e0c068977ec92508060cd584e1aaf758bfda82a270ef25eace","observation_id":"a9a85efe-03b1-4ebb-97a6-3b055fcc1f0b","resolution":{"observed_at":"2026-08-07T14:22:54.755487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.232089Z","title":"Grounding image matching in 3d with mast3r, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.232089Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:36a13b868b9a5828dfd30de726ea459eee6de06e0347c85fd1ee4a53e4220206","observation_id":"26cc3540-515c-4258-86d9-7bcdad46d5bd","resolution":{"observed_at":"2026-08-07T14:22:54.232089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.236370Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.236370Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:65f627d6e2481b870f77b0bdb3f7edc95fc8e068be479b65857e03d79badffd0","observation_id":"40eacbd6-011e-4b17-88f1-c461883c565e","resolution":{"observed_at":"2026-08-07T14:22:54.236370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.713707Z","title":"Unifying repre- sentation and calibration with 3d foundation models","venue":null,"work_id":"7ac5ce12-2464-41da-989c-1b61469dc54e","year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.240685Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:9299657aa4c338e940ddd2664ae298b6e47e9ccc5198fd9e7f87f7133a213aca","observation_id":"97602419-2178-41dc-931b-150391af90f9","resolution":{"observed_at":"2026-08-07T14:22:54.719051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.697184Z","title":"Simultaneous geometry and pose estimation of held objects via 3d foundation models","venue":null,"work_id":"a6926801-6a99-48d2-8aa0-fe843fc84f46","year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.245179Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:7b61affbb0e9ec54b7b09091baf6930c699551b803f587f0a13f4c7783937ba7","observation_id":"6ba4d7b3-06b5-4a9f-af65-9f1ee77ecb33","resolution":{"observed_at":"2026-08-07T14:22:54.702429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.679811Z","title":"Stylegan-v: A continuous video gener- ator","venue":null,"work_id":"25d3e5b1-1e6a-491d-bd17-1040ebd7365c","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.249296Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:78e28893cd837420008a246c3aeed15cd7acfd15ffadc37a4b7c5c4954469eb5","observation_id":"7c1a54c1-deea-443b-afe4-616764359178","resolution":{"observed_at":"2026-08-07T14:22:54.685157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-07T14:22:54.253277Z","title":"Video diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.253277Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:b18c5234fd009ef13ae661ac392a7b0e95c042c5d2e1db144d5432ef19d067b9","observation_id":"80a02b12-1036-4a25-9540-12b86793be6b","resolution":{"observed_at":"2026-08-07T14:22:54.253277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.12367","last_updated":"2022-12-23T14:43:30Z","snapshot_observed_at":"2026-08-05T17:22:45.065328Z","submitted_at":"2022-12-23T14:43:30Z","title":"Highly anisotropic transient optical response of charge density wave order in ZrTe$_3$","version":1},"cited_work":{"arxiv_id":"2212.12367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.12367","snapshot_observed_at":"2026-08-07T14:22:54.391941Z","title":"Highly anisotropic transient optical response of charge density wave order in ZrTe$_3$","venue":"cond-mat.str-el","work_id":"4f318b5d-63a5-4071-97d1-4a4759e8b7b6","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.257748Z"},"links":{"cited_paper":"/paper/2212.12367","citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:4ab039115da0e421ca025e1c3816966af89c2677a490f9ebb8176739d873fd63","observation_id":"cff98f6b-99c3-4a0d-aaf5-0568fd9dc21e","resolution":{"observed_at":"2026-08-07T14:22:54.398795Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.262251Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.262251Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:9589b17266e061b66bae1eb7635298737fb382fa597c396b6f3f9f63a9f85386","observation_id":"001ffcd5-d01c-4e6f-aa67-357ed5b1f549","resolution":{"observed_at":"2026-08-07T14:22:54.262251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14489","last_updated":"2025-04-01T18:22:54Z","snapshot_observed_at":"2026-08-07T16:54:11.419701Z","submitted_at":"2025-03-18T17:57:22Z","title":"Stable Virtual Camera: Generative View Synthesis with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14489","snapshot_observed_at":"2026-08-07T14:22:54.267557Z","title":"Stable virtual camera: Generative view synthesis with diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.267557Z"},"links":{"cited_paper":"/paper/2503.14489","citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:a738fde1de7a7f4046e3fa74115be1bc739b0b59efa00adbe9379d1da50b82dd","observation_id":"6dd41bfa-fe46-49e3-bf09-428ae59c8758","resolution":{"observed_at":"2026-08-07T14:22:54.267557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.651088Z","title":null,"venue":null,"work_id":"47e2509a-4db1-4487-8110-4b12eb930edf","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.272330Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:86b7e5829f1b16cbf470b5416cf84b653035e4752a38f59cb2def04ebfb0d11a","observation_id":"2d4526ca-fd17-4091-9b30-08dde8fe4162","resolution":{"observed_at":"2026-08-07T14:22:54.657760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.635139Z","title":"Global and reactive motion generation with geometric fabric command sequences","venue":null,"work_id":"5a05b9f4-a183-49fb-9e09-c1a7de711cb3","year":2023},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.276635Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:22d62db55d69733e585bd43200d64de2ecf73082af6b330004e5fe12983a1f01","observation_id":"43868906-1d61-40d7-8202-557a0cf3e065","resolution":{"observed_at":"2026-08-07T14:22:54.639807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.618320Z","title":"Continuous occupancy map fusion with fast bayesian hilbert maps","venue":null,"work_id":"a1f278ce-0d15-4018-b8cb-b8578c4d1077","year":2019},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.281470Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:055d9dc7136083c49cef2edf3eac11f5ca5d9112ff5ca40c37bafc1e732f3150","observation_id":"5c1cdc16-e8e0-4384-af9b-beeb0467afc0","resolution":{"observed_at":"2026-08-07T14:22:54.624665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.602486Z","title":"Spatiotemporal learning of directional uncertainty in urban environments with kernel recurrent mixture density networks","venue":null,"work_id":"6da4be77-6ea9-4b94-b665-75c6d6208e81","year":2019},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.286602Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:8cf0c506cccfccff94f509fa50dd1f92755cd858a63985515e84755d39319552","observation_id":"e4fb97ae-f06d-4ff8-9c62-62a2abcc9fa9","resolution":{"observed_at":"2026-08-07T14:22:54.608061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.585906Z","title":"Mesh manifold based riemannian motion planning for omnidirectional micro aerial vehicles","venue":null,"work_id":"02d0d890-9fcd-42e3-9a4c-6fc2ed20feba","year":2021},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.291203Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:16e0e9d283e507110cd671986cf617382840c630f24264e9f61d2af8ea3583eb","observation_id":"5177e5f8-d22e-4fbe-ba61-991c3aee062b","resolution":{"observed_at":"2026-08-07T14:22:54.591623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.568841Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"b9f1734a-4029-4832-865c-8272d2092342","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.296244Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:11aee98bd538443e625deebff9583e58f338bac7a3851507bd18e88e3ba9b97b","observation_id":"89fa6142-cdfe-4d9d-b3a2-bf1ceb2df9ac","resolution":{"observed_at":"2026-08-07T14:22:54.574159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.301317Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.301317Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:390aca419080fee4a29cc9142eac24b97be7b3a0283673e3a6dd36b203636c75","observation_id":"ab347e9c-f4b4-4e8e-9513-d07b25040e04","resolution":{"observed_at":"2026-08-07T14:22:54.301317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.544648Z","title":null,"venue":null,"work_id":"1459be58-7281-489a-8efa-a06dcb4f635f","year":2020},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.306070Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:570c33e1b2c855228df74e8781b5cefee5c9215458a6bfd16a08029aa6f43e90","observation_id":"c3ec8110-3fe7-4a97-9450-c82a2372aab7","resolution":{"observed_at":"2026-08-07T14:22:54.549688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.528488Z","title":"A connection between score matching and denoising autoencoders","venue":null,"work_id":"d1a95451-0069-48e2-ae83-57d5fec2632b","year":2011},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.310293Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:24c45c33d9bd06bd05bbe86b4c3e02f79bfd852a3722a6cafb1f0e5b1c31e98c","observation_id":"c539f4e4-e4b1-45a7-a2e9-3a70bbe764c3","resolution":{"observed_at":"2026-08-07T14:22:54.534289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.315071Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.315071Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:74ab8dcecaf311e1cb478a190efa4a673cc37f7e3ec4bc5238181bc0268ca0fe","observation_id":"de039762-8ee5-44da-b626-d63478c23bc4","resolution":{"observed_at":"2026-08-07T14:22:54.315071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.502443Z","title":null,"venue":null,"work_id":"ab25b82e-4c45-458d-aed0-69ba39ab6f02","year":2018},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.319337Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:f4f6b2413a1a1dea8892503532d6bd3f778f74b1c3c08434d0e48120a3cab7fc","observation_id":"f7f43c97-b13f-4d79-a0ad-ca01555b8cca","resolution":{"observed_at":"2026-08-07T14:22:54.508585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.486805Z","title":"Bonilla, and Fabio Ramos","venue":null,"work_id":"b2aaf129-9bed-4251-ad85-913050e596d5","year":2022},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.323577Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:148508ce72fb8033168efb0fc01a4f680989c596f44cdf608b296c2abf584b6b","observation_id":"19090957-5bcd-41bb-bc89-4ab1bcd46b81","resolution":{"observed_at":"2026-08-07T14:22:54.491446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.472471Z","title":"Morrison","venue":null,"work_id":"3a8ef0c7-891c-4e9a-813e-a3d485a32baa","year":1950},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.327859Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:82f2af47d5406e78a394c18cec938f2b900ee30c4387148fbd0a48ccdb6aa1e9","observation_id":"d96ad7a1-8dda-49d7-9da0-3d61676c9b35","resolution":{"observed_at":"2026-08-07T14:22:54.477356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.457792Z","title":null,"venue":null,"work_id":"974f1f41-1f00-4fe9-8e6f-2e2e0ca0fcf4","year":1987},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.332053Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:4c81622e6d8c7a4c8f50c4fd3902f1f6c16ef4afc8eceae62d1c8a4dd5b9d788","observation_id":"94ca3e05-d08b-4946-8f36-fc80dc8aafb2","resolution":{"observed_at":"2026-08-07T14:22:54.462449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.441871Z","title":null,"venue":null,"work_id":"d66e7e31-c823-45f3-8ff2-fcf8db643dd0","year":1977},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.336736Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:e5293c5bad8f7c84b36ee3a5fd5a73221f68e83eda8564f4406ed91a27095e1c","observation_id":"2c9dab58-c177-4ab6-86c4-8fe4107452ae","resolution":{"observed_at":"2026-08-07T14:22:54.446996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:54.425691Z","title":"Computing discrete fr ´echet distance","venue":null,"work_id":"096eec04-deee-4c57-ab50-e4be751052bd","year":1994},"citing_paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:54.341611Z"},"links":{"citing_paper":"/paper/2505.19306"},"observation_digest":"sha256:487ab399aa74ae6654f2c868845548b019a5349f534dea434d079e408ada07ab","observation_id":"244d4ad0-f25b-48df-846b-efe49622ae6d","resolution":{"observed_at":"2026-08-07T14:22:54.431080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19306","last_updated":"2025-05-25T20:30:25Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T14:14:57.327729Z","submitted_at":"2025-05-25T20:30:25Z","title":"From Single Images to Motion Policies via Video-Generation Environment Representations"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2505.19306."}