{"as_of":"2026-08-05T11:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8990e7b76d2a958177380a5d8ef8e6fe5a662e4b555e388f161b8ef6435647c2","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T04:34:04.281000Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.27345/citation-record","integrity":"/paper/2606.27345/integrity","json":"/paper/2606.27345/citation-record.json","paper":"/paper/2606.27345"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion trans- formers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:18ba0d712f323b849bcf26cf6d1ac7fa2f44bdbf3adb564aad4bf22af832c03d","observation_id":"66000928-bd02-422e-b70a-834b4a079041","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:ef1a1d34ada1d6a74c17e5d81fe2347785111ba0f25497fda35844132a19cff9","observation_id":"d446926f-5a21-417f-a026-98b61ba32aec","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-07-06T20:52:55.699004Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":"2503.11647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-07-04T16:29:56.626897Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video, March 2025","venue":null,"work_id":"468e39a2-8f08-49d5-b3a6-92df4205b5f3","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:e8f8f8da8c412ad8882e8e3c0b91a0ea148a2a5b461c29a0bceefad8f5a9d1c3","observation_id":"90b2d484-b6b1-40db-b37d-801c06fbc8b4","resolution":{"observed_at":"2026-06-29T20:03:57.080654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02690","last_updated":"2025-01-05T23:55:33Z","snapshot_observed_at":"2026-08-05T04:34:52.004699Z","submitted_at":"2025-01-05T23:55:33Z","title":"GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking","version":1},"cited_work":{"arxiv_id":"2501.02690","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.02690","snapshot_observed_at":"2026-07-07T14:03:48.615075Z","title":"GS-DiT: Ad- vancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking","venue":"cs.CV","work_id":"3317bf96-b12e-49d7-918d-06233e00c8b8","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2501.02690","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:6ecf3b70ed6eed71eb1a7a45acba2cf70aeaf47d69075e0a1642f885f412acda","observation_id":"f5c90ce4-6040-4a8a-92ab-5089a7b0d498","resolution":{"observed_at":"2026-06-29T20:03:57.064581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:9d521b78d7f9fd746efd60e4daf73ecd9b46a025cbdbf54e154c3ebd5b31e241","observation_id":"50b0ef14-9c9a-4893-8541-0a56013c6173","resolution":{"observed_at":"2026-06-29T20:03:57.064406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Simultaneous local- ization and mapping: part i.IEEE robotics & automation magazine, 13(2):99–110, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:41b94f976949473fc6ea076763bb798cadf5a57534577c395b5f29dee9a6e695","observation_id":"c0a07c73-4d6d-434d-8106-782f24d10e91","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:64ec744979eb686e2abadd3e8bd48836ba5905e582703e98c196d1e02aca1574","observation_id":"0fe3298a-ee64-410b-adb9-4bbd0b6cf4a9","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Diffusion as shader: 3d-aware video diffusion for ver- satile video generation control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:8696ba2402cdaedbc88afead330a07b33998b929c3996bfbdf67be51a5c7a562","observation_id":"4137f80f-09fe-499c-a06f-9023528bcaaa","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Cambridge University Press, 2 edition, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:bb2859040a9856e48149d6bb751c85e7eb9283ceb395ccf9a35f7fbc3b9c7aad","observation_id":"21de0dcb-f2d1-48f9-b965-67d71cc2e065","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Cameractrl: En- abling camera control for video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:9645eca926bee64ec232071f886e6b30116dcf3b3426c4fcc48be8754448b1c6","observation_id":"0e916e8b-21bf-4055-a90c-c18c1b7f0de9","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Query-key normalization for transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:9b2ca82ea3d09f2fac64ae4c2aaa4a5628d3199fe54be23594f775eb9da2b2a1","observation_id":"5dce7778-a296-41bc-aa5e-7bda1e3d1ce3","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Rotary position embedding for vision transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:5701b50c1b5ad2f5a5184763462a53e493ff640798a3fa1a1f66660b85b0425a","observation_id":"690cdda7-bc9e-4229-8852-9986efd192da","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:44822f6770508ca92be793b9e5da7bda869b73e1d514f46caddadea5516cf0d3","observation_id":"bedafa41-ed7f-4c1f-a007-476f9e136fb3","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:c7cb4c57278e2a8d5e154fa7822cbd7fbd305c7f21662afc2e754d8b52e13bf2","observation_id":"85192f99-61d8-40df-ac2f-2dc4a3cb9f14","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:390ae9ba1d7320b3d8c42e8fd4795a92e6dbf38713f5a122d80acd0c3ab83517","observation_id":"dd5ffa46-a47f-4bb6-bd16-89516db5d2fe","resolution":{"observed_at":"2026-06-29T20:03:57.034678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:14cc0319ec9f58bbb360c815ca42b9f921b5a952b008abbe2d0236c6b4c74bd4","observation_id":"b54ac941-eb8f-4a2f-8470-cbee1b7df537","resolution":{"observed_at":"2026-06-29T20:03:57.049613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08068","doi":"10.48550/arxiv.2602.08068","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rerope: Repurposing rope for relative camera control","venue":"Open MIND","work_id":"0a668134-f21c-4f60-87bc-35725a079479","year":2026},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:4c7bca5656a7d86d8ba96e3df07c439fe7cd9b9685775aa0a971aa13c1b9dc6b","observation_id":"aa929f87-538f-4455-a5ca-31a4b6f0265e","resolution":{"observed_at":"2026-06-29T20:03:57.052891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:24:40.749671+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:24:40.749671+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.10496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:29:51.212498Z","title":"Dreamscene: 3d gaussian-based text-to-3d scene generation via formation pattern sampling","venue":null,"work_id":"11b9d9a5-c460-466a-92bf-5b4f199e822c","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:6e0a7de0126f6aa82f1d47b682a32ecf303407be66187bee127afc21e2c63798","observation_id":"821481a8-79e6-42aa-8366-bbb246cd7f54","resolution":{"observed_at":"2026-06-29T20:03:57.067637Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:f9ff31332ff64cf14a8d31e815131399eb0cc57912b95c3e2030d04b145561b2","observation_id":"d0b455ac-bf2f-4920-af0f-f16d4e2f4e93","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:c0ec7c81b2dfdeffbca65272429081d6335255109dd367583406e9f8f89ac09e","observation_id":"957d910b-2976-4efe-a3b6-e644a8218a9f","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.08358","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:29:51.196751Z","title":"Trackingworld: World-centric monocular 3d tracking of almost all pixels","venue":null,"work_id":"deb94515-242b-4d0e-b341-448d97ade993","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:3b4da900ff53606641ed85419cb93b848f68e0b1bcfcb9fdff88d30ee728ac3b","observation_id":"025592bf-6eab-460a-bdb5-3b46d59c46f8","resolution":{"observed_at":"2026-06-29T20:03:57.078514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.02573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:47:31.684232Z","title":"Track4world: Feedforward world-centric dense 3d tracking of all pixels.arXiv preprint arXiv:2603.02573","venue":null,"work_id":"237ea51d-002d-48f3-aa30-23c8bc3fed03","year":2026},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:2b72e2926961961ab43b3e96f2287adc777b14dda99386bdb5cc8abe50c60092","observation_id":"90de9d5e-061f-4918-a514-a5e8c1921548","resolution":{"observed_at":"2026-06-29T20:03:57.072662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:46fad92d4a4ae3dae7be74ed674c220374c93bab2ca675ef9afe44fac520dbe2","observation_id":"e8a7ee6c-fad7-4958-97a4-981c393c105f","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":"2410.13720","doi":"10.48550/arxiv.2410.13720","metadata_source":"pith","pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Movie Gen: A Cast of Media Foundation Models","venue":"cs.CV","work_id":"a6a118b0-002f-4b19-881f-7f1183e0d7d8","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:3966149856c818cfdc4b2ab64a12ff86b94b12270d8824ad824419629aad3480","observation_id":"d1736fd4-c736-4179-9b3d-e669f2ad7073","resolution":{"observed_at":"2026-06-29T20:03:57.069899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Springer, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:1b36ebf6020a8311ea693cc366b58a48b022ed527eeeae6420dd583906f95108","observation_id":"2e11c99b-45a8-47d3-af6f-96b54fa3c235","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:989d217f49e2fef85bf9a2c6d22e63454041b3eeb4929a91df550bf6118396b5","observation_id":"065f41d4-28fb-4559-a61c-3793148b8bf4","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Structure-from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:9183175ad93c1e01cce258a8ab4225045bf8538da4a37509e8fe7bfb63490eed","observation_id":"b92e44b1-d75e-4f2e-995b-7c1c577b2385","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:8ebde95ffd42ba072684436bb85ad6c9a3d3f6bd9c1e4c8eb49dce17b60cf0aa","observation_id":"6262f8d2-dd53-4233-bf71-5472c5bb58c2","resolution":{"observed_at":"2026-06-29T20:03:57.075097Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"DROID-SLAM: Deep visual SLAM for monocular, stereo, and RGB-D cameras","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:b8a1eb988f40cc63d2062c19957339e7ad57d08f70933f68505f5d9a7918b33b","observation_id":"e181cf89-892a-4e03-b9b8-d3b7de828837","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"FVD: A new metric for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:5e55c26888a46a1362513847b179f1a361a02699a6c44df5175d0f37c9afc5ca","observation_id":"9dffd51f-4ceb-4e56-b5f8-463e513bbcef","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:299794091d79a5f3dcff131fdf49886e7db9dbf939784a3b3f73061ab8e02b04","observation_id":"15636485-370e-4334-8d49-8bc509c1da58","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:bffd70295c06270890390a0bb74dd423b84ed2924df89817c304d89999702a27","observation_id":"296103dc-6446-4d8c-ab4b-dc23b658e990","resolution":{"observed_at":"2026-06-29T20:03:57.046933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"MotionCtrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:2ae7c1557f81bbc9d474a8f4814ca12f87238970f7b4fdaccebe9d10c9c2688c","observation_id":"2d5c8fec-2033-4522-96b7-c1e1c67bd6a9","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Spatialtracker: Tracking any 2d pixels in 3d space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:cc243abc839f6eee8c10e4f2755d793e88a0fe20d900c960d54659cd4cd2e328","observation_id":"6b629c10-4186-4797-bcb2-c00b4d2f0090","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12462","last_updated":"2025-07-19T02:07:12Z","snapshot_observed_at":"2026-08-01T17:43:34.476973Z","submitted_at":"2025-07-16T17:59:03Z","title":"SpatialTrackerV2: 3D Point Tracking Made Easy","version":2},"cited_work":{"arxiv_id":"2507.12462","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.12462","snapshot_observed_at":"2026-07-10T18:47:31.614330Z","title":"Spatialtrackerv2: 3d point tracking made easy","venue":"cs.CV","work_id":"68991c49-0dac-4fd8-a260-37dc1721dec8","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2507.12462","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:81fb3be4bb2d0b0a17f7d59fe3f6e62c09768f7b88a97e6e93b05bda66b8252c","observation_id":"0f2e2724-9262-4846-8414-389ccc7555c3","resolution":{"observed_at":"2026-06-29T20:03:57.067251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2406.02509","doi":"10.48550/arxiv.2406.02509","metadata_source":"pith","pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","venue":"cs.CV","work_id":"ef36842f-bbba-4a74-9df2-ec15c109c1b3","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:1872f5ea05cca3375cdbf8024d4da7acbde63e28ed1a9eaed56b74769cad4ab8","observation_id":"025bae1a-7556-472d-b001-ccbddbbc6252","resolution":{"observed_at":"2026-06-29T20:03:57.070081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:f57aefc47b112e42e2e61477f6ae2023e9b9da322405b3cda649423634d0c69a","observation_id":"328974ae-67e4-49d7-8505-ec9db9901f9a","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:a20af820137b345c1860a79da5c50c1fdde0d946dc06bdb517f0bfc8251f3ef9","observation_id":"adcd7768-8618-446d-b794-db079d62456b","resolution":{"observed_at":"2026-06-29T20:03:57.072474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Tra- jectoryCrafter: Redirecting camera trajectory for monoc- ular videos via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:34280b381df0690ba07a808ee5d04379c17e00de677315f3d2454043321f0729","observation_id":"6241ebfe-05bd-43ae-b3a7-5c824e5b38f2","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Root mean square layer nor- malization.Advances in neural information processing sys- tems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:4fd234e1ddc764839a0c3f4ea6ad67d3bab005b91fc5a560b05c7eab5f85f9b8","observation_id":"ab8ff1fe-fb8f-455b-9485-cf01248433f8","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Tapip3d: Tracking any point in persistent 3d geome- try.Advances in Neural Information Processing Systems, 38: 135284–135303, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:7c92ad0e8e23a40d17046de9b4af1c227047e4fc60d2bf63507e0312b34a0b77","observation_id":"2bc8b7e9-7bdb-423b-9583-b3b7abb7cfca","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.07237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:29:51.223545Z","title":"Unified camera positional encoding for controlled video generation","venue":null,"work_id":"59c944cc-e7b5-4565-84db-e5b36b9aeef5","year":2026},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:40378d09abfcef587d57f25114c37ecbb688b937a9b6af562e26aaf8c1a472f6","observation_id":"66feda78-22ee-4bad-8783-c6b3dae1fe7b","resolution":{"observed_at":"2026-06-29T20:03:57.075545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T04:34:04.281000Z","title":"Stereo magnification: Learning view syn- thesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:8591727413bf4ef20eecc3d51fba021c8b8660ba09d94453a1347b88ae58993c","observation_id":"de7fac1d-78a5-448e-8f2e-90065f381fc1","resolution":{"observed_at":"2026-06-29T04:34:04.281000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12201","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T02:27:45.680254Z","title":"Omniworld: A multi-domain and multi-modal dataset for 4d world modeling","venue":null,"work_id":"a2a9311e-9a5a-4a48-947d-c1f5e4eddd0b","year":2025},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:5d646de0f674beaab80c4bce7c5b64d8849202814e4c5235dddaa686c8e8d9f8","observation_id":"2dcdfa09-7f36-4dd7-89b2-214ce181f3de","resolution":{"observed_at":"2026-06-29T20:03:57.077926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":27,"verified_exact":16,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2606.27345."}