{"as_of":"2026-08-13T17:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b352f359b2ebbfdeea443b28ea952abc3d5ab0821e4a043650816609bf42094d","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:26:19.793906Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00094/citation-record","integrity":"/paper/2608.00094/integrity","json":"/paper/2608.00094/citation-record.json","paper":"/paper/2608.00094"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.791180Z","title":null,"venue":null,"work_id":"27f62fda-c213-4c7b-8bb5-54881aac4ff0","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.587405Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:97a72cbbccc9895cfbb44a4901d5aadbcb185856888116bc2f0acc7b947a858b","observation_id":"1b36935b-7fa8-413e-8a05-bfe566b04c87","resolution":{"observed_at":"2026-08-05T04:26:20.795450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.778199Z","title":null,"venue":null,"work_id":"025d8c0f-1236-4059-ae66-de69bbaedfdc","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.594223Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:e5dc6405b04331484eac768289474d62fbf69bc675b1c33629dd696e94bdc169","observation_id":"de8807e7-fc0f-40ed-b5ce-75b70bd6c3ca","resolution":{"observed_at":"2026-08-05T04:26:20.782476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.764428Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":"c6efaa85-35a6-4ebc-a671-8a68b5b6e94f","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.598406Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:5bd66d4c03328b2daf3b1e294ef233f96810d6a5ae09bad6c4bd256c1c2b7443","observation_id":"f95b95f1-f7d2-4058-bbf1-7c3384ed6f42","resolution":{"observed_at":"2026-08-05T04:26:20.769173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.749821Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"ee7c6526-eca5-42e8-b014-e1f326eeb701","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.602593Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:02ec870f35f4009292bea687e12efd8e95e58bcd2ae3c73e501988c9bb0ba5c2","observation_id":"3e362fc7-b4b5-4160-95b1-f4254069c710","resolution":{"observed_at":"2026-08-05T04:26:20.754875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.735605Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":"1cf247a3-f886-435b-82cf-7c3a8a2b13f4","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.606888Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:1fb4b2c16217bb3bc2590f56b187d44b584c0b019946892fd08fb28b96e06142","observation_id":"c0eddad7-cb10-406a-a3b2-9eb32469fd29","resolution":{"observed_at":"2026-08-05T04:26:20.740211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T04:26:19.610968Z","title":"arXiv preprint arXiv:2503.20314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.610968Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:46f82857a385ed0101fc131b6088359129abae2ad07e3adbfb9de5ed97319acb","observation_id":"695e384c-0e46-4ed8-bbb4-1fd2ed7bfc44","resolution":{"observed_at":"2026-08-05T04:26:19.610968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:19.616133Z","title":"arXiv preprint arXiv:2604.02329 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.616133Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:5f380dc830cbd456a732b43d7adaeb28a475a153b24978bf899c047dd85c073d","observation_id":"c877723f-2824-4d21-909a-86b606056ad2","resolution":{"observed_at":"2026-08-05T04:26:19.616133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.20889","last_updated":"2026-07-23T03:26:02Z","snapshot_observed_at":"2026-08-13T06:41:55.498086Z","submitted_at":"2026-07-23T03:26:02Z","title":"Engine-Native Editable 3D World Reconstruction with Objects and Lighting","version":1},"cited_work":{"arxiv_id":"2607.20889","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.20889","snapshot_observed_at":"2026-08-05T04:26:20.247274Z","title":"Engine-Native Editable 3D World Reconstruction with Objects and Lighting","venue":"cs.CV","work_id":"b23b1575-2a4f-45c1-a02b-7667b48c3d03","year":2026},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.620191Z"},"links":{"cited_paper":"/paper/2607.20889","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:ece25da62b1a7c0d7bdcd030802a1ddc6d29e99088603a092c2462edf46193c3","observation_id":"062a7969-b8d3-41a7-9785-f16d36017ab4","resolution":{"observed_at":"2026-08-05T04:26:20.252579Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.722477Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"4865710e-f0a2-4c59-a52e-8324c0374e96","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.624360Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:cb77d99c4e33370a4600ce470450c209e34a149fc950bccacdbee5642af549b9","observation_id":"5d5c5384-dd96-46b9-b507-c331715a7ed6","resolution":{"observed_at":"2026-08-05T04:26:20.726874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.31388","last_updated":"2026-06-30T09:16:21Z","snapshot_observed_at":"2026-08-02T07:18:38.830324Z","submitted_at":"2026-06-30T09:16:21Z","title":"One Video, One World: Turning Monocular Video into Physical 4D Scenes","version":1},"cited_work":{"arxiv_id":"2606.31388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.31388","snapshot_observed_at":"2026-08-05T04:26:20.228961Z","title":"One Video, One World: Turning Monocular Video into Physical 4D Scenes","venue":"cs.CV","work_id":"d18f720c-60a3-4405-9b28-5a220d2df2de","year":2026},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.628774Z"},"links":{"cited_paper":"/paper/2606.31388","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:8f43e0b74fc0de720cca3ce49ed44151539a6637b6674aeccbe5197414a67155","observation_id":"701bd1b4-a8df-4737-85d7-d60e8d6daf4e","resolution":{"observed_at":"2026-08-05T04:26:20.233503Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.709039Z","title":"The Fourteenth International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":"325018b4-c235-4b5f-a7d0-e48842d11318","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.633059Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:6eb6aefa3fa153658fe98ac328a73c37c67a0c67c77fc97e6b8b7b5bd70b4a5b","observation_id":"c6e566ff-0329-476c-b40f-9cf8c900756f","resolution":{"observed_at":"2026-08-05T04:26:20.713587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.15147","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.206613Z","title":"arXiv preprint arXiv:2503.15147 , year=","venue":null,"work_id":"a3586c76-57f2-4d2e-949c-b6f87667e13c","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.637006Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:9b1de9e7a76e606c54fcb262f6bfb234fa0ad87f93131495fec027f9b9fd032c","observation_id":"14df655e-c624-4ae9-bc98-25b4d5e3b431","resolution":{"observed_at":"2026-08-05T04:26:20.213270Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07978","last_updated":"2025-09-09T17:59:02Z","snapshot_observed_at":"2026-08-09T15:37:17.603849Z","submitted_at":"2025-09-09T17:59:02Z","title":"One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07978","snapshot_observed_at":"2026-08-05T04:26:19.641056Z","title":"arXiv preprint arXiv:2509.07978 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.641056Z"},"links":{"cited_paper":"/paper/2509.07978","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:61e308c0307e1636b9de32b5543859163940aa621ee6da23419e930b8b3cfa1d","observation_id":"96a0abb4-e4c6-4add-a21c-d5f47a6536f0","resolution":{"observed_at":"2026-08-05T04:26:19.641056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.695368Z","title":null,"venue":null,"work_id":"8e154236-7bd8-42a4-a9a2-e997bd47e57b","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.645409Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:85d5071596f16503aeef9986d1555005b3d233326ff734617844157117622740","observation_id":"648e1480-41fc-46fe-adba-f0fc52aa83c6","resolution":{"observed_at":"2026-08-05T04:26:20.699731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.680730Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"88bad6f5-a53a-452b-b250-5ed5c279caa9","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.649526Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:8d50eaa88753ca4ab6f13a709640d559fbb57b4f52c22ba21d4d79f309a52769","observation_id":"1fd4e114-ccf0-48de-9c82-03b3cbfc9280","resolution":{"observed_at":"2026-08-05T04:26:20.685263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:19.653343Z","title":"IEEE transactions on image processing , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.653343Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:d39ec46b480bbf433d539c2a15295d3c435ed4fd995045702ae834d5f877d5d2","observation_id":"007c75c0-a56e-46a0-9b90-860d3ec8d618","resolution":{"observed_at":"2026-08-05T04:26:19.653343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27351","last_updated":"2026-07-28T06:02:20Z","snapshot_observed_at":"2026-08-09T05:09:24.410360Z","submitted_at":"2026-05-26T17:51:59Z","title":"Feedforward 3D Editing Learns from Semantic-Part Transformation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27351","snapshot_observed_at":"2026-08-05T04:26:19.657390Z","title":"arXiv preprint arXiv:2605.27351 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.657390Z"},"links":{"cited_paper":"/paper/2605.27351","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:fe7ccc84575aa1e4397f2e582ba030e8e3cec73d1d9b913d131e2b1fa7b4fcd0","observation_id":"9e8c5d70-f9e3-4432-ae48-7c4d5edb8b23","resolution":{"observed_at":"2026-08-05T04:26:19.657390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.656829Z","title":null,"venue":null,"work_id":"28efde5b-ac5f-415c-92e6-7e135a533723","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.661754Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:7311d92b18045a53bfa1471497507a54a6a717530e74129b93308f328afcd4a8","observation_id":"27eab3bd-51b6-4871-a9fe-22e887c93aaa","resolution":{"observed_at":"2026-08-05T04:26:20.661301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.643241Z","title":"ACM Transactions on Graphics (TOG) , volume=","venue":null,"work_id":"10c2ef93-e101-46d2-9f88-cfc3a130df3e","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.665804Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:d14e37dc370c7e2156e3f76f50250aa05674023553f5f9b4980e755fb4472e2e","observation_id":"24ea695d-0969-4c9f-90c2-927695f208f4","resolution":{"observed_at":"2026-08-05T04:26:20.647583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.629357Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"bee81b56-934e-48da-a3d5-69476f40df90","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.669645Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:b373be5778045313b48a1d86ef1af8fd3a1e1df9259b7619f869894d9e5889e1","observation_id":"f9a2aaaa-4736-458a-a438-80b1cea68bb6","resolution":{"observed_at":"2026-08-05T04:26:20.634073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.01883","last_updated":"2026-07-02T08:36:02Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T08:36:02Z","title":"PairCoder++: Pair Programming as a Universal Paradigm for Verified Code-Driven Multimodal and Structured-Artifact Generation","version":1},"cited_work":{"arxiv_id":"2607.01883","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.01883","snapshot_observed_at":"2026-08-05T04:26:20.105639Z","title":"PairCoder++: Pair Programming as a Universal Paradigm for Verified Code-Driven Multimodal and Structured-Artifact Generation","venue":"cs.CL","work_id":"55bf7099-34b7-42f9-8e3f-bcbd67876f80","year":2026},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.673557Z"},"links":{"cited_paper":"/paper/2607.01883","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:eba7fddadb8a948bc7d61872894b282b82a80ad771eee5ccf45e1dcd5c65d831","observation_id":"b1990619-5040-4937-8384-1190a248f98a","resolution":{"observed_at":"2026-08-05T04:26:20.112091Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01103","last_updated":"2025-06-01T17:58:36Z","snapshot_observed_at":"2026-08-07T11:48:19.621062Z","submitted_at":"2025-06-01T17:58:36Z","title":"DeepVerse: 4D Autoregressive Video Generation as a World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01103","snapshot_observed_at":"2026-08-05T04:26:19.677979Z","title":"arXiv preprint arXiv:2506.01103 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.677979Z"},"links":{"cited_paper":"/paper/2506.01103","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:0ca6b4747f9d4d92d1bee3c8ed905742dd679a534d79ca22d3aec0ab00c01d07","observation_id":"0e877de5-00e1-477d-9d10-de9aca31026c","resolution":{"observed_at":"2026-08-05T04:26:19.677979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09415","last_updated":"2026-04-10T15:27:27Z","snapshot_observed_at":"2026-08-11T03:51:29.335032Z","submitted_at":"2026-04-10T15:27:27Z","title":"PhysInOne: Visual Physics Learning and Reasoning in One Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09415","snapshot_observed_at":"2026-08-05T04:26:19.682065Z","title":"arXiv preprint arXiv:2604.09415 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.682065Z"},"links":{"cited_paper":"/paper/2604.09415","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:b041187ca5ce597d37ac98603073594e04d2a74e173511559b8007b368578552","observation_id":"62c5e407-fe39-4c78-9f94-e6cfae480639","resolution":{"observed_at":"2026-08-05T04:26:19.682065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.615922Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"87160c99-8651-4071-8ac5-1c405a2e93a3","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.686260Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:5d4575fc5d66a588562f63631c8efdd04529d17c3c104658dad188fd6cfaf2b6","observation_id":"7069a4cf-a358-4cf1-9f8d-176950ef7c72","resolution":{"observed_at":"2026-08-05T04:26:20.620047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.602447Z","title":"SIGGRAPH Asia 2025 Conference Papers , year=","venue":null,"work_id":"08d12319-d2a0-4d81-807a-fefde12827bb","year":2025},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.689987Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:343572f50262c7faf3854d93fb2ddf3a37262ecaafdb90681a9b4c39b7e0afeb","observation_id":"91738a07-d8e7-4e93-87b7-0b2190d0f57e","resolution":{"observed_at":"2026-08-05T04:26:20.606765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.588435Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"87866d3c-9dcc-439c-b978-1c75af0092b3","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.694140Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:4c6306a68a6d785ba122ce277ae8cd3c4321e74f85d5f3f7c1482ae7bd8da74a","observation_id":"0326de84-2ede-4fa1-bb8a-82a0db348a56","resolution":{"observed_at":"2026-08-05T04:26:20.593186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09733","last_updated":"2025-03-12T18:26:34Z","snapshot_observed_at":"2026-08-10T20:33:31.498043Z","submitted_at":"2025-03-12T18:26:34Z","title":"I2V3D: Controllable image-to-video generation with 3D guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09733","snapshot_observed_at":"2026-08-05T04:26:19.697952Z","title":"arXiv preprint arXiv:2503.09733 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.697952Z"},"links":{"cited_paper":"/paper/2503.09733","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:cab364dff0ba85548080765af152f3d850843f34501380e3155f194a67374552","observation_id":"84627c5b-73c9-494d-9118-2dacb9a40d03","resolution":{"observed_at":"2026-08-05T04:26:19.697952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.574808Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"9ba27050-8e72-4299-8864-6148d3ac9387","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.702304Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:d3d60195a01d6ea41ce4b0bbb21da636c7bcc041e0ea9411ffbf251082252675","observation_id":"7a650771-7161-489d-b7b5-6850a08b0aef","resolution":{"observed_at":"2026-08-05T04:26:20.579438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:19.706287Z","title":"arXiv preprint arXiv:2601.00393 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.706287Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:9ef7669d843aa0b2113b6db48ea5d62f1333535225e0ffb7c6df954eba55bae8","observation_id":"378c902e-cbc4-4585-88ef-6779ee7f01b6","resolution":{"observed_at":"2026-08-05T04:26:19.706287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.561554Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"52db52b5-68f6-43e5-896d-466ae5734158","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.710003Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:6ee22fcf892c2ada89e8e2da1b3838bf3b6769e7092437ea38a6b8c8ae293f1e","observation_id":"ca5c0c6b-2296-4ec7-9261-47fe13d2295e","resolution":{"observed_at":"2026-08-05T04:26:20.565638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.548238Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"0addc2e4-15fc-4ce8-8981-5a9abe33b398","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.713863Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:34a28d33ff61c9babd191db8f6829457f24d68906a85ce13c5fdfac4e8e078cd","observation_id":"78d94749-7f06-40e3-b417-06c271623418","resolution":{"observed_at":"2026-08-05T04:26:20.552530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.535184Z","title":null,"venue":null,"work_id":"e442ba62-94e3-4fd0-bcf0-8a4d51a1214f","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.717981Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:11659ca041f0543629d3947167abc3311e02ba99c0e97a831dcd52a5452f958d","observation_id":"dc46a388-76cd-4d3c-a71c-1ce2a23a8d1b","resolution":{"observed_at":"2026-08-05T04:26:20.539437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:19.721783Z","title":"arXiv preprint arXiv:2602.01661 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.721783Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:ff7ef22cd3ccf266db17fa159bf12ecd11daa77e477fa2a5a8d9eed4d60a5dac","observation_id":"eabc4ef3-93c0-4b9d-9251-4c69b833f4a9","resolution":{"observed_at":"2026-08-05T04:26:19.721783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.520937Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":"f37f6d82-f7a5-414c-8106-59f791c26a5a","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.725990Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:3d123f07e3eaef2cf69eb66d543603a60a6c7fad1e5f60444c12b7683a6f50a9","observation_id":"64bce904-df28-4b12-ade7-1d4d03387bf3","resolution":{"observed_at":"2026-08-05T04:26:20.525790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.507564Z","title":null,"venue":null,"work_id":"2f729c7c-660b-4910-96bb-ebb2c4e7412d","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.730175Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:526a5e48d17593ee46fb19bc8cb53af4303034ed8cc098deaab5ec56e5010445","observation_id":"5b9a72d4-6ddd-4ad5-92c3-fe3d1706ddea","resolution":{"observed_at":"2026-08-05T04:26:20.511942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15050","last_updated":"2025-03-05T02:09:23Z","snapshot_observed_at":"2026-08-13T01:44:11.708842Z","submitted_at":"2024-12-19T16:57:45Z","title":"Uni-Renderer: Unifying Rendering and Inverse Rendering Via Dual Stream Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15050","snapshot_observed_at":"2026-08-05T04:26:19.734120Z","title":"arXiv preprint arXiv:2412.15050 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.734120Z"},"links":{"cited_paper":"/paper/2412.15050","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:e42d23f4608a11a6612506d828f06951e61a8cfd29e27e7d0f25a4ce3b2a2ef4","observation_id":"0c0845fe-4a7e-459a-946d-05fc90557871","resolution":{"observed_at":"2026-08-05T04:26:19.734120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14492","last_updated":"2025-04-01T21:14:20Z","snapshot_observed_at":"2026-08-12T04:49:11.105944Z","submitted_at":"2025-03-18T17:57:54Z","title":"Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14492","snapshot_observed_at":"2026-08-05T04:26:19.738561Z","title":"arXiv preprint arXiv:2503.14492 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.738561Z"},"links":{"cited_paper":"/paper/2503.14492","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:0ae3f59b4130fc3378a4c4c6c2312fcdcad472406a10e84fa31e3edeae15d30b","observation_id":"b9585c3c-98f4-4271-baed-acc6429fb9b6","resolution":{"observed_at":"2026-08-05T04:26:19.738561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.494038Z","title":null,"venue":null,"work_id":"ca502265-5399-4662-8ca5-279fd55419f1","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.742766Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:a65fc0ce6b44c4247d3274a9245053294e7a08157154c271af74580e4bcdc062","observation_id":"9473ac85-5a87-4db4-b6e6-370690cdf927","resolution":{"observed_at":"2026-08-05T04:26:20.498193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18590","last_updated":"2025-03-22T20:49:08Z","snapshot_observed_at":"2026-08-10T09:15:31.919236Z","submitted_at":"2025-01-30T18:59:11Z","title":"DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18590","snapshot_observed_at":"2026-08-05T04:26:19.746625Z","title":"arXiv preprint arXiv:2501.18590 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.746625Z"},"links":{"cited_paper":"/paper/2501.18590","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:4b57d9527d6f822163ad2fd823745b7dee21e7654ca0b6bf55f4f4eb25f25ed0","observation_id":"8864eca6-8a05-4663-bfbd-7436b49b37b5","resolution":{"observed_at":"2026-08-05T04:26:19.746625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.480602Z","title":"Machine Vision and Applications , volume=","venue":null,"work_id":"4d1c2b9e-48ef-4e25-877b-7a851b36989e","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.750559Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:a0efe56a33327d48c5bdc6b30c6a7e17d79de2628fa0d65295d31bcfe091acb1","observation_id":"fac6548b-9145-4e6e-b931-6aa9b5697f1f","resolution":{"observed_at":"2026-08-05T04:26:20.485299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.467137Z","title":null,"venue":null,"work_id":"d11ffc6f-8d84-4cdd-bb24-69dca8bab1fd","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.754407Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:71631493d620f6497cc87bcf98f0d8b4ae67d540e00a011fe3a239f7c7338b9b","observation_id":"c2f3a45a-3401-430e-8e87-688c1394d2ae","resolution":{"observed_at":"2026-08-05T04:26:20.471298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.451939Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"1c329b09-50e7-41c1-ba59-35a7f612d879","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.758407Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:f5abd33b0d6dc5fff782e3719d4b9d068b256d5eb6bb1a401cf61c2b06bd23dd","observation_id":"7e01aa34-eef4-48c7-a944-ffcc568c8d98","resolution":{"observed_at":"2026-08-05T04:26:20.456584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.436784Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"2b3edb08-cbd1-4e41-88e7-a8e4883c3497","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.762210Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:b2e6857617c7d28c2af1f0cb45ab10256e23bcb9898548a99aefea8bc053a09d","observation_id":"d55e1705-f3e0-4944-825c-d6e8504e37d7","resolution":{"observed_at":"2026-08-05T04:26:20.442168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.422581Z","title":"Proceedings of the 31st International Conference on Computational Linguistics (COLING) , pages=","venue":null,"work_id":"e32d6c02-0ad0-4224-b820-5a1dcc1d9480","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.766013Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:dc2cd1f65a79c70e529ad55f77ea9a7d777e7d480c92efa8b222d4479ed182d0","observation_id":"1d785074-e26f-4419-a24e-373b7119a52b","resolution":{"observed_at":"2026-08-05T04:26:20.427040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03847","last_updated":"2025-01-09T04:25:42Z","snapshot_observed_at":"2026-08-12T10:00:51.349786Z","submitted_at":"2025-01-07T15:01:58Z","title":"Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03847","snapshot_observed_at":"2026-08-05T04:26:19.769780Z","title":"arXiv preprint arXiv:2501.03847 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.769780Z"},"links":{"cited_paper":"/paper/2501.03847","citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:4fba1ebefa5c5a0671084792de21b520f31b5411c2967c504f516e73be072216","observation_id":"f0abae99-8118-426c-acb5-68056063e4cb","resolution":{"observed_at":"2026-08-05T04:26:19.769780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.409219Z","title":null,"venue":null,"work_id":"1cf5c945-c6da-4192-9105-3e94faafe829","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.773866Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:e666ee426a802a1cd16ad92e8ba4a06afadd4e79947be72277cdfe4aa2724a8b","observation_id":"a58798a1-67e4-4254-a62a-79a2a0dec9a4","resolution":{"observed_at":"2026-08-05T04:26:20.413303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.395902Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":"185205f7-ec6c-41c3-a528-b4e20c32db07","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.777919Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:9a496f01da2bf84f5983ace004cea4d283200aab444494003fb39e159564b5a7","observation_id":"74ce7127-1d65-4169-a4d2-d1ba6107e968","resolution":{"observed_at":"2026-08-05T04:26:20.400061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.382705Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"b4468871-9ab7-48cf-8666-feb216944b43","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.781974Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:2915049e468dedf99f93a2d48e53477352b13b7c1fea6ec77af1d02028796120","observation_id":"0c81264c-aa2e-47cf-ad71-d58302d72ef4","resolution":{"observed_at":"2026-08-05T04:26:20.386813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.368882Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":"eca8abfb-0556-4522-9e03-47643529a205","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.785840Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:bf52061264d86a548d1cbf5595630c26fbe7aad2c2942d560105fffc9f746448","observation_id":"ee06c855-e6c9-42a6-8e32-645346e17b9e","resolution":{"observed_at":"2026-08-05T04:26:20.373184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:19.789994Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.789994Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:92aa9c5dc86e11ae7905a87517aeb65a59eafb07d6f00a00001965d0a0a63bd7","observation_id":"358062ce-5015-4a60-a253-4d79655a157f","resolution":{"observed_at":"2026-08-05T04:26:19.789994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:26:20.345913Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages=","venue":null,"work_id":"24a25bf9-5cbe-42d8-8cd4-8f41fd8b07bf","year":null},"citing_paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:19.793906Z"},"links":{"citing_paper":"/paper/2608.00094"},"observation_digest":"sha256:cf06b4720e967c1c7cf7884d803c0560e3017f51a37a65264d752ddb57dbcbcb","observation_id":"1608b0c3-bae9-43fe-a47f-2d26a7c407a9","resolution":{"observed_at":"2026-08-05T04:26:20.350369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00094","last_updated":"2026-08-04T07:01:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T03:56:47.806519Z","submitted_at":"2026-07-30T16:55:28Z","title":"Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2608.00094."}