{"as_of":"2026-08-20T03:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3def0b4f35e8f3523d5622c5554aa45db03583b0f0b92fe28cfd0bb50e9deebf","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:26:02.271891Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:13:38.178040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2512.07527","last_updated":"2026-04-08T08:18:16Z","snapshot_observed_at":"2026-08-11T07:27:40.541892Z","submitted_at":"2025-12-08T13:01:12Z","title":"From Orbit to Ground: Generative City Photogrammetry from Extreme Off-Nadir Satellite Images","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-17T00:57:35.745943Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2512.07527"},"observation_digest":"sha256:92587e01f553acb327548bb0d6d6abcd5b323f95a8de8d665266a77531497eea","observation_id":"a162933a-d703-4f68-a459-86ac97808da0","resolution":{"observed_at":"2026-05-17T00:58:46.363491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-03T08:44:00.093660Z","title":"ArXiv:2507.21809 (2025) 1 360Anything: Geometry-Free Lifting of Images and Videos to360◦ 19","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.16192","last_updated":"2026-06-20T04:22:08Z","snapshot_observed_at":"2026-08-09T18:42:36.640301Z","submitted_at":"2026-01-22T18:45:59Z","title":"360Anything: Geometry-Free Lifting of Images and Videos to 360{\\deg}","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T08:44:00.093660Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2601.16192"},"observation_digest":"sha256:0740b5966287dc62afd0aebeeb3aed8687733e6058a0ee643fb8c25503fd21ba","observation_id":"aef31e3a-df4c-4907-926c-d1fa2bd7aeeb","resolution":{"observed_at":"2026-08-03T08:44:00.093660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2602.04876","last_updated":"2026-05-20T07:57:24Z","snapshot_observed_at":"2026-08-16T19:15:31.392809Z","submitted_at":"2026-02-04T18:58:55Z","title":"PerpetualWonder: Long-Horizon Action-Conditioned 4D Scene Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T13:26:57.909496Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2602.04876"},"observation_digest":"sha256:7867e8478ef5e38a9cdfd7cd7e42420c4484e36d0b66a7fd96d04d3d03915e8b","observation_id":"5e172177-6454-44fb-a764-ae3116a8ee6e","resolution":{"observed_at":"2026-05-21T13:30:12.738322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-07-15T13:51:30.008232Z","title":"arXiv preprint arXiv:2507.21809 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06445","last_updated":"2026-07-08T07:22:50Z","snapshot_observed_at":"2026-08-15T10:30:17.445130Z","submitted_at":"2026-03-06T16:37:15Z","title":"What if? Emulative Simulation with World Models for Situated Reasoning","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-15T13:51:30.008232Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2603.06445"},"observation_digest":"sha256:cbb6c5ad8600e22a4c8678ccaf331f6e14e6964516f20a37a7624b39f5fa64f8","observation_id":"134117c1-c633-47bb-93ce-b7bd8e703157","resolution":{"observed_at":"2026-07-15T13:51:30.008232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2603.11911","last_updated":"2026-05-06T13:54:46Z","snapshot_observed_at":"2026-08-16T00:03:57.202045Z","submitted_at":"2026-03-12T13:28:50Z","title":"InSpatio-WorldFM: An Open-Source Real-Time Generative Frame Model","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T12:07:17.341611Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2603.11911"},"observation_digest":"sha256:57773291c640cd85acf859ae3bf39ab3edfc167c29066ee9c8564622fc874258","observation_id":"fdafd95f-ecdb-4914-bcb9-b05636992662","resolution":{"observed_at":"2026-05-15T12:09:59.865909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2603.18636","last_updated":"2026-05-08T04:13:25Z","snapshot_observed_at":"2026-08-14T21:10:09.483728Z","submitted_at":"2026-03-19T09:00:08Z","title":"Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T08:55:52.757489Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2603.18636"},"observation_digest":"sha256:4ec69f130822c88e0ed3bdbcd86dc7705507212c91fdcc9f65133173d7a64c42","observation_id":"89dd8db4-4f1a-4729-9eee-8b470daf5565","resolution":{"observed_at":"2026-05-15T08:59:53.213213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-08-10T20:11:35.866439Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-10T19:36:42.100191Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:1f03ad53ace12881edad53bea518fbf07bef3308f4898093f79827b7e2b65c43","observation_id":"6aecab20-676c-4062-97d8-4d709df7392d","resolution":{"observed_at":"2026-05-10T22:45:48.934406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels.arXiv preprint arXiv:2507.21809, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-08-10T20:11:35.866439Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:96a76de58cbaf4044abf20566ea43865df1714cf65a0f142b69bc675448112b4","observation_id":"47e6f3bb-0df7-40d1-b145-714ac31e1405","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-08-13T14:43:54.028587Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:14.349469Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.08995"},"observation_digest":"sha256:be4fef394abe44c97caee0b98a2f8b7a383c885f457bd658967d7a831cca71af","observation_id":"a5b9b2f4-b253-4244-9d8e-5bd73b199093","resolution":{"observed_at":"2026-05-11T00:41:04.446793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2604.09535","last_updated":"2026-04-10T17:53:55Z","snapshot_observed_at":"2026-08-13T17:37:12.058706Z","submitted_at":"2026-04-10T17:53:55Z","title":"EgoTL: Egocentric Think-Aloud Chains for Long-Horizon Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T17:10:36.209152Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.09535"},"observation_digest":"sha256:22ba354f60eab142bdef114c0a784f1a57ab949588f27fdb35b534d2ce04ee02","observation_id":"b13c4a06-7126-4b56-97a8-a4f6181fb2e8","resolution":{"observed_at":"2026-05-11T07:26:03.070430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2604.18215","last_updated":"2026-04-21T16:05:42Z","snapshot_observed_at":"2026-08-15T20:48:38.775550Z","submitted_at":"2026-04-20T13:00:17Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T04:49:44.525757Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.18215"},"observation_digest":"sha256:68e26f64ce8982ebff97e86ddcc724e031abdaa317f05e2fc338496b8a8dc5e3","observation_id":"f5057577-9cfb-487f-be81-305ec7d2e145","resolution":{"observed_at":"2026-05-10T11:35:19.143244Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-07-12T18:37:45.495075Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.21685","last_updated":"2026-07-07T08:37:04Z","snapshot_observed_at":"2026-08-13T20:28:02.880113Z","submitted_at":"2026-04-23T13:50:12Z","title":"Resilience Revisited: A Multidimensional Framework Derived from Realistic Attack Scenarios","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T18:37:45.495075Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.21685"},"observation_digest":"sha256:3a4a5d95798b42162af97dde521c7348d7b149b17c8d43837b54673346e4bbd2","observation_id":"1dfbccdf-93ee-4163-8385-ea5049329f0a","resolution":{"observed_at":"2026-07-12T18:37:45.495075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2604.21686","last_updated":"2026-04-23T13:50:47Z","snapshot_observed_at":"2026-08-15T23:47:04.718260Z","submitted_at":"2026-04-23T13:50:47Z","title":"WorldMark: A Unified Benchmark Suite for Interactive Video World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T21:55:41.553840Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2604.21686"},"observation_digest":"sha256:2a12f9dd25e8d38632cfd2c83ac2d350361418f2ddb2ce841b61c1bed7cd5df2","observation_id":"51f067e3-c51d-4b53-89bc-17fb8212f3b7","resolution":{"observed_at":"2026-05-11T14:21:07.653056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2605.31336","last_updated":"2026-05-29T14:17:59Z","snapshot_observed_at":"2026-08-08T11:08:50.003696Z","submitted_at":"2026-05-29T14:17:59Z","title":"DecMem: Towards Minute-Long Consistent World Generation with Decoupled Memory","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T22:38:10.473453Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2605.31336"},"observation_digest":"sha256:b247a14205eb4d6ee26c42048e6fecf1dc95f6c13021712714139925e978ab46","observation_id":"b02d81f1-abf2-4c35-9f89-235c14f72122","resolution":{"observed_at":"2026-06-28T22:42:46.767781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.00499","last_updated":"2026-05-30T03:13:00Z","snapshot_observed_at":"2026-08-09T10:23:42.127989Z","submitted_at":"2026-05-30T03:13:00Z","title":"OptiWorld: Optimal Control for Video World Generation under Physical Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T19:02:51.848742Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.00499"},"observation_digest":"sha256:629db18d8b3517ecd88adddbc2c7bad401301150dcf735fb437a9926cd2556fc","observation_id":"d3075f16-0084-4cc9-a1de-1362c5b445b4","resolution":{"observed_at":"2026-06-28T19:32:35.573919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.01164","last_updated":"2026-05-31T11:12:30Z","snapshot_observed_at":"2026-08-10T04:19:28.721919Z","submitted_at":"2026-05-31T11:12:30Z","title":"Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T17:29:18.513507Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.01164"},"observation_digest":"sha256:48271e461d47514b40797bb107772a6c2b5e49281de59fa71849b53f5e742500","observation_id":"6ef63e82-5a34-4cf5-b72c-cf66eb81cb0f","resolution":{"observed_at":"2026-07-01T21:06:14.165974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.11529","last_updated":"2026-06-10T00:19:51Z","snapshot_observed_at":"2026-08-18T14:54:03.366627Z","submitted_at":"2026-06-10T00:19:51Z","title":"XPR: An Extensible Cross-Platform Point-Based Differentiable Renderer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T07:59:14.025568Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.11529"},"observation_digest":"sha256:4129e94d3d07b67086aa1154143d2ce39178e23483245e46061a56bf6dfcffc7","observation_id":"0c28ee58-cab4-4467-8aa4-bf5f3ba6f1ce","resolution":{"observed_at":"2026-07-03T13:28:19.120615Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.12213","last_updated":"2026-06-10T15:29:06Z","snapshot_observed_at":"2026-08-09T18:43:06.001483Z","submitted_at":"2026-06-10T15:29:06Z","title":"SHERPA: Seam-aware Harmonized ERP Adaptation for Open-Domain 360$^\\circ$ Panorama Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T09:45:22.821334Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.12213"},"observation_digest":"sha256:5c2d98fc597c33fbf3b67f112c302102d2b3353aa074f9e8e9ed11104451326c","observation_id":"702382d9-ac96-4a1b-a79b-011e211c5da9","resolution":{"observed_at":"2026-07-03T10:58:03.122879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.13376","last_updated":"2026-06-17T16:38:12Z","snapshot_observed_at":"2026-08-13T15:09:55.341984Z","submitted_at":"2026-06-11T14:01:02Z","title":"MoVerse: Real-Time Video World Modeling with Panoramic Gaussian Scaffold","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T07:21:39.698103Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.13376"},"observation_digest":"sha256:1fa0064229c23619cdde18428922838358eaf15e53951b6710f9e7ee69001c4d","observation_id":"78c0e212-f217-4aec-866e-d4979e4e3ffa","resolution":{"observed_at":"2026-07-03T13:58:21.904846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.13655","last_updated":"2026-06-11T17:54:05Z","snapshot_observed_at":"2026-08-16T05:33:59.886315Z","submitted_at":"2026-06-11T17:54:05Z","title":"Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T06:54:11.233650Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.13655"},"observation_digest":"sha256:ed979fe3e95eb55f36304bff51ef5e8e60f3aec58bb81e6b8e0dd7b9a7df524f","observation_id":"b8ebed14-f7ba-4bfd-aa14-67b2274a684c","resolution":{"observed_at":"2026-07-03T14:48:32.946103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.18180","last_updated":"2026-06-16T17:13:58Z","snapshot_observed_at":"2026-08-11T19:34:16.942141Z","submitted_at":"2026-06-16T17:13:58Z","title":"EgoCS-400K: An Egocentric Gameplay Dataset for World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T01:39:09.498257Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.18180"},"observation_digest":"sha256:aa290c4bad29d51e17486f5e0257decfd92c5d55a41bf76f352e9f1c3701d450","observation_id":"011a08db-d5d4-4bfa-873f-d961df8e78e7","resolution":{"observed_at":"2026-07-03T20:08:55.946757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2606.21775","last_updated":"2026-06-19T21:50:15Z","snapshot_observed_at":"2026-08-02T05:48:47.124780Z","submitted_at":"2026-06-19T21:50:15Z","title":"Beyond the Next Step: Variable-Length Latent World Models for Long-Horizon Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T14:22:14.987181Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2606.21775"},"observation_digest":"sha256:082c41e61aa2b6f2b8cdefe8f162fa56e8f9c80231c8996b87372f096a7704c5","observation_id":"1c5d2b83-7ab8-4be1-882a-85f28d88efc8","resolution":{"observed_at":"2026-07-04T06:39:37.035650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-07-12T02:19:35.281990Z","title":"arXiv preprint arXiv:2507.21809 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03461","last_updated":"2026-07-03T16:18:20Z","snapshot_observed_at":"2026-08-13T15:02:26.120680Z","submitted_at":"2026-07-03T16:18:20Z","title":"WorldBagel: Uncovering the Power of Unified Multimodal Models for Vision-Language-Action-World Modeling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T02:19:35.281990Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2607.03461"},"observation_digest":"sha256:01165ccdcd57752a8db16690b4e8c80634e9c90edfd630b6ca16620571d43470","observation_id":"50a964d1-6de6-42b9-baf2-5398d08409c4","resolution":{"observed_at":"2026-07-12T02:19:35.281990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":"2507.21809","doi":"10.48550/arxiv.2507.21809","metadata_source":"pith","pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels","venue":"cs.CV","work_id":"c6acc052-25de-49cf-90fc-d23468f99e8d","year":2025},"citing_paper":{"arxiv_id":"2607.06401","last_updated":"2026-07-07T15:31:32Z","snapshot_observed_at":"2026-08-18T13:58:20.070179Z","submitted_at":"2026-07-07T15:31:32Z","title":"A Definition and Roadmap for World Models","version":1},"reference_index":258,"source":"arxiv_source","source_observed_at":"2026-07-08T07:10:33.826140Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2607.06401"},"observation_digest":"sha256:5ddf45ffab262e8895400c693b964d24087ae6902a69ebe3206253890417979f","observation_id":"8c8710b2-2787-4aef-ae01-2a96e117ddaa","resolution":{"observed_at":"2026-07-08T07:14:44.376600Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.924462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-01T19:06:40.994730Z","title":"arXiv preprint arXiv:2507.21809 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17097","last_updated":"2026-07-19T06:41:53Z","snapshot_observed_at":"2026-08-17T01:10:36.930445Z","submitted_at":"2026-07-19T06:41:53Z","title":"HarmoHOI: Harmonizing Appearance and 3D Motion for Multi-view Hand-Object Interaction Synthesis","version":1},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-08-01T19:06:40.994730Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2607.17097"},"observation_digest":"sha256:bf7e273d23e65c18194504ae60f8fb786d96fae60a7c28f04847c4fdeec9929e","observation_id":"ef0e1315-f1d7-4ba5-9507-bd8180e64a10","resolution":{"observed_at":"2026-08-01T19:06:40.994730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-07-30T11:07:38.473701Z","title":"HunyuanWorld 1.0: Generating immersive, explorable, and interactive 3D worlds from words or pixels","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27201","last_updated":"2026-07-29T17:59:39Z","snapshot_observed_at":"2026-08-15T14:34:09.377948Z","submitted_at":"2026-07-29T17:59:39Z","title":"Mental World Modeling","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-30T11:07:38.473701Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2607.27201"},"observation_digest":"sha256:8f48aca1056f9952f80f0177ab924c480e80fc84637a2077accfc6f795d18073","observation_id":"0bae4cdf-1c15-4e69-b302-14961fd832cf","resolution":{"observed_at":"2026-07-30T11:07:38.473701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-06T12:52:07.503610Z","title":"arXiv preprint arXiv:2507.21809 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-13T03:30:27.643726Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.503610Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:efbabadafa4439d45e8d8a99d4a4557ee432cbd21e66ce3c6bfefa6893b8e967","observation_id":"e2b15240-f868-453b-9b89-a3bc09bf9778","resolution":{"observed_at":"2026-08-06T12:52:07.503610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-08T17:13:38.178040Z","title":"Hunyuanworld 1.0: Generating immersive, explorable, and interactive 3d worlds from words or pixels.arXiv preprint arXiv:2507.21809, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05248","last_updated":"2026-08-05T15:46:38Z","snapshot_observed_at":"2026-08-16T05:56:29.817463Z","submitted_at":"2026-08-05T15:46:38Z","title":"WorldClaw: Agentic 3D Open-World Generation at Scale","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:38.178040Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2608.05248"},"observation_digest":"sha256:aa5c76bbc9e65fec042bbb3c4020d5e968f85c36ad0fd5308b33de3eb7e6fb94","observation_id":"f4c374aa-410b-42bd-9a39-596e729ea14d","resolution":{"observed_at":"2026-08-08T17:13:38.178040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.21809/citation-record","integrity":"/paper/2507.21809/integrity","json":"/paper/2507.21809/citation-record.json","paper":"/paper/2507.21809"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T12:26:02.027355Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.027355Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:53e3dd338d8ff2e3d86b4a23b5a6f65454b819f74067758d0b35d920f510e5c6","observation_id":"8e83fc43-eece-4238-9e7d-4277fd04c5fb","resolution":{"observed_at":"2026-08-06T12:26:02.027355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14492","last_updated":"2025-04-01T21:14:20Z","snapshot_observed_at":"2026-08-16T12:48:53.261368Z","submitted_at":"2025-03-18T17:57:54Z","title":"Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14492","snapshot_observed_at":"2026-08-06T12:26:02.032190Z","title":"Cosmos-transfer1: Conditional world generation with adaptive multimodal control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.032190Z"},"links":{"cited_paper":"/paper/2503.14492","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:81cc2d0bf7c7b1318a8891bc040db5a51e5a4f67066634097a25954386a6d87a","observation_id":"f5ad7f50-a70a-4fb8-8496-ec4a2b63727e","resolution":{"observed_at":"2026-08-06T12:26:02.032190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T12:26:02.036435Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.036435Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:77db6a9df171b16c11a40fbbcf4fb5ce26b256b466e1823422ef2f8b0fcb87ec","observation_id":"ed6cb418-3f76-446e-89ee-3efcadba9b34","resolution":{"observed_at":"2026-08-06T12:26:02.036435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13384","last_updated":"2023-11-23T11:40:16Z","snapshot_observed_at":"2026-08-19T13:44:43.671372Z","submitted_at":"2023-11-22T13:27:34Z","title":"LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13384","snapshot_observed_at":"2026-08-06T12:26:02.040452Z","title":"Luciddreamer: Domain-free generation of 3d gaussian splatting scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.040452Z"},"links":{"cited_paper":"/paper/2311.13384","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7dabac4b7f9c00484d3505775ce31e0af61f8a70156ef952358c46a19a166b73","observation_id":"490e8db7-1bbb-40cd-a260-38e9a90e8654","resolution":{"observed_at":"2026-08-06T12:26:02.040452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.986216Z","title":"Procthor: Large-scale embodied ai using procedural generation","venue":null,"work_id":"da03461d-f96a-412f-890b-af35b2812657","year":2022},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.044409Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:a80bc6f8fa9639a02c247e9b70e10879650270064e2610c578afee56bc502749","observation_id":"28356cf3-1f3c-42ac-9559-118167805c71","resolution":{"observed_at":"2026-08-06T12:26:02.989732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.976195Z","title":"Streetscapes: Large-scale consistent street view generation using autoregressive video diffusion","venue":null,"work_id":"11f88b36-a101-4074-900c-fd2ff2644062","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.047951Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:abbb61d87ccd7f61238742af14066cc84e24755b707a9bdc01da1693531cd563","observation_id":"657ba0fd-3656-45be-97c3-723b1357c56b","resolution":{"observed_at":"2026-08-06T12:26:02.979840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13141","last_updated":"2023-11-22T04:06:39Z","snapshot_observed_at":"2026-08-16T14:41:18.076591Z","submitted_at":"2023-11-22T04:06:39Z","title":"Diffusion360: Seamless 360 Degree Panoramic Image Generation based on Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13141","snapshot_observed_at":"2026-08-06T12:26:02.051603Z","title":"Diffusion360: Seamless 360 degree panoramic image generation based on diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.051603Z"},"links":{"cited_paper":"/paper/2311.13141","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:ef7f435e88ab69f113d56cb463e64457da47eed3833a5aaa389b5366d67831b9","observation_id":"ec4bfeed-f504-4557-bbcc-9f1ca411f5fb","resolution":{"observed_at":"2026-08-06T12:26:02.051603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03568","last_updated":"2024-12-04T18:59:05Z","snapshot_observed_at":"2026-08-17T08:30:58.061060Z","submitted_at":"2024-12-04T18:59:05Z","title":"The Matrix: Infinite-Horizon World Generation with Real-Time Moving Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03568","snapshot_observed_at":"2026-08-06T12:26:02.055381Z","title":"The matrix: Infinite-horizon world generation with real-time moving control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.055381Z"},"links":{"cited_paper":"/paper/2412.03568","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:cfefc5878ee0050276c9c1c16a7039063ef3d17c9276aac8c504b26a8ff6ab08","observation_id":"146d3efa-5a7f-42cb-94c7-1131ced1c68e","resolution":{"observed_at":"2026-08-06T12:26:02.055381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.965877Z","title":"Layoutgpt: Compositional visual planning and generation with large language models","venue":null,"work_id":"67859940-e3bd-47a3-9070-b78409d32072","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.059349Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:4905df2eeead83eec252931ed388b8588568381eb80a0c8c7a975701cae793d6","observation_id":"d41e2764-2648-45c3-9caf-d7589918b07a","resolution":{"observed_at":"2026-08-06T12:26:02.969537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-08-15T07:34:03.035482Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-06T12:26:02.062770Z","title":"Cat3d: Create anything in 3d with multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.062770Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:03808583269f0386bae788ccb4a5038104efd4d2008ad0af8c24539c8179d66e","observation_id":"cdf93b42-7182-4eca-927c-652df7eb974c","resolution":{"observed_at":"2026-08-06T12:26:02.062770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02601","last_updated":"2024-05-03T04:50:27Z","snapshot_observed_at":"2026-08-17T10:41:51.380790Z","submitted_at":"2023-10-04T06:14:06Z","title":"MagicDrive: Street View Generation with Diverse 3D Geometry Control","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02601","snapshot_observed_at":"2026-08-06T12:26:02.066230Z","title":"Magicdrive: Street view generation with diverse 3d geometry control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.066230Z"},"links":{"cited_paper":"/paper/2310.02601","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:52325c060f800710b4a769e1f6199457ac2cac637d84176b46406bbddbcc4fe8","observation_id":"5b328ff0-063e-461f-8c0d-e83e8c8df4d3","resolution":{"observed_at":"2026-08-06T12:26:02.066230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.955770Z","title":"Draco: A library for compressing and decompressing 3d geometric meshes and point clouds","venue":null,"work_id":"d3a406c9-7139-4792-9a61-01f06e23f0c2","year":2017},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.069882Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:be4c1df11d08d4c47067e77329a81bad4cfd60fa8dad9f12e1539a723a70dd31","observation_id":"61ca70a7-fb42-499d-bbc1-63d75d734c04","resolution":{"observed_at":"2026-08-06T12:26:02.959209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-08-16T12:50:17.421166Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-08-06T12:26:02.073088Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.073088Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:b430040fd7fe5d4d7dae6ac97d6ff96afbcb8c7561dbf4e12dc66a115108c7ec","observation_id":"6d7e922f-a1aa-4419-9e89-b15b83ae7982","resolution":{"observed_at":"2026-08-06T12:26:02.073088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.946549Z","title":"Openlrm: Open-source large reconstruction models","venue":null,"work_id":"e1c12ac6-2c45-41fb-9f78-d792379238c0","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.076479Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:08f485e171cc0f8f22b382f57c0072da4a18fdd28aac41f0cc7e3fce47359236","observation_id":"d02c47e9-49df-4602-b621-3320a0864590","resolution":{"observed_at":"2026-08-06T12:26:02.949667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-06T12:26:02.079670Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.079670Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:e88fb606c144d1613886f4012c5305984ec7ad9f4b14366a8949115d95d805f8","observation_id":"e330b1c7-0274-4c91-b9a3-285c98bfcc89","resolution":{"observed_at":"2026-08-06T12:26:02.079670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-08-18T01:50:26.644460Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-06T12:26:02.083070Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.083070Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:f889afb170023ed3a1130eed708035e37507bf219966a3877abcf9131387855d","observation_id":"26731dc2-0e1c-4187-83cc-d3891df99c11","resolution":{"observed_at":"2026-08-06T12:26:02.083070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T12:26:02.086508Z","title":"Gaia-1: A generative world model for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.086508Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:00bc7ee99cef889661640eb8d82cd15366c264be09269e5a2e12192c7e9c4bbb","observation_id":"55643988-dd0a-4ffb-9902-01584ca3f3d0","resolution":{"observed_at":"2026-08-06T12:26:02.086508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.937434Z","title":"Worldsheet: Wrapping the world in a 3d sheet for view synthesis from a single image","venue":null,"work_id":"be901fea-1a29-4d5b-a2f1-3ea9c9576d36","year":2021},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.090771Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:6f34c4fa91ed90768542debe7ed984d3a595695af82ea809f00ef312cd0959fb","observation_id":"39ac1f04-9d0e-4818-87c1-8ce096228b28","resolution":{"observed_at":"2026-08-06T12:26:02.941087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04225","last_updated":"2025-06-04T17:59:04Z","snapshot_observed_at":"2026-08-17T14:52:52.050125Z","submitted_at":"2025-06-04T17:59:04Z","title":"Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04225","snapshot_observed_at":"2026-08-06T12:26:02.094318Z","title":"V oyager: Long-range and world-consistent video diffusion for explorable 3d scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.094318Z"},"links":{"cited_paper":"/paper/2506.04225","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:fc2dffc1266d7584939dd6e1027329192cf49ae31c2d633f2f3b02574b1dd9db","observation_id":"9754c52c-9620-4108-a10a-6f7934e5ed93","resolution":{"observed_at":"2026-08-06T12:26:02.094318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.927290Z","title":"Scene4u: Hierarchical layered 3d scene reconstruction from single panoramic image for your immerse exploration","venue":null,"work_id":"dc519201-ae3c-4975-bdfb-c8d4a5ab46c9","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.097776Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:41e980ce2340e75b035d42b984b5792501fe99c739cff30cfae0fb2ed91e5178","observation_id":"344b0625-ed22-4008-b52c-4fdd42cdaa0c","resolution":{"observed_at":"2026-08-06T12:26:02.930789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.916576Z","title":"Cubediff: Repurposing diffusion-based image models for panorama generation","venue":null,"work_id":"3287f64c-c3b1-48df-ab47-b7c6a17874cf","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.101285Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:5bda51c2845f08a57962dc399e5a671cd7f2129c71c220df8a1d598854a14011","observation_id":"a6bf79c1-615b-47d2-a5a1-6b71ba1e1e09","resolution":{"observed_at":"2026-08-06T12:26:02.920287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00626","last_updated":"2025-08-28T04:44:11Z","snapshot_observed_at":"2026-08-16T13:03:46.810878Z","submitted_at":"2024-11-01T14:34:33Z","title":"ZIM: Zero-Shot Image Matting for Anything","version":2},"cited_work":{"arxiv_id":"2411.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00626","snapshot_observed_at":"2026-08-06T12:26:02.510415Z","title":"ZIM: Zero-Shot Image Matting for Anything","venue":"cs.CV","work_id":"174a0735-ed81-4e80-81ca-9bab08f050fa","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.105338Z"},"links":{"cited_paper":"/paper/2411.00626","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:c98ddf290d61ed486a683cfb58c33994ec38f44928e8b38373ec98e72ad920b6","observation_id":"4b76d3d9-34b2-487c-97a3-90e028964bc0","resolution":{"observed_at":"2026-08-06T12:26:02.514331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.905710Z","title":"Tanks and temples: Benchmarking large-scale scene reconstruction","venue":null,"work_id":"05acd516-580e-4ca6-9316-466e573ca73b","year":2017},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.109234Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:9df83d0ceecdbc82c37d67243772e8f6481a81369d9edbb9188a6ec1f2eda2a7","observation_id":"684128cb-d093-4254-94d0-ed8075150b9d","resolution":{"observed_at":"2026-08-06T12:26:02.909256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T12:26:02.112969Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.112969Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:ae9cfd82611daea7b4fa2632aeb9ad3085bd9633385c95717540933e039df43c","observation_id":"91c1c4df-9fa4-46a4-8755-6bdbe7b823b5","resolution":{"observed_at":"2026-08-06T12:26:02.112969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.116673Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.116673Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7d9f13c4b43382482c48aa5c152a35f67e4cd29fac0b82ff42b8805c169c2a10","observation_id":"70b7d09e-8d45-485c-83e4-6e18a6c50395","resolution":{"observed_at":"2026-08-06T12:26:02.116673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.891328Z","title":"Director3d: Real-world camera trajectory and 3d scene generation from text","venue":null,"work_id":"74ad3515-7028-4efb-9497-a5e2e09f6b88","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.120265Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:c811cf6b5890527ec128cfacdf2a323d10d3a71df821713b9271136280107b2f","observation_id":"6037e515-d1d9-4113-b5f0-75f8511406dc","resolution":{"observed_at":"2026-08-06T12:26:02.894723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.123871Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chinese understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.123871Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:30af75fb7d18599efe252354afb5032a1b97b9267b1ac0616114f2cb51ee864e","observation_id":"43c8e923-97ba-460c-ab5f-ee81d28aba2d","resolution":{"observed_at":"2026-08-06T12:26:02.123871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T12:26:02.127377Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.127377Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:b63111d8296542809e91d7d4979123f507aefc003bc94c255dbbc099fc88ed0c","observation_id":"b5805acc-c186-4a32-b921-5d5c4d222bc3","resolution":{"observed_at":"2026-08-06T12:26:02.127377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04338","last_updated":"2024-06-11T03:36:09Z","snapshot_observed_at":"2026-08-19T15:22:25.610906Z","submitted_at":"2024-06-06T17:59:47Z","title":"Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04338","snapshot_observed_at":"2026-08-06T12:26:02.130956Z","title":"Physics3d: Learning physical properties of 3d gaussians via video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.130956Z"},"links":{"cited_paper":"/paper/2406.04338","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:38789d673ae9997accebf66c5b8d4f97f648953a9b164e3ef5f6e4b2676221fe","observation_id":"2cbc55cd-02c5-4780-8ac7-53a91aea9087","resolution":{"observed_at":"2026-08-06T12:26:02.130956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.134677Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.134677Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:b62ba6a7cf46974d53209948d604c466fd39a246c7cf98da326d604eaac262a7","observation_id":"3eb99ad9-e242-4e43-9aa5-7f3c208b16f8","resolution":{"observed_at":"2026-08-06T12:26:02.134677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.137750Z","title":"No-reference image quality assessment in the spatial domain","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.137750Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:5dbf6066763cdb48fcb4a9f83c1bc48cc0e3a149c5f92468fa4896b7c1b9032b","observation_id":"69bb9d64-e286-493b-a3d6-b133948bc1f9","resolution":{"observed_at":"2026-08-06T12:26:02.137750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.140649Z","title":"completely blind","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.140649Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:fed38358427ea4a22b95851e08d56bd559281191bd465aa596b96c781be66697","observation_id":"857d4635-155f-49aa-b0bb-602cd7429db4","resolution":{"observed_at":"2026-08-06T12:26:02.140649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.860381Z","title":"The synthesis and rendering of eroded fractal terrains","venue":null,"work_id":"b853f910-109c-4532-8ab4-2fd37e3bd9c7","year":1989},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.143568Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:f78674d418a3e3ff1a49107e4217899918b0022b44afd69adb0eb8738815b478","observation_id":"234d9f22-b920-4b44-a139-0561ef2353c5","resolution":{"observed_at":"2026-08-06T12:26:02.864122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.146749Z","title":"Genie 2: A large-scale foundation world model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.146749Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:a7ef997fd3bca7a088633cd405622a2d75d144f54064ff5d31e74faf0f2c2c39","observation_id":"025025c0-239d-4678-9f79-d5f94a95d00e","resolution":{"observed_at":"2026-08-06T12:26:02.146749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.845067Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"c528c9bb-8275-48d1-b2b9-7212ce249ec7","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.149604Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:91aa1318a00b41afd306519416d457733d9fd5e427ac6083ba7319d08d304db3","observation_id":"d751b925-1b5c-4836-b93d-0f976266d584","resolution":{"observed_at":"2026-08-06T12:26:02.848556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.835766Z","title":"Unik3d: Universal camera monocular 3d estimation","venue":null,"work_id":"8802f028-9621-4888-9738-e3465722e9a7","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.152342Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7ab9a5a1bbe1dbd7dfd952693e2254019ce73b801861f56d5596b30218131d6d","observation_id":"6f136649-f34d-4eab-bff9-ca90cee04168","resolution":{"observed_at":"2026-08-06T12:26:02.839189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.826124Z","title":"Barron, and Ben Mildenhall","venue":null,"work_id":"dda9bc0c-6104-478d-a5cf-83b543f49e4b","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.155213Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:d25e82a6b477572860f57bd58a57375346086f1529c3bfb68ca144b8dbe7e2ec","observation_id":"2151ca3e-1ad1-4b11-a1dc-55813d33bd54","resolution":{"observed_at":"2026-08-06T12:26:02.829328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.816442Z","title":"Infinite photorealistic worlds using procedural generation","venue":null,"work_id":"dabe6350-707f-4604-9b75-140d6a07fcbc","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.158150Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:9d2a178da9264a2086f56a7ec2bb998a5907438779d1c489d350d9668a22d5eb","observation_id":"0b0a27b0-ff5f-4117-8e48-578c16370972","resolution":{"observed_at":"2026-08-06T12:26:02.819914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.805633Z","title":"Infinigen indoors: Photorealistic indoor scenes using procedural generation","venue":null,"work_id":"246449a7-b287-4019-bdd8-98ea63c37427","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.161046Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:f2ec0e4d830bfc68b50bf2a4a77daf0fe03863d1ce2c5757caf0a512ceef20f0","observation_id":"ed8bb6e8-9fa1-4d74-a199-1ac64098a080","resolution":{"observed_at":"2026-08-06T12:26:02.809872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.164400Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.164400Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:585751ed37bd9c16bc885e810d1355b759b701f74a6e3d5c0a8a4304d940c9b8","observation_id":"ce4f1398-ebdb-4a97-ba3d-75a6272f159e","resolution":{"observed_at":"2026-08-06T12:26:02.164400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16611","last_updated":"2025-03-20T18:06:12Z","snapshot_observed_at":"2026-08-16T12:48:10.419168Z","submitted_at":"2025-03-20T18:06:12Z","title":"A Recipe for Generating 3D Worlds From a Single Image","version":1},"cited_work":{"arxiv_id":"2503.16611","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.16611","snapshot_observed_at":"2026-08-06T12:26:02.470943Z","title":"A Recipe for Generating 3D Worlds From a Single Image","venue":"cs.CV","work_id":"efb7f481-38d4-4973-aecc-019078168f8f","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.167616Z"},"links":{"cited_paper":"/paper/2503.16611","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:4314a13fe296e81bb9d8037a04a6e0b94afbdbc19d92724c5944d6ea6d9e81c0","observation_id":"72e15731-63eb-4374-8d34-408009b4d187","resolution":{"observed_at":"2026-08-06T12:26:02.475268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-06T12:26:02.171229Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.171229Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:04665343a1daaf28eb332b909ef306a82917f237a7a8da42003f0c196c51c000","observation_id":"1f1936ba-a343-4ab8-80f6-8fba74a6e514","resolution":{"observed_at":"2026-08-06T12:26:02.171229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-08-16T13:02:01.454341Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-08-06T12:26:02.174516Z","title":"Dimen- sionx: Create any 3d and 4d scenes from a single image with controllable video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.174516Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:be7a1c694b67850030eb6ba907781f3b358f5faa6d617343b6da9f11b43c2180","observation_id":"67a0346e-d221-4e78-bf57-1aae38abb2cd","resolution":{"observed_at":"2026-08-06T12:26:02.174516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.791027Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"e0fc6415-5a4f-4c11-8e5b-f1a5d775198c","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.177969Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:1ebaf21eb6b711c4e9ff65135637984002b3392f5b50f8adc36b5aa4e0de3e1c","observation_id":"5481eb6f-3adf-41ab-8f29-3de2cd4a1e3f","resolution":{"observed_at":"2026-08-06T12:26:02.794314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.779558Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":"04457598-80bd-45ce-91b8-d8c91900f592","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.181250Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:f71645345d7865fa5acde62e75248c51a85b532a6d8759072f68bb9d5f1e1ca7","observation_id":"b3c04b4a-8c22-4970-9493-30d2cfeab328","resolution":{"observed_at":"2026-08-06T12:26:02.784169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.184496Z","title":"Mvdiffusion: Enabling holistic multi-view image generation with correspondence-aware diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.184496Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:d9cb01f5981345bed3939e025796afc9a06116caac89dee51d282b1fe165d998","observation_id":"21ada51c-3e7c-4ddf-b455-517869e6cea1","resolution":{"observed_at":"2026-08-06T12:26:02.184496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.187864Z","title":"Hunyuan3d 1.0: A unified framework for text-to-3d and image-to-3d generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.187864Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:f34e746fbb6b45e67d23ebfee88e60da9a10c616e47738716a2e3418a9051f19","observation_id":"7dbe8b96-8d12-4d8a-8508-3c52afc11400","resolution":{"observed_at":"2026-08-06T12:26:02.187864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.756464Z","title":"Hunyuan3d 2.0: Scaling diffusion models for high resolution textured 3d assets generation, 2025","venue":null,"work_id":"f6f84257-3874-4df6-bf00-7f94350d29a2","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.190925Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:efb58900f12f81aefbab4db60d0e5bed4c125fab13f3839c2298d7eb2b8d3639","observation_id":"f178a129-29c4-43d8-96b5-b7a81c8eadbb","resolution":{"observed_at":"2026-08-06T12:26:02.760247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.746592Z","title":"Hunyuan3d 2.5: Towards high-fidelity 3d assets generation with ultimate details, 2025","venue":null,"work_id":"8a9e881b-b0dd-47a5-bcce-359f33f3c4e7","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.194125Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:fdeacf0afb9d245be8229f778fee59521164584b2c4e2b5cdcbba7ff0fd5eb07","observation_id":"f4dc830f-5b4c-4d95-b3d9-c63bcd4a3ab9","resolution":{"observed_at":"2026-08-06T12:26:02.750179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-08-17T23:27:13.017878Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-06T12:26:02.197425Z","title":"Magi-1: Autoregressive video generation at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.197425Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:6053edbfda9ce352c61cca11f2757881b211cd943459c24c5c565ab38f272083","observation_id":"6fe0e9c8-4993-4d49-bdb0-570fd3e00923","resolution":{"observed_at":"2026-08-06T12:26:02.197425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T12:26:02.200635Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.200635Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:8fd70700d6f51d94a81c790444b06e3ee58df9e412a43081d0083ab5f2098929","observation_id":"6325b4a1-38ec-43f9-aa48-3bf6e0ac95f0","resolution":{"observed_at":"2026-08-06T12:26:02.200635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14686","last_updated":"2023-08-28T16:21:51Z","snapshot_observed_at":"2026-08-16T15:05:12.775471Z","submitted_at":"2023-08-28T16:21:51Z","title":"360-Degree Panorama Generation from Few Unregistered NFoV Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14686","snapshot_observed_at":"2026-08-06T12:26:02.204227Z","title":"360-degree panorama generation from few unregistered nfov images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.204227Z"},"links":{"cited_paper":"/paper/2308.14686","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7f4c48fe989e7de467e68aaf6c9cc8971ebeb50480bf8a107f6f341f401de894","observation_id":"a156c768-1661-49c7-9c8f-fc5de58a129d","resolution":{"observed_at":"2026-08-06T12:26:02.204227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.736362Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision","venue":null,"work_id":"c2eaa1d2-8caf-43aa-9fdf-13cd2721e0a6","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.207690Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:537a3c5cdbd09758f2d10837a0c34af12fc0c4e7703e31164fbe9fd3db734b3a","observation_id":"8e038dbf-2124-4400-95ef-3b0da3bb71d3","resolution":{"observed_at":"2026-08-06T12:26:02.740439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.726189Z","title":"Rodin: A generative model for sculpting 3d digital avatars using diffusion","venue":null,"work_id":"5a643b28-c9a3-4113-be58-cbcea0c294cb","year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.210552Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:57f8075d47074dccad238b7507677c73280d71e6f6e442afb6a836c08422ce69","observation_id":"4553e929-d7fa-4bb8-8a63-2296c6bacd66","resolution":{"observed_at":"2026-08-06T12:26:02.729933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.213755Z","title":"Drivedreamer: Towards real-world-drive world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.213755Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:984422887d25fa05fd309cfbbd84c45331d3cc841a5c18027cb01dc989e227df","observation_id":"6f07d8c1-dfdb-4310-96ed-61741dcb0abc","resolution":{"observed_at":"2026-08-06T12:26:02.213755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.216782Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.216782Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:aa49b9ae2393cb72cbb2320364226e442794be7343b11f807a166ad8720e36f5","observation_id":"690e2af6-14e7-4169-b25b-9498c2e39b7f","resolution":{"observed_at":"2026-08-06T12:26:02.216782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11406","last_updated":"2024-09-17T17:59:33Z","snapshot_observed_at":"2026-08-16T13:17:44.345878Z","submitted_at":"2024-09-17T17:59:33Z","title":"Phidias: A Generative Model for Creating 3D Content from Text, Image, and 3D Conditions with Reference-Augmented Diffusion","version":1},"cited_work":{"arxiv_id":"2409.11406","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11406","snapshot_observed_at":"2026-08-06T12:26:02.411243Z","title":"Phidias: A Generative Model for Creating 3D Content from Text, Image, and 3D Conditions with Reference-Augmented Diffusion","venue":"cs.CV","work_id":"cd41213c-c69d-472a-a889-deeb88e30edb","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.219816Z"},"links":{"cited_paper":"/paper/2409.11406","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:88029672ecf1b35734ab2319d0c9506b1c9a58b1ddf9f927f08271c7b9d71dbb","observation_id":"eed8ab56-22c0-4f6c-b256-936a1073724c","resolution":{"observed_at":"2026-08-06T12:26:02.417218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.705250Z","title":"Worldlabs blog, 2024","venue":null,"work_id":"dca985bc-7494-4512-823b-666528f74da7","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.223386Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:697a8e8437eb7f59e24a74253b12d955857ef344e2a32d6a186340ab522f51d6","observation_id":"193ae202-aaf7-470b-a022-f559ec997c9c","resolution":{"observed_at":"2026-08-06T12:26:02.708478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-08-06T12:26:02.226405Z","title":"Q-align: Teaching lmms for visual scoring via discrete text-defined levels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.226405Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:80bba7deffc16e4af74460b1ef4c12df6c6c135ec8af305836ef2312ec89832b","observation_id":"563e4d58-6c13-4384-95d9-df5cf375bf8c","resolution":{"observed_at":"2026-08-06T12:26:02.226405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.230267Z","title":"Panodiffusion: 360-degree panorama outpainting via diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.230267Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:aed6c5e312792626f4b7f65aac889c598600025d3a8b859d0d71e8f8d6b118dc","observation_id":"3816db32-472e-43f8-91b4-3daa41079ba6","resolution":{"observed_at":"2026-08-06T12:26:02.230267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-10T16:56:54.588021Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05284","snapshot_observed_at":"2026-08-06T12:26:02.233410Z","title":"Video world models with long-term spatial memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.233410Z"},"links":{"cited_paper":"/paper/2506.05284","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:3d6d7b57c750389ce2e4d5164bc5473869dd57638437fd38dbc57b364611f87c","observation_id":"636d5055-d7e8-4139-831c-824b9ece7313","resolution":{"observed_at":"2026-08-06T12:26:02.233410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01506","last_updated":"2025-05-30T11:13:13Z","snapshot_observed_at":"2026-08-17T11:46:18.301015Z","submitted_at":"2024-12-02T13:58:38Z","title":"Structured 3D Latents for Scalable and Versatile 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01506","snapshot_observed_at":"2026-08-06T12:26:02.236795Z","title":"Structured 3d latents for scalable and versatile 3d generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.236795Z"},"links":{"cited_paper":"/paper/2412.01506","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:a9a1b5c9e2e2cdcf5f7591eb4eca18444538076db020c3cce447066d6600e45d","observation_id":"f0b274e4-0650-4d54-bd0d-ed38940ad7c9","resolution":{"observed_at":"2026-08-06T12:26:02.236795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.695815Z","title":"Worldgen: Generate any 3d scene in seconds","venue":null,"work_id":"3105a17c-c6c0-4f24-bd6f-fb42dccc9090","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.240483Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:a9646352113cd7ae04ad2f737cb90d5f5bd66ee6cae241fa8fb5da78be025be7","observation_id":"93008388-f0b5-4b68-ab63-c395cb2666fe","resolution":{"observed_at":"2026-08-06T12:26:02.699067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13252","last_updated":"2025-02-21T16:06:37Z","snapshot_observed_at":"2026-08-16T13:24:15.777384Z","submitted_at":"2024-08-23T17:50:23Z","title":"LayerPano3D: Layered 3D Panorama for Hyper-Immersive Scene Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13252","snapshot_observed_at":"2026-08-06T12:26:02.243946Z","title":"Layerpano3d: Layered 3d panorama for hyper-immersive scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.243946Z"},"links":{"cited_paper":"/paper/2408.13252","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:facc98834f90ba8cb307ced7f8d61b67a957fa7a35e3ce14fc7e385f715a1b18","observation_id":"2b6e03ce-f771-4eaa-94bd-39e7745103f7","resolution":{"observed_at":"2026-08-06T12:26:02.243946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T12:26:02.247462Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.247462Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:3ca45adc39d761271ba4c314a29b7f64896437c263f52b06c6bd9a1006241367","observation_id":"4b9f3a35-e00b-4544-a66a-d0fb30c71252","resolution":{"observed_at":"2026-08-06T12:26:02.247462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24203","last_updated":"2024-10-31T17:57:02Z","snapshot_observed_at":"2026-08-16T13:04:02.381731Z","submitted_at":"2024-10-31T17:57:02Z","title":"DiffPano: Scalable and Consistent Text to Panorama Generation with Spherical Epipolar-Aware Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24203","snapshot_observed_at":"2026-08-06T12:26:02.250912Z","title":"Diffpano: Scalable and consistent text to panorama generation with spherical epipolar-aware diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.250912Z"},"links":{"cited_paper":"/paper/2410.24203","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:df01acca0ff6ac9b401bb8cbf859752e70754941c40941734f353ed17d81cdbf","observation_id":"ee6559f6-1934-4da0-8f75-91330e86738f","resolution":{"observed_at":"2026-08-06T12:26:02.250912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.686023Z","title":"xatlas: Mesh parameterization library","venue":null,"work_id":"78dc1b0d-38ac-4e71-af7e-811e65b7fdae","year":2018},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.254774Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:ddae5dda0f52f27206b23c0186b61f82221ac8620636efdc9090e136ad842731","observation_id":"a45d47c3-81d1-4f44-bc42-d832693fd160","resolution":{"observed_at":"2026-08-06T12:26:02.689490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.675301Z","title":"Wonderworld: Interactive 3d scene generation from a single image","venue":null,"work_id":"c2392354-71dc-4f5e-ba4b-49d65fca6e79","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.257870Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:96aec498ac15107b3eec200919ab06d772dc6aaa6f74d5665bcce49d89addfc1","observation_id":"da18a110-3247-400c-aa58-66dbf50b28e2","resolution":{"observed_at":"2026-08-06T12:26:02.678848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.664861Z","title":"Wonderjourney: Going from anywhere to everywhere","venue":null,"work_id":"bb94462e-667d-47b1-a768-25f4b21610ad","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.261175Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7b37f47d1a994e8dd3ad03ea2c1621897c51fa274be3be742f6552b01171e67f","observation_id":"535c6663-0344-4458-8da1-5ab76ffc85c9","resolution":{"observed_at":"2026-08-06T12:26:02.668795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.654830Z","title":"Taming stable diffusion for text to 360 panorama image generation","venue":null,"work_id":"de62f85e-7fd7-4bd1-9c88-3018ac53726e","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.264716Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:03335105417b490b78f719144eaeb3d6313a772db70240bc510e36ea123899e4","observation_id":"182e003d-da5d-4684-9654-6e614379fb65","resolution":{"observed_at":"2026-08-06T12:26:02.658216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.645447Z","title":"Panorama generation from nfov image done right","venue":null,"work_id":"c003da59-67b9-4382-bd24-0dc6f66219de","year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.268410Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:7e732151dcbc128473127e084053674d54111a2455636e702a190f792e3545c5","observation_id":"57d2b40f-579d-449b-837d-24fa193753ea","resolution":{"observed_at":"2026-08-06T12:26:02.648844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:26:02.635001Z","title":"Scenex: Procedural controllable large-scale scene generation via large-language models","venue":null,"work_id":"ec699d74-e890-49fd-866b-3c93c93c20cc","year":2024},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.271891Z"},"links":{"citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:9b4f6b5d39b2ef4047087a8bf506fc94f3af085dd51358a677ce113edb3161cd","observation_id":"a71b7d5e-3b71-42b9-95b7-3f75df1be0a9","resolution":{"observed_at":"2026-08-06T12:26:02.638657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T23:36:33.407202Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 28 inbound Pith citation observations for arXiv:2507.21809."}