{"as_of":"2026-08-09T09:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:691f8cd98627e02057290b303975b35802b22345fb09c9a6e98f65dcff6322d9","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:52:07.585334Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04964/citation-record","integrity":"/paper/2608.04964/integrity","json":"/paper/2608.04964/citation-record.json","paper":"/paper/2608.04964"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T12:52:07.389295Z","title":"arXiv preprint arXiv:1803.10122 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.389295Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:1a4363edf18348619aa6a19f060d6a82dee471cd18df9af13b37b4d1a90c2287","observation_id":"a966c26b-efde-4b37-a854-987d711d5a61","resolution":{"observed_at":"2026-08-06T12:52:07.389295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.495887Z","title":"Proceedings of the 36th International Conference on Machine Learning , series =","venue":null,"work_id":"08a06f65-c5a0-4441-b7de-8a89b10cd233","year":2019},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.393978Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:99c6ac45fca341324fbbe50483ee0a44482b22cc12d471cec7f6ff4c32076efc","observation_id":"d6bf0421-46e5-4413-8921-94a2989ce22c","resolution":{"observed_at":"2026-08-06T12:52:08.498960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.486922Z","title":"Nature , volume =","venue":null,"work_id":"c8aa71d1-91f2-46d4-b669-59cc54f3eef6","year":2020},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.397581Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:293b5c8252bdb59d41baf52bfbfd5926407b363cf6232dcb64cb0225bb02da0d","observation_id":"c4aa3610-cc2d-4f87-83d1-cd3ff8bfaecb","resolution":{"observed_at":"2026-08-06T12:52:08.489788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.400872Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.400872Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:24de5b5f75e562ff7c280c9c14042967acebfaa359f868dcae6bb8878b0d714d","observation_id":"65714080-4fcb-4691-bee4-789898c0d20b","resolution":{"observed_at":"2026-08-06T12:52:07.400872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.403999Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.403999Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:c90f2d4a959f318e21471c34c9cd008b8cc3db588f5663cbb86b2ba623c2aef1","observation_id":"9102f933-d1dd-4a5d-bdf7-b5d1c9a1016a","resolution":{"observed_at":"2026-08-06T12:52:07.403999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.465693Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"a0ac09c3-23cd-43cc-9fe5-59e2a3aaa1a9","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.407425Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:206142bbda5ddae7f558cebe4afd4ceebebaabde66c271540759659288ac8d7c","observation_id":"4f4ecde6-faf4-44c7-84ac-8fff433ac100","resolution":{"observed_at":"2026-08-06T12:52:08.468620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.456867Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"b04c2952-7e31-4009-9265-b2630b866993","year":2020},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.410470Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:7a9222aa18bf4e01d372a146dcb4912b77f6765a202ab528101e5a94cd2f75fd","observation_id":"ebf0a668-3a83-49a9-8eed-4b95ff3dd174","resolution":{"observed_at":"2026-08-06T12:52:08.459763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.447986Z","title":"Proceedings of the 36th International Conference on Machine Learning , series =","venue":null,"work_id":"350fe670-30ee-4be5-b44a-ae9892a75a58","year":2019},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.413514Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:381261dcf37db2b01788f1037a01817580e3fbac564328a7f115063bb6b1ce65","observation_id":"6e4a0b1d-bc59-463f-beb8-f8512408a976","resolution":{"observed_at":"2026-08-06T12:52:08.450928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.438440Z","title":"Proceedings of the National Academy of Sciences , volume =","venue":null,"work_id":"d78904df-beed-452e-95f0-7507358017b0","year":2017},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.416676Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:e2b9721d698be667bcfef577ace521cc760d5c0a08600a574598032501c7aabe","observation_id":"0c3d63f6-5480-4cb9-9bc3-d25a3bffd87a","resolution":{"observed_at":"2026-08-06T12:52:08.441738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.420048Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.420048Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:a9e36401fe8daf279f55791a162248c8386f01edea622eea29f4d120edf258b7","observation_id":"a9a82c16-e3df-43f2-88e5-bc1fa06d1595","resolution":{"observed_at":"2026-08-06T12:52:07.420048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T12:52:07.423086Z","title":"arXiv preprint arXiv:2402.03300 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.423086Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:0347a997d0c3671ffd62f879fb63418669ce8a08f4595db7c3a3014b944c3f47","observation_id":"a94fc77a-8c17-4c83-8b91-53c2ad85fcd0","resolution":{"observed_at":"2026-08-06T12:52:07.423086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T12:52:07.426761Z","title":"arXiv preprint arXiv:2501.12948 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.426761Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:8a4ca09068b7edc325fafb8f8afa86120761bbc81a5d439a00a033121b631bde","observation_id":"c86b4f69-f39b-4888-aa10-4fd9745d2fef","resolution":{"observed_at":"2026-08-06T12:52:07.426761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.430820Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.430820Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:0b936926690bedb820cb22d6246893cd4abe77cc032513f568ef3046ad21c24e","observation_id":"1046a1a6-f6d2-49ed-ae6a-6c4c1683b16f","resolution":{"observed_at":"2026-08-06T12:52:07.430820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03739","last_updated":"2024-11-07T03:54:22Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:18Z","title":"Aligning Text-to-Image Diffusion Models with Reward Backpropagation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03739","snapshot_observed_at":"2026-08-06T12:52:07.433871Z","title":"arXiv preprint arXiv:2310.03739 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.433871Z"},"links":{"cited_paper":"/paper/2310.03739","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:841007e2de5a406ac6bdff70861123ed4aa67188de726555239195ddff5bc5fa","observation_id":"2173b4b2-15b9-493d-9427-40229aeffded","resolution":{"observed_at":"2026-08-06T12:52:07.433871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.416948Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":"79181d0e-16bf-4c37-a4fa-2b1c68ff77e5","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.437252Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:54813ce709ef4fc1c8d36c70addd5ed234c24b00ac143ffc9e00bc883ea58499","observation_id":"5720e1f7-bd07-4532-a6ff-9a93e76fe8c4","resolution":{"observed_at":"2026-08-06T12:52:08.419980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-06T12:52:07.440319Z","title":"arXiv preprint arXiv:2505.05470 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.440319Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:d39a2ce476d0b4900377fc7c3d945d4fe0bbad3f349d3936aa7ac8362377322f","observation_id":"1d21a86a-ad4f-4283-b200-4a278568d67d","resolution":{"observed_at":"2026-08-06T12:52:07.440319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-06T12:52:07.443964Z","title":"arXiv preprint arXiv:2505.07818 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.443964Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:c0ea025f27da12534a7bc3c13765ff2f3589a047eb8484deb0ccadbb799df492","observation_id":"22f7f965-e012-4046-9136-d740b8c6176c","resolution":{"observed_at":"2026-08-06T12:52:07.443964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16117","snapshot_observed_at":"2026-08-06T12:52:07.447160Z","title":"arXiv preprint arXiv:2509.16117 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.447160Z"},"links":{"cited_paper":"/paper/2509.16117","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:5f144a373fb3cd728e63c261bac7db751c3ccd8d5ddebb9d79b9002a41ad8c91","observation_id":"6f43c988-1dd9-45d6-8304-a971014e684e","resolution":{"observed_at":"2026-08-06T12:52:07.447160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.407552Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"d4f9e7da-6198-4729-8dca-594d85ff4393","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.450340Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:b3a95cdcae1a51ed9bc316bddaa42af0745ca1f89186e0979d5e860606a29ba8","observation_id":"609e055e-f452-4bc6-9755-ad37334efc84","resolution":{"observed_at":"2026-08-06T12:52:08.410891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.397484Z","title":"Proceedings of the 41st International Conference on Machine Learning , year =","venue":null,"work_id":"0ed7e7f7-dc57-4fc8-92ab-4aea793bd8f8","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.453296Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:0e7f66fa03120e40940bbb75a6f438b00a86555ed64d75492ad32ad2159e6d17","observation_id":"fffe7d35-ce02-4655-b950-9280dbfe3d49","resolution":{"observed_at":"2026-08-06T12:52:08.401218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.387239Z","title":"2024 , howpublished =","venue":null,"work_id":"72dc004b-695b-4ace-ac86-1fdd2a01297b","year":2024},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.456267Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:344e1cab3b9399d6ed59f83af8d594a62baae4b2de6e59c1f36ceaf68da1f7b6","observation_id":"14226566-6c2c-4436-b1ed-a402f4220d07","resolution":{"observed_at":"2026-08-06T12:52:08.391069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.378227Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"c3cbc325-8887-4a42-bc71-21c3aa790abb","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.460021Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:f0b9930931b63c500cbf3e0418c92064671bbd12359e4a3b17e0af3bb3ad2fe0","observation_id":"7dca4008-1a77-4e15-b2ae-5cb21b20ccbd","resolution":{"observed_at":"2026-08-06T12:52:08.381202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.368073Z","title":null,"venue":null,"work_id":"0d27e10d-8ef4-4812-83fc-643b1b7f5e8b","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.463398Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:9eec45a9e963bab824159ab2ab6ab6ebefd64ec37c9bba83f00ef76abb50d161","observation_id":"8f6ed51b-aa50-41d4-9ec8-9f9833820b3b","resolution":{"observed_at":"2026-08-06T12:52:08.371710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.358832Z","title":"and Hu, Zhiting , journal =","venue":null,"work_id":"b2550bcc-8fdd-49cc-93f6-ccd200106f21","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.466170Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:84e0ad429727ac61a1c4faf459f196c8e073f52eabe5487c22fe592bc8de25ad","observation_id":"fa9e2fe9-4c29-4f53-8333-7b948c3ed27d","resolution":{"observed_at":"2026-08-06T12:52:08.361868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.349448Z","title":"Proceedings of the 41st International Conference on Machine Learning , year =","venue":null,"work_id":"0b0ccc6e-87fa-4a23-8c33-42158d2f03a0","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.469183Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:63f12a2fbefed22135050617c1694cb4e4299d5f2bf9956361c13f822e9ca75a","observation_id":"831457de-9124-4119-9673-ac1729e79c36","resolution":{"observed_at":"2026-08-06T12:52:08.352562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.339677Z","title":"2024 , howpublished =","venue":null,"work_id":"7a785340-475b-4d2e-8052-00685e6059a1","year":2024},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.472121Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:e8479ff1e7c22ff4e0dc206f7117c415108920065b22668ae8d9bf0ef66b35a3","observation_id":"a4088ae4-7bee-411d-8fc2-fbb8e09325dd","resolution":{"observed_at":"2026-08-06T12:52:08.343007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.330130Z","title":"2025 , howpublished =","venue":null,"work_id":"86e07006-36c4-40b3-9c02-726634476457","year":2025},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.475013Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:b7aab40e53fc54a0b59f6773efba615e320d3d059b8d3113aa5f4d4079a4efd1","observation_id":"2a70d464-93ef-440a-864f-fef970b45a4a","resolution":{"observed_at":"2026-08-06T12:52:08.333292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-07-06T19:06:23.640089Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14837","snapshot_observed_at":"2026-08-06T12:52:07.478205Z","title":"arXiv preprint arXiv:2408.14837 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.478205Z"},"links":{"cited_paper":"/paper/2408.14837","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:588065ebcc42d65e7faeacd2137ce6874acabd50aee0d76749e26a453ef95aa3","observation_id":"2fb42671-c29c-4375-9151-0136b4697114","resolution":{"observed_at":"2026-08-06T12:52:07.478205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.481530Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.481530Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:4a900c90b3582b3e2c2abc3c7734c4ee9bc66687ac441374b747c52bcf12637e","observation_id":"caa9ed73-0db5-455f-b738-e94eae40a9e0","resolution":{"observed_at":"2026-08-06T12:52:07.481530Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.312935Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":"50bdd849-7fc8-44ca-93e7-a4799d270001","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.484450Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:a9088940df3be2caee8c0b0aa366b74c7d8f05d818b8e7bce6a72d26bb4c90b7","observation_id":"64c0fdb6-bc3a-4461-8d29-c7a4ddfcdd11","resolution":{"observed_at":"2026-08-06T12:52:08.316450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18701","last_updated":"2025-06-23T14:40:49Z","snapshot_observed_at":"2026-08-07T02:31:55.435917Z","submitted_at":"2025-06-23T14:40:49Z","title":"Matrix-Game: Interactive World Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18701","snapshot_observed_at":"2026-08-06T12:52:07.487383Z","title":"arXiv preprint arXiv:2506.18701 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.487383Z"},"links":{"cited_paper":"/paper/2506.18701","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:5b83075767a5f3bc571bc9bddf65704c2713acdc1bddf96c0afc55ed049206c9","observation_id":"51376c77-4811-4af3-bb1c-4980817b2313","resolution":{"observed_at":"2026-08-06T12:52:07.487383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.303268Z","title":"Proceedings of the 43rd International Conference on Machine Learning , note =","venue":null,"work_id":"02ce0f3e-cd33-4838-8a88-77085015648a","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.490691Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:2498170d2ac06b0db76d2b861b2b2fbf19dc2081f27a8f3fd2c99024fe0c779b","observation_id":"db1a89b3-ef81-4dbb-b3a0-ede6db496e01","resolution":{"observed_at":"2026-08-06T12:52:08.306431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07534","last_updated":"2026-07-08T15:33:25Z","snapshot_observed_at":"2026-07-11T23:20:11.647150Z","submitted_at":"2026-07-08T15:33:25Z","title":"Infinite Worlds with Versatile Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.07534","snapshot_observed_at":"2026-08-06T12:52:07.493836Z","title":"arXiv preprint arXiv:2607.07534 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.493836Z"},"links":{"cited_paper":"/paper/2607.07534","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:6afc028c654c4cc857f4f3b637bf7e45e997f61ec1408befb5f695c8229e35a7","observation_id":"5f14f0c9-2bf6-4c0e-83ba-a63f2314a837","resolution":{"observed_at":"2026-08-06T12:52:07.493836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14268","last_updated":"2026-04-15T17:59:17Z","snapshot_observed_at":"2026-07-06T23:02:05.116649Z","submitted_at":"2026-04-15T17:59:17Z","title":"HY-World 2.0: A Multi-Modal World Model for Reconstructing, Generating, and Simulating 3D Worlds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14268","snapshot_observed_at":"2026-08-06T12:52:07.496933Z","title":"arXiv preprint arXiv:2604.14268 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.496933Z"},"links":{"cited_paper":"/paper/2604.14268","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:b3559c7834fefaf08e94a9ad3fd588243aeeb33a32e14663331f0ca7ae3330ce","observation_id":"a8872ce4-31ca-4b5f-b476-48ac88cd9ce6","resolution":{"observed_at":"2026-08-06T12:52:07.496933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T12:52:07.500257Z","title":"arXiv preprint arXiv:2501.03575 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.500257Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:8d6defb3738509eacd86b37338ca83ce8bc94edecb53c019f5eb634ce36cc257","observation_id":"0b7b2828-dfbd-4808-be45-b3c2fb067557","resolution":{"observed_at":"2026-08-06T12:52:07.500257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-06T12:26:01.183840Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21809","snapshot_observed_at":"2026-08-06T12:52:07.503610Z","title":"arXiv preprint arXiv:2507.21809 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.503610Z"},"links":{"cited_paper":"/paper/2507.21809","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:80711237298b2d84f72a557c5224b986d2cb856b68d44d573e6b7f31be4033a3","observation_id":"e2b15240-f868-453b-9b89-a3bc09bf9778","resolution":{"observed_at":"2026-08-06T12:52:07.503610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.293125Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":"b36c24de-f549-48b6-86bd-05685d6889b1","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.506567Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:59f043a581c0df84b3bd95c0f8f4721073ecd23dffb88218a9367fdf5a860667","observation_id":"94e359db-1db2-49af-97fd-9cb34b2fbd13","resolution":{"observed_at":"2026-08-06T12:52:08.296702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.283499Z","title":"2025 , doi =","venue":null,"work_id":"9609a3e8-1fb5-48fa-913b-8328ee5b7ac5","year":2025},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.510115Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:c9f2dfb9d87bd504cef8633497c651a902e964c873113c1aeed8550dea8e13e8","observation_id":"29bc183c-44ff-499a-8b36-4c85b272cd7e","resolution":{"observed_at":"2026-08-06T12:52:08.286543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.273711Z","title":"2024 , publisher =","venue":null,"work_id":"8a38dff7-2eac-4d18-9dbf-b29ab4790c4c","year":2024},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.513307Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:f045a9344c6baddc1c482ad17f6631fe9c3a32b62aba55c7754b8b5bd23bf13d","observation_id":"98a02ea0-241c-405d-b847-3098adf48626","resolution":{"observed_at":"2026-08-06T12:52:08.276867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.516415Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.516415Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:81f32e10dc7098c7307dc964143c827e1772e69baaf082db35e23acffac9cc10","observation_id":"2d61345d-ef31-40cb-af2d-7ee7ab302adc","resolution":{"observed_at":"2026-08-06T12:52:07.516415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.257403Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"fb3bca64-163b-42e3-9d3c-1e4c29693dfa","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.519674Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:dd1501ea3edf64f2270dc988955618fb7ece34ee52e294eafa975c8806e991a2","observation_id":"3700b4ee-4d4b-457a-b134-95aac8a200c5","resolution":{"observed_at":"2026-08-06T12:52:08.260918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.247699Z","title":null,"venue":null,"work_id":"692f2b12-4fa0-48a6-868e-23b8cf9e0860","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.522619Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:c237766244907791a2d4413acd28a8bdd7d6d366f887a78a81d1d45e42c9bb2c","observation_id":"9f9bd703-59cf-4e32-926f-c223c4ef1283","resolution":{"observed_at":"2026-08-06T12:52:08.251289Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.235841Z","title":"2026 , note =","venue":null,"work_id":"71b6cb6d-37a7-4a99-9bf8-c013eafa3b6d","year":2026},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.525826Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:2b2624855d9da165900882482deff1cfa87ffb48b9978758e63d0b5eeb151fd8","observation_id":"9e42065d-8090-468e-b7ba-c167c1a6aa20","resolution":{"observed_at":"2026-08-06T12:52:08.239015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.226844Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"25682305-f4df-40e1-bb37-fe49dc5d8201","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.528729Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:4171b697e498adcb913b26afe11355e3a9b655d717ae5823ce33fc49a5327141","observation_id":"b0bfa6fe-f1eb-4af8-b28a-6ba4d9360c72","resolution":{"observed_at":"2026-08-06T12:52:08.229938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.217799Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"72859b38-426d-4021-a069-dc73eefdfd0f","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.531526Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:f8f8d1b7aed65387e15b68f5c34c8f86c27207c48678e8f90b46fda1ca87540e","observation_id":"ce111754-94e8-4efd-aba8-4b6d8cffe8c8","resolution":{"observed_at":"2026-08-06T12:52:08.220797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.208604Z","title":null,"venue":null,"work_id":"11bedd9e-83e7-4286-b652-9a74a3533e0a","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.534518Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:008b9ad5cebf235580c044e41e3e8eb8b4deefd3d0e958a7a57454b9ec2e0058","observation_id":"802b1d91-c98e-426d-91da-79adc772dd9b","resolution":{"observed_at":"2026-08-06T12:52:08.211475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.538105Z","title":"2602.08025 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.538105Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:0cc30aa5bb12cabb499465e9480ed09fe020db9a28b6e591ae77b3a32580622d","observation_id":"ac683f87-b2c1-4c63-b09f-8c8deed89da6","resolution":{"observed_at":"2026-08-06T12:52:07.538105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.199176Z","title":null,"venue":null,"work_id":"0655e1dd-286d-488d-902b-8338eb3ba655","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.541003Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:4b4d7b0e630f5da11a901ec93724037b291c44a94b09a84e39d4ccce1eb8d1df","observation_id":"1b1fc2fa-8274-4aed-928d-9521faa98e5c","resolution":{"observed_at":"2026-08-06T12:52:08.202526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.188375Z","title":"Proceedings of the 40th International Conference on Machine Learning , series =","venue":null,"work_id":"dd61ceca-70c4-40cb-92ff-b433cb033a3a","year":2023},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.544656Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:438f5c20b2f300535eda29d58fa42ded92e684220ccaecce0d09fb74a347e8c1","observation_id":"5dd2b760-672e-4c1e-94ec-78cee576ffab","resolution":{"observed_at":"2026-08-06T12:52:08.193191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.179222Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":"39ae2de8-f937-4133-b005-6ac0e0e1c2a3","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.547724Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:226bfaadae96f0062b7aeed031b010a117c46f248e74a29211f194ceeb6b7012","observation_id":"ba71841a-48bf-4508-97ee-e2e58228dcc7","resolution":{"observed_at":"2026-08-06T12:52:08.182478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-06T12:52:07.550886Z","title":"arXiv preprint arXiv:2404.08471 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.550886Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:11e60d43a443a088411dffb9db1dfb7695a31e114e6c327644333e80917b2dab","observation_id":"ddc335b8-21a4-45ee-86ed-5f751aa42242","resolution":{"observed_at":"2026-08-06T12:52:07.550886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21996","last_updated":"2026-05-28T06:02:27Z","snapshot_observed_at":"2026-08-07T13:15:36.558064Z","submitted_at":"2025-05-28T05:55:44Z","title":"VRAG: Learning World Models for Interactive Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21996","snapshot_observed_at":"2026-08-06T12:52:07.554883Z","title":"arXiv preprint arXiv:2505.21996 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.554883Z"},"links":{"cited_paper":"/paper/2505.21996","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:a5aab976a9b00c70f51bc167edd99d3efc0f2dae81692b5b5fb846118d2adc44","observation_id":"a864c737-e7e6-41bb-bda6-80baa054b784","resolution":{"observed_at":"2026-08-06T12:52:07.554883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-07T11:02:24.060549Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05284","snapshot_observed_at":"2026-08-06T12:52:07.557992Z","title":"arXiv preprint arXiv:2506.05284 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.557992Z"},"links":{"cited_paper":"/paper/2506.05284","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:d26df9132b540eda574bf5b99047a4cce7676b9ba2660bc4332a84cef5cc8877","observation_id":"9e44f665-33e6-4ece-8411-de2300489ce0","resolution":{"observed_at":"2026-08-06T12:52:07.557992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.169437Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":"ff058088-9645-43aa-b675-7aa59cf9dfb8","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.561418Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:efce3094c8954bb7b9b10b95550ee3fd90af4beda6f540bd90d6cc3e816b8f50","observation_id":"1c427656-c539-472e-a182-deef20e4a4f4","resolution":{"observed_at":"2026-08-06T12:52:08.172742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.564386Z","title":"arXiv preprint arXiv:2509.23958 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.564386Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:472ef55aea09a9343db734339503457db9d9e0cf503c248b7239c0328ad6ba3d","observation_id":"aa71bce9-2b9f-42fc-ade4-b509f8fc07b7","resolution":{"observed_at":"2026-08-06T12:52:07.564386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.158957Z","title":null,"venue":null,"work_id":"b5dde7c4-0ffb-4332-923b-d3f833b13c65","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.567323Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:104d1deca7e8bdd7fe1c9ef49241876808a673c3d1fb56eb8739eb07836117dc","observation_id":"2b187d94-775f-4a9b-b5e9-117abb165c19","resolution":{"observed_at":"2026-08-06T12:52:08.162012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.149164Z","title":"2024 , publisher =","venue":null,"work_id":"c7fbdc57-f24e-469d-86b3-169ef89a8851","year":2024},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.570418Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:d69cd9b491e473c036ff4d0813576dfc64f88d3221852ca180a66d7eb2568629","observation_id":"258ce293-7a01-4055-9ed7-a3f0f7ad570b","resolution":{"observed_at":"2026-08-06T12:52:08.152324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.138864Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"07b2c0e3-c1da-4b4f-9e68-66bd41c19d15","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.573413Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:d7e69974d20c1d307b8918d49d4f3951cbe1d930374820910a2bf7cccd8a59ab","observation_id":"3d0fff2a-e41b-4f79-86b2-94fc52a41e72","resolution":{"observed_at":"2026-08-06T12:52:08.142338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.128270Z","title":"2025 , eprint=","venue":null,"work_id":"28936b3b-9f49-4ef4-bbbf-d0680e4f9400","year":2025},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.576158Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:2c2db64fe7ef12395a83755191728a3e88b4c881a334ea9cd2f6d78d64d50bfa","observation_id":"4c655baa-8493-4a96-b952-3cf4a3ff3391","resolution":{"observed_at":"2026-08-06T12:52:08.131490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24578","last_updated":"2026-05-23T13:42:35Z","snapshot_observed_at":"2026-08-02T07:50:35.635060Z","submitted_at":"2026-05-23T13:42:35Z","title":"World Models as Group Actions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24578","snapshot_observed_at":"2026-08-06T12:52:07.578878Z","title":"arXiv preprint arXiv:2605.24578 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.578878Z"},"links":{"cited_paper":"/paper/2605.24578","citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:15a047b6e48ee174afb64852d1e23fc836eeaf69a3c6d974b8a5c2d4890b0d6b","observation_id":"c6f6aca2-6833-4078-929d-8d2af990d511","resolution":{"observed_at":"2026-08-06T12:52:07.578878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:08.115649Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops , pages =","venue":null,"work_id":"566d0178-238d-4cf9-8a22-41b097959a67","year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.582121Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:5dcb9d6b838d5e0e63f6e262e9525f450d655d9819862c9f8fa4c4925d33ef63","observation_id":"96829383-6b44-4e0a-8861-66cb81ca0188","resolution":{"observed_at":"2026-08-06T12:52:08.120574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:52:07.585334Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T12:52:07.585334Z"},"links":{"citing_paper":"/paper/2608.04964"},"observation_digest":"sha256:e5ef6c1bd5def6fdbd70d193eb45c58a827cb0a4c7410e41aec16234ad79754d","observation_id":"a575c53a-5e83-4e35-a516-33578bb382e1","resolution":{"observed_at":"2026-08-06T12:52:07.585334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04964","last_updated":"2026-08-05T15:34:47Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T23:13:40.838851Z","submitted_at":"2026-08-05T15:34:47Z","title":"WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":30,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.04964."}