{"as_of":"2026-08-09T06:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5fbe95270ec383254df2b5fc3ec35f9621cd2a60c11060d3d0abc889e209ffe","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:44:40.081765Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05776/citation-record","integrity":"/paper/2608.05776/integrity","json":"/paper/2608.05776/citation-record.json","paper":"/paper/2608.05776"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.22370","last_updated":"2026-06-21T07:39:37Z","snapshot_observed_at":"2026-07-06T23:57:14.069903Z","submitted_at":"2026-06-21T07:39:37Z","title":"Towards Error-Free Long Video Generation","version":1},"cited_work":{"arxiv_id":"2606.22370","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.22370","snapshot_observed_at":"2026-08-07T23:44:42.717221Z","title":"Towards Error-Free Long Video Generation","venue":"cs.CV","work_id":"36111777-dc80-4c6c-a5e1-dfb90a7244d5","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.849925Z"},"links":{"cited_paper":"/paper/2606.22370","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:e2c91e8e700faad676192737902a9eb6cec452908ca011cc78eb9516e9d2ca07","observation_id":"d8c3317f-d222-45e2-a8e1-14844feb5ea7","resolution":{"observed_at":"2026-08-07T23:44:42.735787Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:39.868218Z","title":"Avatarforcing: One- step streaming talking avatars via local-future sliding-window denoising.arXiv preprint arXiv:2603.14331,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.868218Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:ce07bba1cf2e582267f04d4afa2fdcbaa34c5bc8ca8ec4dd7dd90b07449abaf0","observation_id":"097a62c3-a92d-48d6-8d7c-304eb1a9e39d","resolution":{"observed_at":"2026-08-07T23:44:39.868218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:39.873464Z","title":"Dreamid-omni: Unified framework for controllable human-centric audio-video generation.arXiv preprint arXiv:2602.12160,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.873464Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:ead192383a7423fbc6ae364886ed8db9eca4d4a9432b49023b9637dfc146eb63","observation_id":"1da0607f-4214-484c-b68e-79d1b4ab2f62","resolution":{"observed_at":"2026-08-07T23:44:39.873464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21661","last_updated":"2026-06-19T18:06:15Z","snapshot_observed_at":"2026-08-02T10:44:02.035539Z","submitted_at":"2026-06-19T18:06:15Z","title":"UnityShots: Memory-Driven Multi-Shot Audio-Video Generation with Boundary-Aware Gating","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.21661","snapshot_observed_at":"2026-08-07T23:44:39.879025Z","title":"Unityshots: Memory-driven multi-shot audio-video generation with boundary-aware gating.arXiv preprint arXiv:2606.21661,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.879025Z"},"links":{"cited_paper":"/paper/2606.21661","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:6077ac0222107492e216534b63f06423934c2a9c193ca03fb7c625733dc63a49","observation_id":"f79588df-4aae-4004-b8a4-4d776be64733","resolution":{"observed_at":"2026-08-07T23:44:39.879025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-07T23:44:39.884692Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.884692Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:f7ce5e7a3bb43b8727ba3cd7233cbc924a4c1339eb8f09a33cf6d91ef4ec4b23","observation_id":"e1398963-9808-4c22-be92-6bfde189a6f6","resolution":{"observed_at":"2026-08-07T23:44:39.884692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T23:44:39.894675Z","title":"GitHub: jd- opensource/JoyAI-Echo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.894675Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:2b6fec0070a21f2d281d634971e6b0fb4224d606116ae4c0f88a02054898a94e","observation_id":"6283e165-43c4-42ab-9cec-b82064210575","resolution":{"observed_at":"2026-08-07T23:44:39.894675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:39.899710Z","title":"Stable video infinity: Infinite- length video generation with error recycling.arXiv preprint arXiv:2510.09212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.899710Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:dca3803e1549a4ca0e9a4afdf2cf0fa580223fa5a3116ea1c80d100e3ee8d1be","observation_id":"1cba8373-83ad-4b7d-984c-61f3778d2e5b","resolution":{"observed_at":"2026-08-07T23:44:39.899710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-08-08T11:22:22.336902Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25161","snapshot_observed_at":"2026-08-07T23:44:39.994931Z","title":"Rolling forcing: Autoregressive long video diffusion in real time.arXiv preprint arXiv:2509.25161,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.994931Z"},"links":{"cited_paper":"/paper/2509.25161","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:c4983c7d4874e64a4bd6bd7df6c61a65db178c4237d630ade194c0fc60b9919a","observation_id":"0cfb0aa9-76aa-4722-ab42-98f407aaa3a9","resolution":{"observed_at":"2026-08-07T23:44:39.994931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.000257Z","title":"Filmweaver: Weaving consistent multi-shot videos with cache-guided autoregressive diffusion.arXiv preprint arXiv:2512.11274,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.000257Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:8c639271044ff836aa18b2395a3aaa52c0b9b7af3a7c858b3c24d2d63fee06ad","observation_id":"f778ec24-1694-4f99-907b-96eb73c630e6","resolution":{"observed_at":"2026-08-07T23:44:40.000257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:41.589840Z","title":"Corruption-aware training of latent video diffusion models for robust text-to-video generation.arXiv preprint arXiv:2505.21545,","venue":null,"work_id":"d37f8ed1-b3aa-4a14-9adf-e62b63e6d7a8","year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.005388Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:d0988838cda472b0a974460b36f14ff8904c91135b3f98de05aa46a391aedb96","observation_id":"d29496a6-a2fe-4b15-be2c-3e6c6c8fa5b6","resolution":{"observed_at":"2026-08-07T23:44:41.598489Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.010131Z","title":"Holocine: Holistic generation of cinematic multi-shot long video narratives.arXiv preprint arXiv:2510.20822,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.010131Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:a149ee79deb37c6c6bc79ad76ada6da4fac4a840655ee608c52064f97b2cdd90","observation_id":"8add9bc1-6923-40ec-a6ff-5b5a91138141","resolution":{"observed_at":"2026-08-07T23:44:40.010131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13035","last_updated":"2026-06-11T08:16:08Z","snapshot_observed_at":"2026-08-09T02:31:00.420557Z","submitted_at":"2026-06-11T08:16:08Z","title":"TetherCache: Stabilizing Autoregressive Long-Form Video Generation with Gated Recall and Trusted Alignment","version":1},"cited_work":{"arxiv_id":"2606.13035","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.13035","snapshot_observed_at":"2026-08-07T23:44:41.199339Z","title":"TetherCache: Stabilizing Autoregressive Long-Form Video Generation with Gated Recall and Trusted Alignment","venue":"cs.CV","work_id":"469aeb38-e872-4a3b-a2ff-3250bf5cee8a","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.015028Z"},"links":{"cited_paper":"/paper/2606.13035","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:e08f5ad1458c2305a046922207570f7d5f914fb9f04f370121232efd6c5dc792","observation_id":"d01234ba-5349-4d88-9010-fd272c8b1459","resolution":{"observed_at":"2026-08-07T23:44:41.204214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20910","last_updated":"2026-05-20T08:55:37Z","snapshot_observed_at":"2026-08-02T06:22:21.581112Z","submitted_at":"2026-05-20T08:55:37Z","title":"FlowLong: Inference-time Long Video Generation via Manifold-constrained Tweedie Matching","version":1},"cited_work":{"arxiv_id":"2605.20910","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20910","snapshot_observed_at":"2026-08-07T23:44:41.178079Z","title":"FlowLong: Inference-time Long Video Generation via Manifold-constrained Tweedie Matching","venue":"cs.CV","work_id":"f7ea6a9c-68ad-4245-bfdc-7eb4187f6729","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.019669Z"},"links":{"cited_paper":"/paper/2605.20910","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:2fbd3f49723648acd2300ce10adca791ae59b6fc714874a7da24257b99ae9a9f","observation_id":"6e6ce10f-f6ed-4617-9a38-43469fa7f1de","resolution":{"observed_at":"2026-08-07T23:44:41.183002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T23:44:40.028568Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.028568Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:476624cc624c1422bddf94777b227bd3429d273f8048310c0aa7d631cd9e19d2","observation_id":"fad09602-5a86-4cc5-88e9-2a28176cf0a3","resolution":{"observed_at":"2026-08-07T23:44:40.028568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.033441Z","title":"Error analyses of auto-regressive video diffusion models: A unified framework.arXiv preprint arXiv:2503.10704,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.033441Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:0c5343f6c6a571cad5a087b285a52f683d4600c9479c3c4e2c94ddef5a056629","observation_id":"f383f6e5-db75-4204-9598-2d96fb7733a5","resolution":{"observed_at":"2026-08-07T23:44:40.033441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-08-07T23:44:40.037787Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long-horizon memory.arXiv preprint arXiv:2604.08995,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.037787Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:6a149d57823e691789f4918ad1357d4bb353d0d8ccffb9f77e498e33a691da6a","observation_id":"fba1d459-0315-4e2a-829f-66e496828f60","resolution":{"observed_at":"2026-08-07T23:44:40.037787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2606.14667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.929088Z","title":"Memento: Reconstructtorememberforconsistentlongvideogeneration.arXiv preprint arXiv:2606.14667,","venue":null,"work_id":"225932d5-ec7c-4fdf-b1a2-2927fcd18eff","year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.042295Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:b1ca1278a4602e5dec9805a8434370cbaf0ffc8891c6ee2f282744aa218311df","observation_id":"863009d0-fd96-4097-b3a4-51e5644c9cce","resolution":{"observed_at":"2026-08-07T23:44:40.937213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T23:44:40.046808Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.046808Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:257407531c715da0321896810896e09711cbeb814a06d99a4538ecdff7dd3296","observation_id":"177524fd-3dc5-4155-9699-1a2ec877dc94","resolution":{"observed_at":"2026-08-07T23:44:40.046808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23586","last_updated":"2026-08-04T09:15:37Z","snapshot_observed_at":"2026-08-07T23:09:24.588848Z","submitted_at":"2026-04-26T07:48:47Z","title":"Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling","version":2},"cited_work":{"arxiv_id":"2604.23586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23586","snapshot_observed_at":"2026-08-07T23:44:40.857839Z","title":"Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling","venue":"cs.CV","work_id":"6ab77167-91e8-4099-aa80-7311c5e28eeb","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.051669Z"},"links":{"cited_paper":"/paper/2604.23586","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:32539e1798f7a68d0ba4a46e06e0a40214333bc66900d7d63d9299a79e7c5467","observation_id":"715e7359-8241-4fe5-aaa5-e9fc87f25036","resolution":{"observed_at":"2026-08-07T23:44:40.863368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.056335Z","title":"Storymem: Multi-shot long video storytelling with memory.arXiv preprint arXiv:2512.19539,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.056335Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:72c3f6d92ff96b97c423c3793f10ea5570533b6b7d90cdb373f62ea95481e6e1","observation_id":"d060d691-11d1-400f-ada7-2bfc920facf9","resolution":{"observed_at":"2026-08-07T23:44:40.056335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.25473","last_updated":"2026-06-24T06:58:02Z","snapshot_observed_at":"2026-08-05T22:45:50.916812Z","submitted_at":"2026-06-24T06:58:02Z","title":"Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models","version":1},"cited_work":{"arxiv_id":"2606.25473","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.25473","snapshot_observed_at":"2026-08-07T23:44:40.663855Z","title":"Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models","venue":"cs.CV","work_id":"0c93c14d-d42c-47b6-ac16-3ce6b4573b27","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.060768Z"},"links":{"cited_paper":"/paper/2606.25473","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:a39dc9e5ee09f6cbc271f8328ed837d7dfcd06bbabecd825b7a84c0ff0d35f97","observation_id":"c8416115-6cb9-40aa-add1-02282926e4aa","resolution":{"observed_at":"2026-08-07T23:44:40.671641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.065960Z","title":"Videomemory: Toward consistent video generation via memory integration.arXiv preprint arXiv:2601.03655,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.065960Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:4f082b1abaf5463ff1b88fa138393ad6ae06be54c83a1615f6d3e474a7d50f6c","observation_id":"69a10cf1-ffec-4912-958d-235892799a66","resolution":{"observed_at":"2026-08-07T23:44:40.065960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01434","last_updated":"2024-05-02T16:25:16Z","snapshot_observed_at":"2026-07-06T18:08:52.053005Z","submitted_at":"2024-05-02T16:25:16Z","title":"StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01434","snapshot_observed_at":"2026-08-07T23:44:40.070996Z","title":"Storydiffusion: Consistent self- attention for long-range image and video generation.Advances in Neural Information Processing Systems, arXiv preprint arXiv:2405.01434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.070996Z"},"links":{"cited_paper":"/paper/2405.01434","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:ff3cfe0cd5a95586cdce6b5b61b0321667244ee234ff03e3eabcf039de8f00ca","observation_id":"16d0520c-671e-4ea4-ac6d-bba9fcb9e1c5","resolution":{"observed_at":"2026-08-07T23:44:40.070996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:40.076274Z","title":"Hiar: Efficient autoregressive long video generation via hierarchical denoising.arXiv preprint arXiv:2603.08703,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.076274Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:33f248d127f7fee8b70416aa0c3bdf7ab0d29c916c140f180665da055992b0aa","observation_id":"8e765535-a09f-4e2b-a1aa-9d65310300ea","resolution":{"observed_at":"2026-08-07T23:44:40.076274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:42.760350Z","title":null,"venue":null,"work_id":"8491b242-3c75-4049-a8f0-748e474c0d5c","year":2026},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.081765Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:807932742b4059e549f426f770f4dc1d336b150c4dc16b70ec40bd9213ff58c8","observation_id":"695cc153-0c11-430e-a961-97e899bc69d1","resolution":{"observed_at":"2026-08-07T23:44:42.777265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-07T23:44:40.024029Z","title":"Seedance 2.0: Advancing video generation for world complexity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:40.024029Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:272f37e59be0592f88127552c6a5dd74ad1eb643bbefae0e2acb432f3dc0279a","observation_id":"32200680-72cf-4e7e-8026-cf40d5380ad9","resolution":{"observed_at":"2026-08-07T23:44:40.024029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09639","last_updated":"2026-06-11T05:58:22Z","snapshot_observed_at":"2026-08-02T02:07:05.154330Z","submitted_at":"2026-06-08T15:35:51Z","title":"CineDance: Towards Next-Generation Multi-Shot Long-Form Cinematic Audio-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.09639","snapshot_observed_at":"2026-08-07T23:44:39.862992Z","title":"Cinedance: Towards next-generation multi-shot long-form cinematic audio-video generation.arXiv preprint arXiv:2606.09639,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.862992Z"},"links":{"cited_paper":"/paper/2606.09639","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:ca51ace6b47616fa2317f5906a6be8511e01a5b51d31310c20095c1aeaa6e0c2","observation_id":"7d7a1154-62e0-4fd3-a096-1a21b0697a0f","resolution":{"observed_at":"2026-08-07T23:44:39.862992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:44:39.889969Z","title":"Videoar: Autoregressive video generation via next-frame and scale prediction.arXiv preprint arXiv:2601.05966,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.889969Z"},"links":{"citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:dd6c2d5adf889bcbafd571aaf2c5accfb374a922d0e4bbab626721255da32c5c","observation_id":"545c6e0d-cea8-457c-a382-6807dae50e28","resolution":{"observed_at":"2026-08-07T23:44:39.889969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01392","last_updated":"2024-12-10T01:32:23Z","snapshot_observed_at":"2026-08-06T12:36:01.385451Z","submitted_at":"2024-07-01T15:43:25Z","title":"Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01392","snapshot_observed_at":"2026-08-07T23:44:39.856585Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.arXiv preprint arXiv:2407.01392,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T23:44:39.856585Z"},"links":{"cited_paper":"/paper/2407.01392","citing_paper":"/paper/2608.05776"},"observation_digest":"sha256:d1d42b86ca52f75ed680707c01e41d7a0664fe5d2490d14c3c3dbf411f7323a5","observation_id":"aa87b2a8-e3f7-4f79-9d51-0c3b56b03035","resolution":{"observed_at":"2026-08-07T23:44:39.856585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05776","last_updated":"2026-08-06T09:09:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:12:07.275928Z","submitted_at":"2026-08-06T09:09:49Z","title":"Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.05776."}