{"as_of":"2026-08-06T15:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:822eb10cda1cdf7e3d47c2f9124515023bfeb8e87525db99bcda7ac902cb447e","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:59:15.978300Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:22:55.016830Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T07:34:21.487595Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"cited_work":{"arxiv_id":"2606.10135","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10135","snapshot_observed_at":"2026-06-30T07:34:21.487595Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","venue":"cs.CV","work_id":"3ef9db57-8f87-4fde-9cf7-4e06ab904ac5","year":2026},"citing_paper":{"arxiv_id":"2606.30292","last_updated":"2026-06-29T13:35:44Z","snapshot_observed_at":"2026-07-07T00:04:10.492340Z","submitted_at":"2026-06-29T13:35:44Z","title":"DreamForge-World 0.1 Preview: A Low-Compute Real-Time Controllable World Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T07:32:03.567262Z"},"links":{"cited_paper":"/paper/2606.10135","citing_paper":"/paper/2606.30292"},"observation_digest":"sha256:c8b4494774018322ade3cb64bc3899a3fe6b4b496835f9e82fd480d40d6ad6b4","observation_id":"8db2465e-9fd2-4a85-a945-56f82af02f91","resolution":{"observed_at":"2026-06-30T07:34:21.489288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10135","snapshot_observed_at":"2026-07-30T20:22:55.016830Z","title":"Shaohao Rui, Xiaofeng Mao, Zhanyu Zhang, Peijia Lin, Yansong Zhu, Yibo Zhang, Haibin Wan, and Weijie Ma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26811","last_updated":"2026-07-29T11:58:47Z","snapshot_observed_at":"2026-08-01T23:36:36.928735Z","submitted_at":"2026-07-29T11:58:47Z","title":"DistillAlign: Coordinating Mode Covering and Mode Seeking in Autoregressive Video Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T20:22:55.016830Z"},"links":{"cited_paper":"/paper/2606.10135","citing_paper":"/paper/2607.26811"},"observation_digest":"sha256:5182ae77b46fabf2fbc4f276a797b50e995ce99f87367be883848307faa334ce","observation_id":"7f266ed9-2f5d-400c-af3f-6105a7276130","resolution":{"observed_at":"2026-07-30T20:22:55.016830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.10135/citation-record","integrity":"/paper/2606.10135/integrity","json":"/paper/2606.10135/citation-record.json","paper":"/paper/2606.10135"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-02T11:59:13.080088Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.080088Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:bedccd3277bf9a96d3c9bca0c79ae622919531b9a28587f99b44c5e365b66c35","observation_id":"5a020d75-0e5f-4bfe-baa2-3ef4fce98007","resolution":{"observed_at":"2026-08-02T11:59:13.080088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-02T11:59:13.187944Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.187944Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:0380e6d5f739c36df1f28bef7832d58ab865c63a1c1db6d9df719e08d1c61376","observation_id":"44870811-b1a4-44b0-a72d-a45a61517f60","resolution":{"observed_at":"2026-08-02T11:59:13.187944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-08-02T11:59:13.297613Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model.arXiv preprint arXiv:2508.13009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.297613Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:8798572fe03746aec31a183ee6d49e8fa0bd567930bd484912606ab4bc960e81","observation_id":"cf12c37f-b86d-405a-97dd-e10127e5a8f2","resolution":{"observed_at":"2026-08-02T11:59:13.297613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:13.472562Z","title":"Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.472562Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:48c5740951cd0ec4d1b6843c170ff010ae05c2a0d8fdaab562919e644fb9def9","observation_id":"51468657-3f68-4402-bac5-264c9b6d1eef","resolution":{"observed_at":"2026-08-02T11:59:13.472562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-08-02T11:59:13.661355Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.661355Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:53fcadc4bd0409ccbb56b64419e189a8ef7840ff06958dc69d12edfe081d32f0","observation_id":"00cd2fe4-f483-448b-980b-3c74cc225bf5","resolution":{"observed_at":"2026-08-02T11:59:13.661355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-02T11:59:13.831652Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.831652Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:8dc956a3c39f78a4a96ecb09006022f1b6424e8eb26a331fb16f43177a321f74","observation_id":"eb972098-ab52-44f7-b892-fd21ca0c0641","resolution":{"observed_at":"2026-08-02T11:59:13.831652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:14.127092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.127092Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:92b3743dda391deefef42cd6ee23daade95d5de2f8914e5cfb443b85362b3742","observation_id":"910685b7-2f40-488e-b980-35f76ef13368","resolution":{"observed_at":"2026-08-02T11:59:14.127092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:14.245035Z","title":"Worldcam: Interactive autoregressive 3d gaming worlds with camera pose as a unifying geometric representation.arXiv preprint arXiv:2603.16871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.245035Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:de25e01b12c318691a9d4d7fb6ab426f02342b2bcc783d01075ccbd2e4b28644","observation_id":"fb6cbf9e-791d-4874-a06f-58709c727600","resolution":{"observed_at":"2026-08-02T11:59:14.245035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:14.536835Z","title":"Motion- stream: Real-time video generation with interactive motion controls.arXiv preprint arXiv:2511.01266,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.536835Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:db3a54203e5e3cf35cb5f0fa49516f46a756a08300f65a260d42aab063d83ab6","observation_id":"b90d13f8-11ec-4212-9d6a-1056e169cc19","resolution":{"observed_at":"2026-08-02T11:59:14.536835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-08-02T11:59:14.718773Z","title":"Worldplay: Towards long-term geometric consistency for real-time interactive world modeling.arXiv preprint arXiv:2512.14614,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.718773Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:ed6677db549b03a2651780b2ba58acfdb72761998d4b7f0acc919981f3fa5283","observation_id":"999b1eab-c503-4d8f-91b6-09006eac5223","resolution":{"observed_at":"2026-08-02T11:59:14.718773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:14.859048Z","title":"Hunyuan-gamecraft-2: Instruction-following interactive game world model.arXiv preprint arXiv:2511.23429,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.859048Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:04b6cf3fd49bfa2c5852781738288ca48051b143fe460d93e7d16d17530fcfd2","observation_id":"166a1683-4c29-45d0-a08c-f725ba0a8f16","resolution":{"observed_at":"2026-08-02T11:59:14.859048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-08-02T11:59:15.004301Z","title":"Advancing open-source world models.arXiv preprint arXiv:2601.20540,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.004301Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:a4a854dc73cf7336f194fde078c2f3736f044606b12a275a018f6eccd1fb7927","observation_id":"d0f8f430-a199-4b77-a9f0-380bff7772d6","resolution":{"observed_at":"2026-08-02T11:59:15.004301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-02T11:59:15.169378Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.169378Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:4b55808099069a1bcff5e935bd7b275107bab5f25606eeea678a4ee57b38208b","observation_id":"95e21af3-30e6-4ae2-9f23-fb985e77479f","resolution":{"observed_at":"2026-08-02T11:59:15.169378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-02T12:12:15.465550Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-02T11:59:15.355575Z","title":"Moge-2: Accurate monocular geometry with metric scale and sharp details.Advances in Neural Information Processing Systems, 38:35928–35959, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.355575Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:838756350e3360db7a1618d64905e0a4eb992b3d1f56e34fc679a94d5e251344","observation_id":"38d54208-b661-4e8c-833f-f7a28c9e35e2","resolution":{"observed_at":"2026-08-02T11:59:15.355575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-08-02T11:59:15.498644Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long-horizon memory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.498644Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:2a4d42062e20c94279a44839a0c39ea05c265dcda04d73ea76bca205cd09b7f8","observation_id":"3d158352-2aa8-4799-88dd-f01014686443","resolution":{"observed_at":"2026-08-02T11:59:15.498644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:15.671084Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.671084Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:6c1a62781de29e5f06a5041eb1e5a473220b5608cf3ab2e9764744fbfebfd206","observation_id":"e0d5e855-90b4-4287-b20c-ac0b3a3ed773","resolution":{"observed_at":"2026-08-02T11:59:15.671084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08601","last_updated":"2025-08-14T10:26:51Z","snapshot_observed_at":"2026-08-05T21:28:04.933745Z","submitted_at":"2025-08-12T03:34:21Z","title":"Yan: Foundational Interactive Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.08601","snapshot_observed_at":"2026-08-02T11:59:15.826169Z","title":"Yan: Foundational interactive video generation.arXiv preprint arXiv:2508.08601,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.826169Z"},"links":{"cited_paper":"/paper/2508.08601","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:4b3941ce45f0728743f88f896f49cc96ddb81fa49c77f4293adc971b2406f094","observation_id":"efb85e1e-7e10-4d00-9406-893d521424ea","resolution":{"observed_at":"2026-08-02T11:59:15.826169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-07-06T23:39:34.232661Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30263","snapshot_observed_at":"2026-08-02T11:59:15.978300Z","title":"minwm: A full-stack open-source framework for real-time interactive video world models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.978300Z"},"links":{"cited_paper":"/paper/2605.30263","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:5302110205003dcf5f6253476aa9ea8f37531f696e39e4f91a572a4cd5941855","observation_id":"d36e5299-2ac3-4209-a828-5c491ca8b853","resolution":{"observed_at":"2026-08-02T11:59:15.978300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17744","last_updated":"2025-07-23T17:57:09Z","snapshot_observed_at":"2026-08-06T14:36:41.778601Z","submitted_at":"2025-07-23T17:57:09Z","title":"Yume: An Interactive World Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17744","snapshot_observed_at":"2026-08-02T11:59:13.960726Z","title":"Yume: An interactive world generation model.arXiv preprint arXiv:2507.17744,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:13.960726Z"},"links":{"cited_paper":"/paper/2507.17744","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:25ac8acfc28bc9e5d82e1ded2817a5446d142c1fd8c8ecb65098a61275c1fffb","observation_id":"34bc9b8f-bb56-43a3-b8da-de20b3f7a86c","resolution":{"observed_at":"2026-08-02T11:59:13.960726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:12.958249Z","title":"Vidarc: Embodied video diffusion model for closed-loop control.arXiv preprint arXiv:2512.17661,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:12.958249Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:b08bff767e7194d2092b60d9b2b94aa249b62eea802b9fa5ae7491ccb8b442b4","observation_id":"2438cf5a-ef83-4354-b95f-cb32c435d9aa","resolution":{"observed_at":"2026-08-02T11:59:12.958249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-07-06T18:10:57.647004Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-02T11:59:12.867166Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:12.867166Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:be7cc29764ed706b8a0bd976bcdf7d695d15977758adeac696186d78545fa2a8","observation_id":"b72fe840-58c4-4a2e-a7ce-0ada4fa6ed0b","resolution":{"observed_at":"2026-08-02T11:59:12.867166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:59:14.371711Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:14.371711Z"},"links":{"citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:b1e6895581c47323f5de1739d149bf13a2998063803fc7c258d1faa5b8aa8812","observation_id":"c9363803-0050-4a33-8e5c-7999f7401084","resolution":{"observed_at":"2026-08-02T11:59:14.371711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 2 inbound Pith citation observations for arXiv:2606.10135."}