{"as_of":"2026-08-08T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d4e760d04ac9312bb0bc30f5215fc115a42259a040851498c806211821fb450","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T15:27:55.009337Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:04:14.300857Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T13:04:15.169082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"cited_work":{"arxiv_id":"2606.02436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.02436","snapshot_observed_at":"2026-08-06T13:04:15.169082Z","title":"Geometry-Aware Implicit Memory for Video World Models","venue":"cs.CV","work_id":"39ad9cd0-72fb-4d32-b3df-88dfe235057d","year":2026},"citing_paper":{"arxiv_id":"2608.04956","last_updated":"2026-08-05T15:27:26Z","snapshot_observed_at":"2026-08-08T00:12:36.701809Z","submitted_at":"2026-08-05T15:27:26Z","title":"ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T13:04:14.300857Z"},"links":{"cited_paper":"/paper/2606.02436","citing_paper":"/paper/2608.04956"},"observation_digest":"sha256:4e1364483b809a2f1052cea75b6953e465dda3e889685cbb69942a38b6dd3b65","observation_id":"8077d423-9d92-4989-bf25-81549d1094e4","resolution":{"observed_at":"2026-08-06T13:04:15.173755Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.02436/citation-record","integrity":"/paper/2606.02436/integrity","json":"/paper/2606.02436/citation-record.json","paper":"/paper/2606.02436"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Diffusion for world modeling: Visual details matter in atari","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:43553bce51b5bea4f0333eb1137a2dbb655feea905adf38fc2a37da905e8e81c","observation_id":"e319ade0-a835-45d0-9513-603bb6c8923a","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26599","last_updated":"2026-07-11T20:08:28Z","snapshot_observed_at":"2026-08-07T11:15:53.346799Z","submitted_at":"2026-03-27T16:57:51Z","title":"VGGRPO: Towards World-Consistent Video Generation with 4D Latent Reward","version":2},"cited_work":{"arxiv_id":"2603.26599","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.26599","snapshot_observed_at":"2026-07-14T02:20:26.920520Z","title":"Vggrpo: Towards world-consistent video generation with 4d latent reward","venue":null,"work_id":"ee10761b-dd39-441e-9b68-159d0bbbf0c0","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2603.26599","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:f5289b5cddd6d44e8b20f779d4cfaaaf93570cf04c0c824cfbf0623c147f94c8","observation_id":"636e8b56-6151-4d98-bb3e-b669d08e7866","resolution":{"observed_at":"2026-07-14T02:20:26.920520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Ge- nie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:c8bec7db811f987ae576c13341f292be3f5270cdec2e04e2c64efe002e15aa69","observation_id":"ac5eb165-6506-4645-9f76-4b5934a92714","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.21058","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:59:42.121465Z","title":"Mixture of contexts for long video generation.arXiv preprint arXiv:2508.21058","venue":null,"work_id":"b800ec2a-ab41-48e3-a98d-a26b4942bb2a","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:026aa69e79cc3cc4ebbdff1dd79456d3088dbfbaba1b1b3b921b24d484670707","observation_id":"5aece672-5218-4b9f-9041-d58ee7cd37ab","resolution":{"observed_at":"2026-07-01T22:26:16.891167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Uni3c: Unifying precisely 3d-enhanced camera and human motion controls for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:cc69183637b59b2af2a67f7d30b42b5449f84b0ba2be787a959cf565a7c1208b","observation_id":"e385f59e-6465-4d22-a1b7-3b79e5cdcd98","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00769","last_updated":"2024-12-06T13:09:43Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:17Z","title":"GameGen-X: Interactive Open-world Game Video Generation","version":3},"cited_work":{"arxiv_id":"2411.00769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.00769","snapshot_observed_at":"2026-07-03T01:07:30.588949Z","title":"Gamegen-x: Interactive open-world game video generation","venue":null,"work_id":"5f3b923c-3fdc-468a-8951-94c4ff7b1e29","year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2411.00769","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:70814718387ef66b2039acbefe13271706102b52a321f8d8693f9255c59dc19b","observation_id":"d6567f1c-8c1e-4387-9970-313a3652e62a","resolution":{"observed_at":"2026-07-01T22:26:16.898746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffu- sion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:14a421ccb44c719b10c107b2189c7da27180a7097feac82973f83f9e0f646f2a","observation_id":"672f7a63-852f-421e-b326-e16d532a9fe8","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.25716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:29:45.454564Z","title":"Out of sight but not out of mind: Hybrid memory for dynamic video world models","venue":null,"work_id":"df86b9de-3e6e-4e85-b4c4-74cc3fa4381f","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:9ea7be913cc19d1c23a95a5471bab28159e7df72ed7cbe390e2bc1d0e96a8847","observation_id":"4b3208af-c56d-4f13-b89e-3f011fc67dca","resolution":{"observed_at":"2026-07-01T22:26:16.986632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.00051","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T12:08:06.368191Z","title":"Infinite-canvas: Higher-resolution video outpainting with extensive content generation","venue":null,"work_id":"7f26d806-78f1-45cd-b320-4e3c0018466a","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:dc6c5f25938939eb83f6c4bad1037f6211c13adaa075f73febb1dff016e72c97","observation_id":"07899d24-0dfc-4a54-b5fa-71f0fdd4e505","resolution":{"observed_at":"2026-07-01T22:26:16.856013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Oasis: A universe in a trans- former.URL: https://oasis-model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b32963a92a233184c3037d7def754e413ae8d99ac436335769efd696a56c78ab","observation_id":"11663831-c3d7-4827-b07e-ba9fff448c4d","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.23286","last_updated":"2026-06-07T21:12:04Z","snapshot_observed_at":"2026-08-03T06:13:17.430436Z","submitted_at":"2026-01-30T18:59:57Z","title":"VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation","version":4},"cited_work":{"arxiv_id":"2601.23286","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.23286","snapshot_observed_at":"2026-07-04T16:49:58.209323Z","title":"VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation","venue":"cs.CV","work_id":"83aee0d9-bbcd-49e2-a8a8-b2aca6ffbeb0","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2601.23286","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:28acf11544946716592b3ba9e304f5a8e9022683ce0142728ef659c10776f0f2","observation_id":"4741e62a-ddab-4a6e-9b7d-1e05478b140b","resolution":{"observed_at":"2026-07-01T22:26:16.838861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:49:30.995441Z","title":"LiveWorld: Simulating out-of-sight dynamics in generative video world models","venue":null,"work_id":"ca4d01be-0052-4868-83e4-661d6913044a","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:d6c98075475f4382a6633ebafc74b8d366e6aa30244d547ce9f40f1d33a7676d","observation_id":"86c34616-b777-41b6-a399-a5fa54c36bba","resolution":{"observed_at":"2026-07-01T22:26:16.922681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03568","last_updated":"2024-12-04T18:59:05Z","snapshot_observed_at":"2026-08-07T13:35:51.338673Z","submitted_at":"2024-12-04T18:59:05Z","title":"The Matrix: Infinite-Horizon World Generation with Real-Time Moving Control","version":1},"cited_work":{"arxiv_id":"2412.03568","doi":"10.48550/arxiv.2412.03568","metadata_source":"pith","pith_arxiv_id":"2412.03568","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The matrix: Infinite-horizon world generation with real-time moving control","venue":"cs.AI","work_id":"11e7c591-d2c5-4d62-9b5e-f9078c35db2e","year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2412.03568","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:8906ba40f673581f11c52d3b03b734637d3a509ef429d64100185a8517695e41","observation_id":"9f5620f7-84c6-4682-a83d-58193f9dd475","resolution":{"observed_at":"2026-07-01T22:26:16.983084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.26193","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:36:17.734386Z","title":"Memcam: Memory-augmented camera control for consistent video generation.arXiv preprint arXiv:2603.26193, 2026","venue":null,"work_id":"3005bb7e-1d27-4b01-a57d-6077e4068e8c","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b4499445adfa233f1c3d31336bf18eb169c4c9321b6d696185e72ec713d9c9df","observation_id":"cf9dcd75-082e-4113-91a2-b6d33eafb22a","resolution":{"observed_at":"2026-07-01T22:26:16.941690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08388","last_updated":"2025-04-11T09:41:04Z","snapshot_observed_at":"2026-08-07T16:06:34.954758Z","submitted_at":"2025-04-11T09:41:04Z","title":"MineWorld: a Real-Time and Open-Source Interactive World Model on Minecraft","version":1},"cited_work":{"arxiv_id":"2504.08388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.08388","snapshot_observed_at":"2026-07-08T10:54:49.297399Z","title":"Mineworld: a real-time and open-source interactive world model on minecraft","venue":"cs.CV","work_id":"51784a48-c98d-430f-92ec-ffa426c300b3","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2504.08388","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:24e042b5ced3ccd8aaf27cc13e94f754cce0b20141eae7c962cb281911cc5a76","observation_id":"8870cd93-ae8c-453e-9b55-47fbdd9a1e67","resolution":{"observed_at":"2026-07-01T22:26:16.934202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"cited_work":{"arxiv_id":"2510.10125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.10125","snapshot_observed_at":"2026-07-09T03:05:55.293884Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","venue":"cs.RO","work_id":"60c6a353-4bc6-4c87-8c39-372fcddd6ac0","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2510.10125","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:a18e029e56cd0a492bb79e5cc0d66250b9f3446812a65ccffbaa8cd0177aabe8","observation_id":"7e548e32-ddca-4ee2-8b7e-8414e31ff93d","resolution":{"observed_at":"2026-07-01T22:26:16.885207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.18215","last_updated":"2026-04-21T16:05:42Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T13:00:17Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","version":2},"cited_work":{"arxiv_id":"2604.18215","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.18215","snapshot_observed_at":"2026-07-01T22:26:16.892436Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","venue":"cs.CV","work_id":"91ebbcfd-7f88-47df-bca3-d3156073ad23","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2604.18215","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:4f11cd7a16037a7735211a9798383b56c02a1399c3c7e9540b81fcf536f65498","observation_id":"9b8c5051-d660-49d8-a4b1-7a45ff569205","resolution":{"observed_at":"2026-07-01T22:26:16.894478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":"1803.10122","doi":"10.48550/arxiv.1712.00409","metadata_source":"pith","pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"World Models","venue":"cs.LG","work_id":"07227eee-8445-4c98-bce4-c6a6fd5ed907","year":2018},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:ce153e081780c1ceb36fbdd701bbb7fdb31bff3d997dbb3c02f42791e600054a","observation_id":"4d225b33-0cad-4c65-8404-e9c280895e46","resolution":{"observed_at":"2026-07-01T22:26:16.964163Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:e01c6062dd051f0ba09af702b0f6e3f91f7658fb9bb22f6c533ed8005d10020b","observation_id":"554a1ab9-e431-4eae-8291-c23d42293c5c","resolution":{"observed_at":"2026-07-01T22:26:16.925340Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2404.02101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-10T01:46:41.167891Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","venue":"cs.CV","work_id":"1c05c278-c023-4ef0-a359-25a41f1065eb","year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:704baec10f45a325953e913670eb1d181ece12b2f6fb82c91fb2a59411558434","observation_id":"895cdc50-2d71-4ee6-8e2e-e04a65100244","resolution":{"observed_at":"2026-07-01T22:26:16.845803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":"2508.13009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-07-09T07:56:04.730683Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","venue":"cs.CV","work_id":"492a2d34-e672-45fb-8f54-c720d2dfae5a","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:9aaa24237178f8c9aefc2040fa018acf83b948df0bf4763ad37371a3a007156a","observation_id":"f7d944cc-ea4e-4f3b-9bce-9956292a0b35","resolution":{"observed_at":"2026-07-01T22:26:16.980457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:00:07.566418Z","title":"Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040","venue":null,"work_id":"d398db79-a718-4fff-a215-641fd1af997a","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:fcc7c0ac7847dc072b64b355ab79c2be94dd6045729eae6ad7543664cf8c7194","observation_id":"b584f26d-ecb2-4be7-aef8-41897b30d8ea","resolution":{"observed_at":"2026-07-01T22:26:16.928689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.21929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:57:29.649901Z","title":"Geometry-as-context: Modulating explicit 3d in scene-consistent video generation to geometry context","venue":null,"work_id":"f961d15d-2004-4526-bd25-a59e751c9e86","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:7481bfbbe878ef4bb1383e07a1365151d0801cc63aff321e5eeee2bca093a7c5","observation_id":"b317a9f6-8f62-4afd-8f11-d5ec29ef482d","resolution":{"observed_at":"2026-07-01T22:26:16.907142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.03198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T05:47:41.299641Z","title":"Mem- ory forcing: Spatio-temporal memory for consistent scene generation on minecraft","venue":null,"work_id":"9d614233-f030-4526-bac0-e91d5c9ab88c","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:f80b7811a77da02288bd907d53a49de92f918c6e79ff0ee34503c48a47b561fd","observation_id":"fbc0e75c-c4c4-4cb9-b42f-5b0adfe5929a","resolution":{"observed_at":"2026-07-01T22:26:16.919692Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:19031319b123237310935a7ba31767434d070556c9c165f792c9f06a2b9b0e0b","observation_id":"9019bc42-fd4a-447f-957b-cc5754fa7688","resolution":{"observed_at":"2026-07-01T22:26:16.859130Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:47:09.329189Z","title":"Cinescene: Implicit 3d as effective scene representation for cinematic video generation.arXiv preprint arXiv:2602.06959, 2026","venue":null,"work_id":"0b07defd-d8a4-4fa0-bf8b-087b62f5e414","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:a234553fe64d290ccdd92b4f4a62ab6ebce085da11b1f53921f2fc4084ba5cb8","observation_id":"fde20904-c32c-4200-8e48-e8c7dcfe7ec9","resolution":{"observed_at":"2026-07-01T22:26:16.969516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.14357","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:09:52.619867Z","title":"Huang, J","venue":null,"work_id":"d1d76f70-c4ba-468a-8c45-296e334e7c76","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:6a3079c315543aa71ddd3ba13a89558806416cc843e261c2f70517a9662f1886","observation_id":"0a3c7866-7330-444d-a21c-e615458d97ae","resolution":{"observed_at":"2026-07-01T22:26:16.978054Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:d38751af756b513cf3c184d0edc091cd20ffc0f91bd02550ec20afd30970c12e","observation_id":"d54b69dc-ba65-4940-85fa-8ac4c4051aba","resolution":{"observed_at":"2026-07-01T22:26:16.946537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Fifo-diffusion: Generating infinite videos from text without training.Advances in Neural Information Processing Sys- tems, 37:89834–89868, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:0b123fb9ef83de08e0e3c13730f19b700f433c8d45dece37971a432a92bc1e29","observation_id":"86d9feef-eb8c-4687-bf07-2328b6569d92","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Near- optimal sensor placements in gaussian processes: Theory, efficient algorithms and empirical studies.Journal of Ma- chine Learning Research, 9:235–284, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:7781abcd184b32babf0d32658ae2ebdd93e43e4da0a59ba725e008829edbb500","observation_id":"78939084-a78c-4917-b348-58af1aad9877","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21615","last_updated":"2026-06-17T16:22:08Z","snapshot_observed_at":"2026-08-06T09:36:16.630593Z","submitted_at":"2025-10-24T16:21:37Z","title":"Epipolar Geometry Improves Video Generation Models","version":2},"cited_work":{"arxiv_id":"2510.21615","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.21615","snapshot_observed_at":"2026-07-04T16:49:58.101863Z","title":"Epipolar geometry improves video generation models","venue":"cs.CV","work_id":"5e17c04b-2a8a-4f05-be03-4703565fe1cc","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2510.21615","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:5774eb32e6b913c9c55c82bb2b073f48628650efac83482ee10fbe5755013400","observation_id":"95aa5169-3b4b-4ddb-846f-e6024f9dbef2","resolution":{"observed_at":"2026-07-01T22:26:16.903876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Ground- ing image matching in 3d with mast3r","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:6c8ea9222c40ab440f1eee1bd8f0d3275ecf535b93a7f3163597a422319c1649","observation_id":"3c0fbb77-736c-41a2-a19f-b65db7cbfe1b","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Vmem: Consistent interactive video scene generation with surfel-indexed view memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:27d2a70010588eca37eff4ff0e344c96aead3a264b97f60626a5dee509a775b5","observation_id":"8cbef03b-face-4068-bc9e-e171d3be9cc3","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:63585066db33af5d56150be5b5bbdceb450254d63f8e35ca08d0e4ba78bd5de9","observation_id":"812ad985-cadb-4108-a294-ac93928732ca","resolution":{"observed_at":"2026-07-01T22:26:16.848940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17744","last_updated":"2025-07-23T17:57:09Z","snapshot_observed_at":"2026-08-06T14:36:41.778601Z","submitted_at":"2025-07-23T17:57:09Z","title":"Yume: An Interactive World Generation Model","version":1},"cited_work":{"arxiv_id":"2507.17744","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17744","snapshot_observed_at":"2026-07-08T10:54:49.210345Z","title":"Yume: An interactive world generation model","venue":"cs.CV","work_id":"15c931d5-49da-401c-8c91-5b0de83195de","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2507.17744","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:f376520fb88086e3d87955c109f9eafd1ccc271a75904d763a222980c41ac9d3","observation_id":"066650b1-1e67-4332-a9e9-34ff7f463339","resolution":{"observed_at":"2026-07-01T22:26:16.888310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-03T19:02:55.301416Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":"2512.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-07-23T02:24:07.287208Z","title":"World- pack: Compressed memory improves spatial consistency in video world modeling","venue":null,"work_id":"7189f30b-0520-472f-9975-bcf5a9cdd481","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b3dadb8886e9d5f29e47db8fd80dff8e4d31cfee49176f9562caf51fed4f3e2f","observation_id":"26ec7362-ebf3-4b74-bef0-f33fd14571c0","resolution":{"observed_at":"2026-07-23T02:24:07.287208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-03T19:40:46.693368Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":"2310.15169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-07-10T01:46:41.165409Z","title":"Freenoise: Tuning-free longer video diffusion via noise rescheduling.arXiv preprint arXiv:2310.15169","venue":"cs.CV","work_id":"772f3c4a-a84d-4ec2-9735-7d4cda51575c","year":2023},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:2dc81be27e4e03b007ea1552517eb5d96cf3a369938bd8c21d197c7c17117ce3","observation_id":"6a024fa0-f6d7-4b59-b4ac-f52e14156dc9","resolution":{"observed_at":"2026-07-01T22:26:16.882558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09042","last_updated":"2025-06-18T17:37:28Z","snapshot_observed_at":"2026-08-07T04:54:23.914784Z","submitted_at":"2025-06-10T17:58:17Z","title":"Cosmos-Drive-Dreams: Scalable Synthetic Driving Data Generation with World Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.09042","doi":"10.48550/arxiv.2506.09042","metadata_source":"pith","pith_arxiv_id":"2506.09042","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, and Björn Ommer","venue":"cs.CV","work_id":"af51168b-8b82-45d2-bf85-e3d07f99492b","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2506.09042","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:804b445b00c12d03ad1a57cad183f991ee0d9d04f84429f7d2591a846c32ac20","observation_id":"6212d6dc-e745-4588-8575-58081939d93e","resolution":{"observed_at":"2026-07-01T22:26:16.957829Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera con- trol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:497da3895660bf52ca04ef37d4e0c2f8aeeb19de15bd2b683ce8d27b5b09a178","observation_id":"9e40b1b8-129c-4090-8cba-a048e819591c","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-07-06T20:59:00.415760Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2503.20523","doi":"10.48550/arxiv.2511.09057","metadata_source":"pith","pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","venue":"cs.CV","work_id":"1339e674-d09b-48b4-8e6f-efe55dcab22e","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:5911a7321922f2a11ea10613702a491734caaa442f285d2bfe159e6f46df5075","observation_id":"a5d34844-6e48-47d0-b608-22c8086df10f","resolution":{"observed_at":"2026-07-01T22:26:16.835995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.22246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:16.935287Z","title":"Savov, N","venue":null,"work_id":"a296cd31-24f8-4a17-bca7-b0dc5eb36b26","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:dce06118a933328314c761e08f99d2c97f7b872df308d674d9d7e66280e6a6a2","observation_id":"c49e8c00-9e08-46f4-9c19-2b86be2a385c","resolution":{"observed_at":"2026-07-01T22:26:16.936842Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":"2512.14614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-07-09T07:56:04.709254Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","venue":"cs.CV","work_id":"48231e12-6c15-4f28-8c51-092766c59f93","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:37581388cb7f6cbb4d0912868d35c3191a3a74a25a9ca4acc4e7a2b4e57fe3b2","observation_id":"3301b506-506e-4b8b-9c2f-596f469c9a8f","resolution":{"observed_at":"2026-07-01T22:26:16.944038Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":"2604.07209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07209","snapshot_observed_at":"2026-07-04T03:49:30.956524Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","venue":"cs.CV","work_id":"daf54616-b87b-4167-ac38-a81906fd3611","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2604.07209","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:fa83754cab433d4c6ae1d22a3827044df0da96c545e7fe666417404e0f3c2056","observation_id":"d93e2c33-da18-4de8-9ece-4afd3f9cab62","resolution":{"observed_at":"2026-07-01T22:26:16.954635Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":"2601.20540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-07-10T08:36:59.816756Z","title":"Advancing Open-source World Models","venue":"cs.CV","work_id":"3446760e-6460-429e-82f6-6a5133ce4c8a","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:e8186304af132233c2407bb440b275d30c4ef9bf406ca410f3e00d1155d0436c","observation_id":"a438548c-9ab5-4c68-a165-4bb777cb4e41","resolution":{"observed_at":"2026-07-01T22:26:16.939186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-07-06T19:06:23.640089Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"cited_work":{"arxiv_id":"2408.14837","doi":"10.48550/arxiv.2408.14837","metadata_source":"pith","pith_arxiv_id":"2408.14837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffusion Models Are Real-Time Game Engines","venue":"cs.LG","work_id":"3f074579-63c2-40bf-b5c8-c6a8c39d9319","year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2408.14837","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:00f44a4750aee8192f89ffa3c9f559975fcb9fb04cd5c1bd8462dad353f819b5","observation_id":"5dfb9139-0d8e-440d-a401-b58e15738a06","resolution":{"observed_at":"2026-07-01T22:26:16.901471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:7b29aec123f7ee509e6c3a973b664086e5f9231fb16062ab5ce4642daa242619","observation_id":"0942d15e-fff9-4683-bd71-dd6130939618","resolution":{"observed_at":"2026-07-01T22:26:16.879059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"3d reconstruction with spatial memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:81483dd73f58d22f1cb36a3be29c8add3ec0520d5d5e313aa266fe1a5a2b8a90","observation_id":"a66ccfe7-3a99-4454-90cd-17f57307e82f","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Vggt: Vi- sual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:05bd059ad12b10e61dd2a654957e01e6134945aff15c24b58c594ddb237a58d4","observation_id":"c1a4140e-8f1a-40a9-90e0-59c99e26be39","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Continuous 3d per- ception model with persistent state","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:56a0dcc419574670dafa152b899ae38f6a31f50fd3d285916316b61eaeab3baa","observation_id":"8bd0f071-fe62-454f-ae97-146205c407bb","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:4e8c01b8930fdc3a4c25abe98a4c1bd8a170f0c1497d3d25d6e591ef609c47c5","observation_id":"d54bb171-3186-44b7-bce6-da2c7016d1e1","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Motionctrl: A unified and flexible motion controller for 11 video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:348767691589d970f4d07b9a5623b685dd7e4445b9da4321e1a663cece8052fa","observation_id":"c57ff5a4-42cf-41d5-a11d-6af192fea2cd","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-08-04T10:05:27.686733Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"cited_work":{"arxiv_id":"2507.07982","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07982","snapshot_observed_at":"2026-07-07T14:33:54.305490Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","venue":"cs.CV","work_id":"7c214f4a-d3ff-48e7-bd13-043eb9c139cb","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2507.07982","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:e1d825edb7f4e19ea3804eefa7a6db5c9c477440c1fb9c4e522fef2d8bef2d87","observation_id":"1e5667ff-2e31-4893-807e-46a4fd2ebd6c","resolution":{"observed_at":"2026-07-01T22:26:16.931440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"cited_work":{"arxiv_id":"2604.18564","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.18564","snapshot_observed_at":"2026-07-07T15:43:53.813844Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","venue":"cs.CV","work_id":"334cd115-9c3c-4a4d-80f4-35a6e6179c9a","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2604.18564","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:8c2411c0840a4a2a6bf8d3fe331ed25a7a2e15690c2cb3bc49e9e841a7034bed","observation_id":"be901613-2e70-40d7-abfe-5d91c5b72e3e","resolution":{"observed_at":"2026-07-01T22:26:16.861911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02393","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T10:54:49.220855Z","title":"Infinite-World: Scaling interactive world models to 1000-frame horizons via pose-free hierarchical memory","venue":null,"work_id":"c6bda419-e0dc-45aa-b96b-eef3a31d0930","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b3e6cc1f9647f107d02149971693d3b66fd6356851b3c0bc8c9014e5f468428c","observation_id":"315d0913-e0cd-4c22-ac4b-d14a80ba3ee4","resolution":{"observed_at":"2026-07-01T22:26:16.852337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-07T11:02:24.060549Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"cited_work":{"arxiv_id":"2506.05284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05284","snapshot_observed_at":"2026-07-03T17:58:47.769652Z","title":"Video world models with long-term spatial memory","venue":null,"work_id":"dbc95f37-bd69-4309-9971-934e68e24e7b","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2506.05284","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b4e5b644400d9b3922ce41f82c0605be96f6736289a8744ae28a32992f9cb6ee","observation_id":"52e1ebb3-cb56-4643-9b9b-a37d3b567250","resolution":{"observed_at":"2026-07-01T22:26:16.916728Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01784","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:57:29.750860Z","title":"Pack and force your memory: Long-form and consistent video generation.arXiv preprint arXiv:2510.01784","venue":null,"work_id":"a3ddc415-5820-4a39-a098-18c1496dd892","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:ad33f60d32c90fe2b0f85d85a992bf83b67d155a4c45b092efb06ed89dc0bef7","observation_id":"04551e92-0dfb-4a8b-937c-4be880c492e8","resolution":{"observed_at":"2026-07-01T22:26:16.876208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18226","last_updated":"2025-06-23T01:27:06Z","snapshot_observed_at":"2026-08-06T23:20:48.408782Z","submitted_at":"2025-06-23T01:27:06Z","title":"Make It Efficient: Dynamic Sparse Attention for Autoregressive Image Generation","version":1},"cited_work":{"arxiv_id":"2506.18226","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18226","snapshot_observed_at":"2026-07-01T22:26:16.863070Z","title":"Make it efficient: Dynamic sparse attention for autoregressive image generation.arXiv preprint arXiv:2506.18226, 2025","venue":null,"work_id":"69217d51-fc10-4c1d-a2fe-bacfca966451","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2506.18226","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:405686115b3e4ed4cc263197c681e59ee8cbdf9a5e7c799cdc9b17e22eba0c62","observation_id":"4fcd77ff-6021-49ed-856b-2672110cab3a","resolution":{"observed_at":"2026-07-01T22:26:16.864916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.03334","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:16.840664Z","title":"Macro-from-micro planning for high-quality and parallelized autoregressive long video generation","venue":null,"work_id":"d2798bac-2db1-47b9-86c3-a696bf65a653","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:aec77c2c4bab67f6b5568e5a168b7cbb05f8bce3f8a788dcf01290463c888734","observation_id":"cde19721-4e43-4d57-987b-f0c1eadb3202","resolution":{"observed_at":"2026-07-01T22:26:16.842600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:16.973643Z","title":"Pathwise test- time correction for autoregressive long video genera- tion","venue":null,"work_id":"605cc282-8423-449f-a911-62881ba25b66","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:71716c64dbed8d1fcc6d4c899925a009cc29c5bb7d355f4f3fce149d9ea97ab3","observation_id":"7db65a0b-3223-4df5-965d-b0a766692c47","resolution":{"observed_at":"2026-07-01T22:26:16.975199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:19:13.356094Z","title":"arXiv preprint arXiv:2504.12369 , year=","venue":null,"work_id":"7159175f-77a7-43d9-8dc3-54bda91b0e0b","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b4bfd2a10b1411d3104872c5be9f348c95f760fbbe64f4f4184a35f34c724ba8","observation_id":"9ba3dd57-f4cd-4770-b6da-575835cded58","resolution":{"observed_at":"2026-07-01T22:26:16.913500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:16.950338Z","title":"arXiv preprint arXiv:2601.14674 (2026) 6","venue":null,"work_id":"b4c843ed-3b5e-411b-af79-547f4e259131","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:ac80ba35c773f488c8ed1e61c42670c32e8d109ac4995987c30e0b27f31fe0ea","observation_id":"2269a0b1-654e-48e0-a0c4-eac7c30a103c","resolution":{"observed_at":"2026-07-01T22:26:16.951864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22960","last_updated":"2026-06-29T11:22:33Z","snapshot_observed_at":"2026-08-06T09:45:03.691678Z","submitted_at":"2026-02-26T12:54:46Z","title":"UCM: Unified Modeling of Camera Control and Memory with Time-aware Positional Encoding Warping for World Models","version":2},"cited_work":{"arxiv_id":"2602.22960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22960","snapshot_observed_at":"2026-07-03T00:57:29.737571Z","title":"Ucm: Unifying camera control and memory with time-aware positional encoding warping for world models","venue":"cs.CV","work_id":"b351fa8a-6b55-4dcc-8ab4-57419992d84a","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2602.22960","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:d587594aa9a011472b3f6bd92f1743f53a63ed9fe9303bb22ee41e97c8bc73bf","observation_id":"980b1245-5bce-4721-8eae-4ec3fab612a4","resolution":{"observed_at":"2026-07-01T22:26:16.909740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08025","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:19:51.152728Z","title":"arXiv preprint arXiv:2602.08025 (2026)","venue":null,"work_id":"5653cc49-7d6a-4fc3-ab30-600d28d540a3","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:15d8601941b49bcaa97d1791c66053078cb152446f1470eb7da53a543288a5b0","observation_id":"ee8e7165-396b-4a4f-b78b-5adcbac145ca","resolution":{"observed_at":"2026-07-01T22:26:16.966917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Context as memory: Scene-consistent interactive long video generation with memory retrieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:48196a2a6f74287f62e162e0af1016ae9146164d7b265fc4c4511ebcce6cbba5","observation_id":"ae5ffd5e-d89c-4c69-9f21-f2d96f7b6e97","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Gamefactory: Creating new games with gen- erative interactive videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:f377604d2244704955b24b9233bfb0a6f0da5b05e3f7a32ae732218a766090e3","observation_id":"ce5de3e8-ee03-498a-990c-a68699fdc300","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":"2410.06940","doi":"10.48550/arxiv.2410.06940","metadata_source":"pith","pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","venue":"cs.CV","work_id":"1aff8ef8-079b-4afe-9e6a-148e6fd08e6a","year":2024},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:1c9da2c9481322bf5d0ddb34f69bd64446b304e3be563a258a65492ae9afafa1","observation_id":"d15d9dca-6a9d-4dc2-b42d-870ccb09400b","resolution":{"observed_at":"2026-07-01T22:26:16.867553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.17117","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T05:47:41.321851Z","title":"Mosaicmem: Hybrid spatial memory for controllable video world models","venue":null,"work_id":"d0b14394-1476-42ab-a944-15bbcaf30d25","year":2026},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:2ec76fb36485ee4e355b0c4bda373c78007bc95f43604ec6c7ab1384efd36077","observation_id":"cae110a9-ffdf-4d93-b3bd-f1fc82f0142a","resolution":{"observed_at":"2026-07-01T22:26:16.870453Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04519","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T10:54:49.172551Z","title":"Context as memory: Scene-consistent interactive long video generation with memory retrieval","venue":null,"work_id":"7aca9998-ca88-48ca-bf11-5e95a18cc40d","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:63163c2bea63fb361bff917e09da77554f77846ef74d806f79990814a5caadc6","observation_id":"0b851cd7-b8ba-4f57-9f59-dfe89e0c1db6","resolution":{"observed_at":"2026-07-01T22:26:16.972526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"Packing input frame context in next-frame prediction models for video genera- tion.arXiv e-prints, pages arXiv–2504, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:b0d11b143a9c060e9643bfedb3ec7232d61c6f240454374e27ea14f70c0aa88e","observation_id":"006959e1-95f1-48d7-ae01-7d46581ae729","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:27:55.009337Z","title":"World-consistent video diffusion with explicit 3d modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:878089760edf27e9d487dd9d1fd88fe1d654004001351d94b9a89ca2e08a1fbf","observation_id":"94e7b19c-763f-4c65-8406-b12e70de8067","resolution":{"observed_at":"2026-06-28T15:27:55.009337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":"2504.02792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-07-10T18:47:31.709153Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","venue":"cs.RO","work_id":"c181dcf1-e774-4216-a30e-e55c3f3a766c","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:93d95cd88d3f301d5fdb41dfae043f7dda22dc532d5ee5b4f3849d4a8695f6ee","observation_id":"0d03b918-ea35-418d-ae1a-194066caab1a","resolution":{"observed_at":"2026-07-01T22:26:16.949223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":19,"verified_exact":47,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 1 inbound Pith citation observation for arXiv:2606.02436."}