{"as_of":"2026-08-20T23:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a3373a5b28b67f922f9094ea7b0431364e2af368f6c98205a2e12a20a9d92ab","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:35:47.635198Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08558/citation-record","integrity":"/paper/2608.08558/integrity","json":"/paper/2608.08558/citation-record.json","paper":"/paper/2608.08558"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.25859","last_updated":"2026-05-02T20:40:07Z","snapshot_observed_at":"2026-08-16T01:10:53.043424Z","submitted_at":"2026-04-28T16:58:52Z","title":"Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models","version":2},"cited_work":{"arxiv_id":"2604.25859","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.25859","snapshot_observed_at":"2026-08-14T04:35:48.654750Z","title":"Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models","venue":"cs.RO","work_id":"dfc2d238-8571-420d-8d87-8dcd1f306c7f","year":2026},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.944761Z"},"links":{"cited_paper":"/paper/2604.25859","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:393aba2ef8997d79d1ce9eb7727576cad9b5df23d3a8b1dfa946f97ca84c1137","observation_id":"d25b082d-807e-4971-b145-4d6bde3eaffb","resolution":{"observed_at":"2026-08-14T04:35:48.684757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-08-13T00:59:48.824306Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-08-14T04:35:46.987762Z","title":"Ha, H.; Florence, P.; and Song, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.987762Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:7cca17cc736e927472ab8ef0b39860bdcbe3bf839d4b9de534616e4912c9d6c9","observation_id":"0d65bcc2-e65a-40ec-8855-772f2b997fb3","resolution":{"observed_at":"2026-08-14T04:35:46.987762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:49.492626Z","title":"InProceedings of the 2023 Conference on Robot Learning","venue":null,"work_id":"089686f5-d0e6-451a-ae37-8ac5d0d83703","year":2023},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.035932Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:7e71d6c49302f9f74b815649f7127470bd7fd7f9c495b59844b0e2b67ed7d026","observation_id":"e5e9978d-a57e-4e5a-821f-12288fc83b7f","resolution":{"observed_at":"2026-08-14T04:35:49.513897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:49.357375Z","title":"InProceedings of the 42nd International Conference on Machine Learning, volume 267 ofProceed- ings of Machine Learning Research, 24328–24346","venue":null,"work_id":"defaa52f-256b-42c7-9ab2-f531a458f937","year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.127965Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:05dbd79ed9a1b7b897a0fd335b1b91ca2277e256f5cd3715b4e84a271459ae1f","observation_id":"df82bc25-b919-465b-b40c-c55849dbe0fe","resolution":{"observed_at":"2026-08-14T04:35:49.401591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06247","last_updated":"2026-05-07T13:26:51Z","snapshot_observed_at":"2026-08-12T15:38:40.474025Z","submitted_at":"2026-05-07T13:26:51Z","title":"CKT-WAM: Parameter-Efficient Context Knowledge Transfer Between World Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06247","snapshot_observed_at":"2026-08-14T04:35:47.192925Z","title":"arXiv:2605.06247","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.192925Z"},"links":{"cited_paper":"/paper/2605.06247","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:4c2fe194edb71e3eda1095136ccb5ecc875a94aa4b283a15d294eada9ae19aac","observation_id":"eda0f05b-7908-4d4f-95ee-cd59726a1bd9","resolution":{"observed_at":"2026-08-14T04:35:47.192925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:47.231781Z","title":"InProceed- ings of the 8th Conference on Robot Learning, volume 270 ofProceedings of Machine Learning Research, 2679–2713","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.231781Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:376a5aa44626fb87b052c435436a37eadfabdac7c94fde1bb9c3adea6dd27319","observation_id":"14c61720-e429-41ab-b43c-48284de52987","resolution":{"observed_at":"2026-08-14T04:35:47.231781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10040","last_updated":"2026-06-10T06:52:36Z","snapshot_observed_at":"2026-08-14T01:21:18.547209Z","submitted_at":"2026-06-08T18:14:08Z","title":"Efficient-WAM: A 1B-Parameter World-Action Model with Low-Cost Future Imagination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10040","snapshot_observed_at":"2026-08-14T04:35:47.274753Z","title":"arXiv:2606.10040","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.274753Z"},"links":{"cited_paper":"/paper/2606.10040","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:0dbf6527f500cd7fd0c4bbda3719a666b31e9cc078c39ac90c9f0a09ef691a94","observation_id":"4e0e25da-c894-43b5-a5da-901dcdbebec0","resolution":{"observed_at":"2026-08-14T04:35:47.274753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-14T04:35:47.324853Z","title":"arXiv:2306.02707","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.324853Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:fe362ed3dff7c6ce685b3c15ecfd391bbe3a712078ef8ae0226f1e3375fb50b9","observation_id":"0d77d707-218d-46b0-b97f-68db6d4d8e8e","resolution":{"observed_at":"2026-08-14T04:35:47.324853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-14T04:35:47.384766Z","title":"In8th Annual Conference on Robot Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.384766Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:85ff1f2e533cf83299713b4dfe0c6789d7b2c227210b8cd55a6da5a599dc2d08","observation_id":"44cbcfe5-b7b5-4fc1-89ab-fc2dd862eca1","resolution":{"observed_at":"2026-08-14T04:35:47.384766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:47.424750Z","title":"arXiv:2603.16195","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.424750Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:322599fcb741855e9cdc864cb535b4d7a1d23e533584b1308521911d2b40cd8f","observation_id":"ae3b2025-f94e-44c0-af9a-857545898b41","resolution":{"observed_at":"2026-08-14T04:35:47.424750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-14T04:35:47.464753Z","title":"arXiv:2602.15922","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.464753Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:db9ad686bf5c5be835ab14d277415c5323a85fd94fdc9d7e3cfbcf0c48bc5ed5","observation_id":"def13912-140e-4fff-a2da-b52ef96155a3","resolution":{"observed_at":"2026-08-14T04:35:47.464753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:49.254950Z","title":"InThe Thirteenth International Conference on Learning Representations","venue":null,"work_id":"0b6d7ffb-2d53-4013-8cd7-d3ec8c0fe57c","year":2023},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.502085Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:fd411c58a81c6b808281434c412d831696015451d3c5e01337e249a006ea3677","observation_id":"6001bddb-6b1a-4f95-95d3-934d9a1a1d78","resolution":{"observed_at":"2026-08-14T04:35:49.280828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-08-20T03:53:25.888886Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-14T04:35:47.541078Z","title":"Zhou,P.;Chen,S.;Chen,D.;Wang,J.;Jin,R.;Zhu,B.;Pan, Y.; Gu, S.; Wang, K.; Nan, S.; Qiu, X.; Qiu, C.; Yang, P.; Cai, Y.; Gao, J.; Li, Y.; Fu, Y.; Yue, X.; Chen, Z.; and Luo, J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.541078Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:588e73f217a061edece18e10fafd39919fa7b23d84c359d5dff16e3d18345eae","observation_id":"7872af17-3d4c-4339-90df-678c524fccb6","resolution":{"observed_at":"2026-08-14T04:35:47.541078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-08-10T02:54:28.264405Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-08-14T04:35:47.584826Z","title":"arXiv:2504.02792","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.584826Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:45e208df3259d598c795b1c6f1aeb22eaa97de0631c8cdd65ac9343bec3187d1","observation_id":"11c4e4c6-a926-4775-bf56-133ebe0092a6","resolution":{"observed_at":"2026-08-14T04:35:47.584826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:49.162056Z","title":"InConference on Robot Learning, 2165–2183","venue":null,"work_id":"22f4d736-7d47-482d-a153-5bfc168c00af","year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.609891Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:0054a09934de55ffb53ab948e19fe12314124d997f54253d78c32bfe5893bebb","observation_id":"488ca4a5-ad2b-4c8c-a48c-7c33cbeda78d","resolution":{"observed_at":"2026-08-14T04:35:49.194730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-14T04:35:47.074751Z","title":"arXiv:1503.02531","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.074751Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:08c5df0914815c662ceeed45f7dbac640bccd8a949de3e8e3767a68b259a1403","observation_id":"b71b92ca-0430-4660-9aea-300ec1d1886e","resolution":{"observed_at":"2026-08-14T04:35:47.074751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5360.5214","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:47.762821Z","title":"Teacher exposure","venue":null,"work_id":"2e25daea-9e4a-42db-b015-13c1e5945322","year":2000},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:47.635198Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:50e6badcd18d2b5cd282e6e87324adbcd9541033200eaf4e662b582ab355be10","observation_id":"a6896f9d-707b-44ee-ac73-33fe30ea8b02","resolution":{"observed_at":"2026-08-14T04:35:47.834747Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06671","last_updated":"2023-02-22T19:18:28Z","snapshot_observed_at":"2026-08-19T14:54:27.107829Z","submitted_at":"2023-02-13T20:18:25Z","title":"GenAug: Retargeting behaviors to unseen situations via Generative Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06671","snapshot_observed_at":"2026-08-14T04:35:46.854860Z","title":"arXiv:2302.06671","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.854860Z"},"links":{"cited_paper":"/paper/2302.06671","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:4fa78b5aa30fb4f1101a9d5c17addc57ac276b862c5ba70234ca09db8de53ac7","observation_id":"98d16b3a-36dc-4d46-b6b0-08748dba139a","resolution":{"observed_at":"2026-08-14T04:35:46.854860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15840","last_updated":"2026-05-08T06:37:02Z","snapshot_observed_at":"2026-08-11T06:04:17.319434Z","submitted_at":"2025-12-17T18:35:54Z","title":"Large Video Planner Enables Generalizable Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15840","snapshot_observed_at":"2026-08-14T04:35:46.804867Z","title":"Chen, B.; Zhang, T.; Geng, H.; Zhang, C.; Li, P.; Song, K.; Freeman, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.804867Z"},"links":{"cited_paper":"/paper/2512.15840","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:dcf1d962c49819ff1130988ceb64a76ebd277b4112a23a2e01cb1317a14a54a5","observation_id":"910d3a9d-cdf8-4dc2-90a8-859071bf9086","resolution":{"observed_at":"2026-08-14T04:35:46.804867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-08-16T22:05:17.066613Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13030","snapshot_observed_at":"2026-08-14T04:35:46.764750Z","title":"arXiv:2512.13030","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.764750Z"},"links":{"cited_paper":"/paper/2512.13030","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:5007c93ba306bcbdc8fb6a149188b5738fcc301d2ccbb04474bb0ef9fea08e99","observation_id":"2934eb91-1efd-4b23-bf60-80a81f1ce694","resolution":{"observed_at":"2026-08-14T04:35:46.764750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24448","last_updated":"2026-06-23T11:35:13Z","snapshot_observed_at":"2026-08-03T06:59:21.107836Z","submitted_at":"2026-06-23T11:35:13Z","title":"Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos","version":1},"cited_work":{"arxiv_id":"2606.24448","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24448","snapshot_observed_at":"2026-08-14T04:35:48.874740Z","title":"Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos","venue":"cs.RO","work_id":"9e6d94e3-82f3-4aac-a353-f2e09397289b","year":2026},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.823017Z"},"links":{"cited_paper":"/paper/2606.24448","citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:9a5e3c4ddae6f02460f1045800e0b5a87862c73aaaa4acb268764e80bf58dacd","observation_id":"df9dc6d3-163d-4414-bedd-edea92f69728","resolution":{"observed_at":"2026-08-14T04:35:48.914997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:35:49.599070Z","title":"InThe Twelfth International Conference on Learning Representations","venue":null,"work_id":"63d4f127-c812-483e-b2f3-4e2e661b34e3","year":2024},"citing_paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models","version":1},"reference_index":9172,"source":"pdf_text","source_observed_at":"2026-08-14T04:35:46.904753Z"},"links":{"citing_paper":"/paper/2608.08558"},"observation_digest":"sha256:6964a14b6cbbd1523af93ea3985270bc92a3432ffebc600f4d07d8f147f00497","observation_id":"a962c79b-0367-4ec9-b665-2e4528bab755","resolution":{"observed_at":"2026-08-14T04:35:49.620081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08558","last_updated":"2026-08-09T08:02:49Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-19T04:47:44.683125Z","submitted_at":"2026-08-09T08:02:49Z","title":"Vid2WAM: Distilling Video Diffusion Priors into World Action Models"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.08558."}