{"as_of":"2026-08-20T08:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ec6fe686569d8107be7fd4328604a6a83b0f28471a59510c430469c0f22138c","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:49:37.070740Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28993/citation-record","integrity":"/paper/2607.28993/integrity","json":"/paper/2607.28993/citation-record.json","paper":"/paper/2607.28993"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-03T15:49:33.584563Z","title":"arXiv preprint arXiv:2602.15922 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:33.584563Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:66759c7a694db377cda9698a0379ff6cba2827d0df12e179cca68bdb99025346","observation_id":"d69c2b35-397d-4549-968b-2bca94bcaf1b","resolution":{"observed_at":"2026-08-03T15:49:33.584563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-03T15:49:33.654145Z","title":"arXiv preprint arXiv:2601.21998 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:33.654145Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:afd4a1ca9ed23d631d3d8e70e76d248479675be4792f819dbdec343993f4c603","observation_id":"a42bf47d-6bd2-42c8-bc9c-5b5b65141d40","resolution":{"observed_at":"2026-08-03T15:49:33.654145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:33.745466Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:33.745466Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:e18e31a79115e21c4f18a74efb009440fb95ed12380754b04a571156de76a3af","observation_id":"14a12973-6f5d-4d66-bf7b-e85213b2593a","resolution":{"observed_at":"2026-08-03T15:49:33.745466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:33.835846Z","title":"arXiv preprint arXiv:2606.15768 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:33.835846Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:10322463d66aa2108eab086b8e3a0318ebca93bb272f9a554108fab0ad7ddd3e","observation_id":"edccdf48-3963-4fbb-8395-c1414e2492eb","resolution":{"observed_at":"2026-08-03T15:49:33.835846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.22078","last_updated":"2026-07-30T02:24:57Z","snapshot_observed_at":"2026-08-18T08:59:17.067437Z","submitted_at":"2026-03-23T15:13:15Z","title":"Do World Action Models Generalize Better than VLAs? A Robustness Study","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.22078","snapshot_observed_at":"2026-08-03T15:49:33.944650Z","title":"arXiv preprint arXiv:2603.22078 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:33.944650Z"},"links":{"cited_paper":"/paper/2603.22078","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:7b52f4673a47d4e5a998bd1781a84767af3b5cd8c93ffd677a1a5f1b690e0dea","observation_id":"a92fd0b1-a34f-49f5-8df5-dd7f71aafed3","resolution":{"observed_at":"2026-08-03T15:49:33.944650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13515","last_updated":"2026-06-11T16:02:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-11T16:02:42Z","title":"MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.13515","snapshot_observed_at":"2026-08-03T15:49:34.013520Z","title":"arXiv preprint arXiv:2606.13515 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.013520Z"},"links":{"cited_paper":"/paper/2606.13515","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:2693d90b9cdc201cffa4f3b7ecc5e7c88a9f815370d69e639250a7ccd88306f8","observation_id":"7c83ccbb-0a5b-4667-92bf-b7b875d07856","resolution":{"observed_at":"2026-08-03T15:49:34.013520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-19T19:57:13.864566Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-08-03T15:49:34.106633Z","title":"arXiv preprint arXiv:2602.12215 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.106633Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:0c5944df6d510bf176688738e08037fd9cc85ef532a92d4488f680ae47ff9513","observation_id":"c6b19a6e-8806-425d-9072-1392c16f1acc","resolution":{"observed_at":"2026-08-03T15:49:34.106633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03188","last_updated":"2026-06-02T05:48:02Z","snapshot_observed_at":"2026-08-13T18:59:07.365549Z","submitted_at":"2026-06-02T05:48:02Z","title":"GeoSem-WAM: Geometry- and Semantic-Aware World Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03188","snapshot_observed_at":"2026-08-03T15:49:34.192515Z","title":"arXiv preprint arXiv:2606.03188 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.192515Z"},"links":{"cited_paper":"/paper/2606.03188","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:38fe662648cef171d2f78f908431e0cb5d640c6320089bebbdd610345f6fb78a","observation_id":"1cb81bbc-0450-4935-8f00-bf16914122e0","resolution":{"observed_at":"2026-08-03T15:49:34.192515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.14712","last_updated":"2026-07-11T13:09:54Z","snapshot_observed_at":"2026-08-15T15:42:29.159558Z","submitted_at":"2026-05-14T11:31:02Z","title":"IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.14712","snapshot_observed_at":"2026-08-03T15:49:34.309210Z","title":"arXiv preprint arXiv:2605.14712 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.309210Z"},"links":{"cited_paper":"/paper/2605.14712","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:ba0002d9a021960502fae88066c59b96cbfd7836027d6837a09a35dba8b83e4c","observation_id":"4268fa03-b28c-4881-abdb-c667b8b80a3f","resolution":{"observed_at":"2026-08-03T15:49:34.309210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21088","last_updated":"2026-06-19T04:35:18Z","snapshot_observed_at":"2026-08-06T05:03:39.968585Z","submitted_at":"2026-06-19T04:35:18Z","title":"MV-WAM: Manifold-Aware World Action Model with Value Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.21088","snapshot_observed_at":"2026-08-03T15:49:34.392255Z","title":"arXiv preprint arXiv:2606.21088 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.392255Z"},"links":{"cited_paper":"/paper/2606.21088","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:fd56c212b58c5ffe92730b611aa9b6a7e97fd197855ad9c9cbdd9f35e4c43b9a","observation_id":"a60f2a74-6007-4964-9cfd-290b3ef6264f","resolution":{"observed_at":"2026-08-03T15:49:34.392255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-08-19T17:09:08.430610Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.00678","snapshot_observed_at":"2026-08-03T15:49:34.478816Z","title":"5: Unified mobility-and-manipulation world action model , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.478816Z"},"links":{"cited_paper":"/paper/2607.00678","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:5c741990f228c8bee2a2c24c4978d15cb4cde3ff3e84a8ea6a290d300d4c4a08","observation_id":"6f9ccf52-df38-48b6-a0c5-e3d4c3af50fb","resolution":{"observed_at":"2026-08-03T15:49:34.478816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-08-20T03:53:25.888886Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-03T15:49:34.537083Z","title":"arXiv preprint arXiv:2603.16666 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.537083Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:adf47912c63807fa4f777554ec1bf01051e1bd49b63783cae7c7ebf7434bf406","observation_id":"1da97980-6797-4a2a-ba52-6c6f1d1ec2c7","resolution":{"observed_at":"2026-08-03T15:49:34.537083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:34.611113Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.611113Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:89b51c767786a38db78c80ac6f85568521c283a649b4d833f06ce64c8eef7313","observation_id":"6a130b0c-898b-4d5e-ab0d-7a44c23c0186","resolution":{"observed_at":"2026-08-03T15:49:34.611113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-03T15:49:34.718596Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.718596Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:6d42c50681ac840d19b05cb91b06de95fa3124e6ee68cb15df45d5313bec8776","observation_id":"ae34c1a9-4884-4110-a404-9587ed9726b4","resolution":{"observed_at":"2026-08-03T15:49:34.718596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-11T15:03:01.640683Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15483","snapshot_observed_at":"2026-08-03T15:49:34.780788Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.780788Z"},"links":{"cited_paper":"/paper/2604.15483","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:d7d293983763a09badaa76cef7e43564ee144de3cd4d961011f57be3d24828dd","observation_id":"84ff1724-9a32-4d09-9f9e-eecbfad0ae6e","resolution":{"observed_at":"2026-08-03T15:49:34.780788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:34.852812Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.852812Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:db4b897c1aeff791637e1fa69e6b58dc34a71e4e44bc54b10d3373050850194d","observation_id":"cdd68d6f-678d-4449-a39b-bcc00e66d8d0","resolution":{"observed_at":"2026-08-03T15:49:34.852812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:34.942689Z","title":"arXiv preprint arXiv:2603.17240 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:34.942689Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:114ce94bd0938c04818d499af492b2e6d9f851aff6bd7a6a225f12018c3fb0ef","observation_id":"6bd49174-b4ef-4fc9-874e-8e23adc5c9e9","resolution":{"observed_at":"2026-08-03T15:49:34.942689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-20T07:20:19.015572Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-03T15:49:35.025359Z","title":"arXiv preprint arXiv:2601.16163 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.025359Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:fa7273f02cdafb77b33481d1e3d27abd23c666cbc3e9ea20998e18c9c68804b9","observation_id":"daf38b54-0a0b-4451-9fa0-7435c4581edf","resolution":{"observed_at":"2026-08-03T15:49:35.025359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-03T15:49:35.101997Z","title":"arXiv preprint arXiv:2406.09246 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.101997Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:c97163e0856697e403d600fce8d38523da3d5516fef0a0133f820267639957a3","observation_id":"841ef738-5d2b-495c-891c-eb4e4101d4b5","resolution":{"observed_at":"2026-08-03T15:49:35.101997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15692","snapshot_observed_at":"2026-08-03T15:49:35.162289Z","title":"2026 , note =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.162289Z"},"links":{"cited_paper":"/paper/2512.15692","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:cf22b10f5a64f0c1ab55289aa5576d981b72646e8fdee8424170bf78982043eb","observation_id":"2a798b04-edbe-443e-9b3e-10fc87a9f161","resolution":{"observed_at":"2026-08-03T15:49:35.162289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:35.252927Z","title":"arXiv preprint arXiv:2603.10448 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.252927Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:5f5db98715ba5b62ca16bf1a2e045f4ece1c69a8c982c125ebc361a8a414b563","observation_id":"a76ccd74-a74a-4823-8380-d4438a4c5138","resolution":{"observed_at":"2026-08-03T15:49:35.252927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11135","last_updated":"2026-04-13T07:48:58Z","snapshot_observed_at":"2026-08-16T01:26:32.469538Z","submitted_at":"2026-04-13T07:48:58Z","title":"AIM: Intent-Aware Unified world action Modeling with Spatial Value Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11135","snapshot_observed_at":"2026-08-03T15:49:35.322527Z","title":"arXiv preprint arXiv:2604.11135 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.322527Z"},"links":{"cited_paper":"/paper/2604.11135","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:8de585e1cd3a1c551e6b61bd9bade7f6dedafa24887cae5d0ebde402bc04d422","observation_id":"b98d25de-9775-4dd7-a5d7-e6f0217443ad","resolution":{"observed_at":"2026-08-03T15:49:35.322527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19683","last_updated":"2026-04-22T17:44:56Z","snapshot_observed_at":"2026-08-15T06:57:44.935343Z","submitted_at":"2026-04-21T17:05:37Z","title":"Mask World Model: Predicting What Matters for Robust Robot Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19683","snapshot_observed_at":"2026-08-03T15:49:35.398622Z","title":"arXiv preprint arXiv:2604.19683 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.398622Z"},"links":{"cited_paper":"/paper/2604.19683","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:d7916aca4c5c42463584cfbbdf52e810fe16bb409b4fe8e7ba8d9005cf4ea665","observation_id":"4c3bc6f6-ea5c-4d8d-8088-2e62effccb5d","resolution":{"observed_at":"2026-08-03T15:49:35.398622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:35.478946Z","title":"arXiv preprint arXiv:2602.22010 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.478946Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:2eff3ac35181d0848718fb77a5a0c243958098da43470d18e9ca5ed62e866b42","observation_id":"91398ec1-3a2b-4837-9a01-dde40e1cb041","resolution":{"observed_at":"2026-08-03T15:49:35.478946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00078","snapshot_observed_at":"2026-08-03T15:49:35.551365Z","title":"7: A latent world-action model from egocentric videos , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.551365Z"},"links":{"cited_paper":"/paper/2605.00078","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:300c13cb8a982fbbae9e5ed1c2060e6eaa56dd4b0a22ea8188df5d8e6877fd17","observation_id":"2c394b1d-a10e-40b6-8f98-379a84346ac7","resolution":{"observed_at":"2026-08-03T15:49:35.551365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-18T01:07:23.737664Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-03T15:49:35.629953Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.629953Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:fc9fc41eaa3b1210ccf2d56b1d886a0f87cacb8eb33c72aaf989c72b8ae7377a","observation_id":"7b05dad0-21cb-472e-ac54-08070d560203","resolution":{"observed_at":"2026-08-03T15:49:35.629953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:35.684909Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.684909Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:218eee076ae755ea14844802982f278199beb4d918c2c21c1a11daf5e9a7b6e7","observation_id":"f90ee0f5-732d-4c95-bd12-c5ca8d359c28","resolution":{"observed_at":"2026-08-03T15:49:35.684909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-03T15:49:35.728941Z","title":"arXiv preprint arXiv:2503.20314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.728941Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:d0fa277d8c9af045f65ff662abf14efb2a085efd822acbff98e3d0adbe4d65fd","observation_id":"b4dde9ff-4c7c-41ee-90c4-d1f3ffe04749","resolution":{"observed_at":"2026-08-03T15:49:35.728941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-08-13T00:59:48.824306Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-08-03T15:49:35.803554Z","title":"arXiv preprint arXiv:2510.13626 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.803554Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:3f92d987419f208b39b77c4b1ab6c595963c096452bddf0a3961aee1d269078c","observation_id":"996db361-a99c-4b7c-a0be-f68aab709be6","resolution":{"observed_at":"2026-08-03T15:49:35.803554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:35.866394Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.866394Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:b4c85fe0f125c80e5a1ca1322d8bcbc7122258c835587ec75a64907a72e435d8","observation_id":"1eedc7ed-138f-4cef-986f-d5f4c189b44e","resolution":{"observed_at":"2026-08-03T15:49:35.866394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:35.934280Z","title":"arXiv preprint arXiv:2602.10098 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:35.934280Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:0e273f644d6a247c3286ad246989979172c876ec35bee11c9f2220ef21363e5e","observation_id":"7ca0bf2c-0a9d-4a05-b7b8-98447f04fc02","resolution":{"observed_at":"2026-08-03T15:49:35.934280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.16391","last_updated":"2026-03-27T17:20:10Z","snapshot_observed_at":"2026-08-18T13:02:41.347839Z","submitted_at":"2026-03-27T17:20:10Z","title":"Disentangled Robot Learning via Separate Forward and Inverse Dynamics Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.16391","snapshot_observed_at":"2026-08-03T15:49:36.017420Z","title":"arXiv preprint arXiv:2604.16391 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.017420Z"},"links":{"cited_paper":"/paper/2604.16391","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:3a4e55177dc1e472f24a67f43a646a927b80da2d608907fddafbe0e2775cd8d4","observation_id":"68089a7d-d00b-464d-81f1-b30d939889bb","resolution":{"observed_at":"2026-08-03T15:49:36.017420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04996","last_updated":"2025-05-08T01:53:55Z","snapshot_observed_at":"2026-08-14T02:18:08.215462Z","submitted_at":"2024-11-07T18:59:06Z","title":"Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04996","snapshot_observed_at":"2026-08-03T15:49:36.099225Z","title":"arXiv preprint arXiv:2411.04996 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.099225Z"},"links":{"cited_paper":"/paper/2411.04996","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:b464afed0ab826d09cf77503fd626b382f1a572a38728a65fc38e83384d7c00e","observation_id":"749d4cc4-7782-4ce1-b4e5-d87ad5cd064e","resolution":{"observed_at":"2026-08-03T15:49:36.099225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-03T15:49:36.181358Z","title":"arXiv preprint arXiv:2506.18088 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.181358Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:8b44708b3ca4950007ab777f5fc0716459395296e3029584565a3ed49436198b","observation_id":"462dfb1d-2b19-44c8-b437-1d44852bcea0","resolution":{"observed_at":"2026-08-03T15:49:36.181358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-03T15:49:36.242713Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.242713Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:ca6d0387068021ae6dc7717f8392e0f73f68d46bd9d902668c062d6c3230048d","observation_id":"f9fe8d26-f112-486e-9d2d-6b6953e41b69","resolution":{"observed_at":"2026-08-03T15:49:36.242713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-13T10:05:34.967093Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-03T15:49:36.294561Z","title":"2506.21539 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.294561Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:2a7a3dbdd3e6cc9a66a7de7ebccbbf788eba3523a81eebe287d28939a86e473b","observation_id":"06f1ea8b-4ded-4fbb-bc7c-3421adf4daf9","resolution":{"observed_at":"2026-08-03T15:49:36.294561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19854","last_updated":"2025-04-28T14:47:34Z","snapshot_observed_at":"2026-08-14T03:25:49.528763Z","submitted_at":"2025-04-28T14:47:34Z","title":"NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19854","snapshot_observed_at":"2026-08-03T15:49:36.356318Z","title":"2504.19854 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.356318Z"},"links":{"cited_paper":"/paper/2504.19854","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:0105e3802279f076527f43b6580ab099293ed71106c27195945d7493696b0be8","observation_id":"4af71e38-d753-4496-9691-e29d470a3dd7","resolution":{"observed_at":"2026-08-03T15:49:36.356318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-03T15:49:36.418442Z","title":"arXiv preprint arXiv:2505.06111 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.418442Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:7475068b7fb48fbf681b988932e6e3cf3f8571ad8fb6ea4474688e90b39c6a77","observation_id":"948f2ae5-2ef9-4c78-903f-24bcb34d81fc","resolution":{"observed_at":"2026-08-03T15:49:36.418442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-03T15:49:36.479527Z","title":"arXiv preprint arXiv:2501.09747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.479527Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:67b1b88595214b913ff1e2b126c2e291eab63b8499755a589a30411cd17b9570","observation_id":"e4950578-bec0-4741-b9b3-806322812cad","resolution":{"observed_at":"2026-08-03T15:49:36.479527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-08-17T15:25:05.328906Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-08-03T15:49:36.540809Z","title":"arXiv preprint arXiv:2505.17016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.540809Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:6d1aba0f6fd5c8a280baa962accc1f61fd6985b1ec4d97e940e882a0d3619d0d","observation_id":"2603dae1-fb5e-44fd-80f5-fa67308fed01","resolution":{"observed_at":"2026-08-03T15:49:36.540809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-15T09:35:08.116329Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-03T15:49:36.623400Z","title":"arXiv preprint arXiv:2502.19645 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.623400Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:f2d4b77eaa99af67efdf71eda0ca11c265f0a7e1a0e6127c2561bfe6c93743e5","observation_id":"0708d229-08b6-43f4-a0c0-576d1444b975","resolution":{"observed_at":"2026-08-03T15:49:36.623400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-08-18T08:46:36.907284Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-08-03T15:49:36.705724Z","title":"arXiv preprint arXiv:2510.10274 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.705724Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:718fab0d5b215b262b3e44fa7ca5014fb9760f4e19bb3e306d70fff792adab7d","observation_id":"9a05cf12-e7f3-4e86-b971-eeba44199cd3","resolution":{"observed_at":"2026-08-03T15:49:36.705724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:36.757841Z","title":"The eleventh international conference on learning representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.757841Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:bc08749ad72913f4cae36c370bd34a7cbb4e7b9f7193fd8a7ac47e6214c2d6a8","observation_id":"f5affaf7-a293-4d9f-a5e7-5ef29ab42a36","resolution":{"observed_at":"2026-08-03T15:49:36.757841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:36.800608Z","title":"Robot World Models , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.800608Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:bf77b8c1f800d0a7c8e9e1b3fb8ec13c73d56325b93e017d4a506dc7c1261af1","observation_id":"ee946bce-322a-488e-ad5f-2e055f3e905f","resolution":{"observed_at":"2026-08-03T15:49:36.800608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05468","last_updated":"2026-07-06T07:10:22Z","snapshot_observed_at":"2026-08-19T09:02:30.811257Z","submitted_at":"2026-07-06T07:10:22Z","title":"Learning 4D Geometric Priors for Inference-Efficient World Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05468","snapshot_observed_at":"2026-08-03T15:49:36.861441Z","title":"arXiv preprint arXiv:2607.05468 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.861441Z"},"links":{"cited_paper":"/paper/2607.05468","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:c93990092681e3554819794fd01787d540b813b6ff0cffd47c30b284f79884b8","observation_id":"60730c37-0e5f-434b-89d8-d4b1a95b1c49","resolution":{"observed_at":"2026-08-03T15:49:36.861441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06481","last_updated":"2026-05-07T16:06:08Z","snapshot_observed_at":"2026-08-11T07:38:44.239882Z","submitted_at":"2026-05-07T16:06:08Z","title":"OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06481","snapshot_observed_at":"2026-08-03T15:49:36.938227Z","title":"arXiv preprint arXiv:2605.06481 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:36.938227Z"},"links":{"cited_paper":"/paper/2605.06481","citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:ee869ab11a750f1fc74e2a07e11271a2cc2fbbfc7fe387c90eea85d08fd97612","observation_id":"d80caec6-100a-4080-99fa-d25cfd54de36","resolution":{"observed_at":"2026-08-03T15:49:36.938227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:37.019119Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:37.019119Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:168375528445fd120da039057f4a1983cff953f1ee8f48f5aad1be6d7982c21c","observation_id":"8ba3a237-d2e3-40d4-80c8-7e09d28a352c","resolution":{"observed_at":"2026-08-03T15:49:37.019119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:49:37.070740Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-03T15:49:37.070740Z"},"links":{"citing_paper":"/paper/2607.28993"},"observation_digest":"sha256:b6a92d60b43c9ba1513fc8a4824b219e68d58fee47920573d2a170f09e479d34","observation_id":"6549a16e-5ba3-47b9-9e15-34169bd25e06","resolution":{"observed_at":"2026-08-03T15:49:37.070740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28993","last_updated":"2026-07-31T03:44:56Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T07:24:24.286199Z","submitted_at":"2026-07-31T03:44:56Z","title":"ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2607.28993."}