{"as_of":"2026-08-19T17:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3700a13310d7a3d1d9013ae9b3f64fe5a748fd80b09859d34271b0f22709040","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:00:32.177370Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06994/citation-record","integrity":"/paper/2608.06994/integrity","json":"/paper/2608.06994/citation-record.json","paper":"/paper/2608.06994"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:31.897470Z","title":"Geoaware-vla: Implicit geometry aware vision-language-action model.arXiv:2509.14117, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.897470Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:9abe703851aacfa58b9e3f1baa4a640806b3a08c3fa1b147f5eeeeb98b94c729","observation_id":"e1a2adb3-85e7-4a24-8577-ac4ec424549b","resolution":{"observed_at":"2026-08-10T17:00:31.897470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-08-15T13:40:01.739055Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-10T17:00:31.901392Z","title":"V-jepa 2: Self- supervised video models enable understanding, prediction and planning.arXiv:2506.09985, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.901392Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:9963d8b416de8988960adaef4b0970465a4a7ffcc087cc0dac492a93142dfec9","observation_id":"5ba9bd6c-d052-4246-a97b-d79274b86079","resolution":{"observed_at":"2026-08-10T17:00:31.901392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.558765Z","title":"Motus: A unified latent ac- tion world model","venue":null,"work_id":"1433b80c-1069-4ae7-a7cf-2c496cbabae3","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.905584Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:11aed74e8eb73137eae3d61efc7f170cd8daf74a6efd2c2119181266324e5422","observation_id":"66f6b088-384d-4c16-83be-4ed9c9b41970","resolution":{"observed_at":"2026-08-10T17:00:33.562214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-10T17:00:31.909235Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots.arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.909235Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:35e23cdb1b1602b0b369100899b7debdb4a90098b7de8f082160ee4afaec1f7c","observation_id":"80bea50a-6e42-4362-b8d2-0a5c815910af","resolution":{"observed_at":"2026-08-10T17:00:31.909235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-10T17:00:31.913390Z","title":"pi 0: A vision-language-action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.913390Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:4fd1351e70afd1f3dad5793afdfc571d2572aa740a2ffb337926d848a4d07491","observation_id":"28132efa-e73d-464f-8f80-cdea63e919a1","resolution":{"observed_at":"2026-08-10T17:00:31.913390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-10T17:00:31.917309Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.917309Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:56870dacd36d96abcfaa2b8a883f887ecfe28960b720c25461e36baf24ca5c44","observation_id":"3b824110-1f95-4bbb-af5e-4360bb912c3d","resolution":{"observed_at":"2026-08-10T17:00:31.917309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.548445Z","title":"Ge- nie: Generative interactive environments","venue":null,"work_id":"3c8bd5ab-19ec-404c-b87f-56ff63bebc9c","year":2024},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.921151Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:05a1084d081be98d17b1e639068452e8517cc57c35f8eead2c8016483142bffc","observation_id":"864d1b1b-3e76-4b38-9539-7832e4c116ea","resolution":{"observed_at":"2026-08-10T17:00:33.552032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-10T17:00:31.925241Z","title":"Univla: Learning to act anywhere with task-centric latent ac- tions.arXiv:2505.06111, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.925241Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3c3acbf7ad29fdb80f90d4195c5f3a6700f269ae6d4e0537816b0ad92bb49409","observation_id":"275f68f0-fce0-44c1-a651-cbb04eccd6c9","resolution":{"observed_at":"2026-08-10T17:00:31.925241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17502","last_updated":"2026-05-30T03:49:39Z","snapshot_observed_at":"2026-08-03T20:59:48.866420Z","submitted_at":"2025-11-21T18:59:32Z","title":"RynnVLA-002: A Unified Vision-Language-Action and World Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17502","snapshot_observed_at":"2026-08-10T17:00:31.928759Z","title":"Rynnvla-002: A unified vision-language-action and world model.arXiv:2511.17502, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.928759Z"},"links":{"cited_paper":"/paper/2511.17502","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:bf3ded7fdb51341ec954258053f349ea2f2dd27c8dafb6ac6f70085a0930b5f1","observation_id":"6f141fd2-9b05-40d7-9876-ac9d22c6bd03","resolution":{"observed_at":"2026-08-10T17:00:31.928759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-13T10:05:34.967093Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-10T17:00:31.932383Z","title":"Worldvla: Towards autoregressive action world model.arXiv:2506.21539, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.932383Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:7cdba9f776170105ea6b6463ac96e3aeb328677c54fe58416d1b98d317b769c7","observation_id":"b4a0e3a3-ced7-48f8-9f9e-9468a573d3a1","resolution":{"observed_at":"2026-08-10T17:00:31.932383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:31.935890Z","title":"Lawam: Latent world action models for efficient dynamics-aware robot policies.arXiv:2606.15768,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.935890Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:332b26a0a29ffb5d5d9a1a45d4743b421af004deacf12dddda9f35a5ae0282aa","observation_id":"f06b0d3e-8555-4713-8af8-bc72f20a3389","resolution":{"observed_at":"2026-08-10T17:00:31.935890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19249","last_updated":"2024-09-09T03:06:57Z","snapshot_observed_at":"2026-08-16T14:14:06.616203Z","submitted_at":"2024-02-29T15:22:17Z","title":"Mirage: Cross-Embodiment Zero-Shot Policy Transfer with Cross-Painting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19249","snapshot_observed_at":"2026-08-10T17:00:31.939376Z","title":"Mi- rage: Cross-embodiment zero-shot policy transfer with cross-painting.arXiv:2402.19249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.939376Z"},"links":{"cited_paper":"/paper/2402.19249","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:df0a90b92e020b460fccebfb7314bc9b59f18813a714d1d53a1f27cd7b95e444","observation_id":"f4b7cdc2-9c35-4b93-a337-07e7b2ffe1e7","resolution":{"observed_at":"2026-08-10T17:00:31.939376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.538432Z","title":"Lapo: Latent-variable advantage- weighted policy optimization for offline reinforcement learn- ing.NeurIPS, 35:36902–36913, 2022","venue":null,"work_id":"44d8cbcf-6ebd-49e3-8148-78dc2c2eb6a7","year":2022},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.943193Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:1bcfb0678087bd098a794cb749cf849fcdb150f9a4fe1b08eefb185212e2e432","observation_id":"25d6fcc7-abe3-4b5b-a379-a7af964ee355","resolution":{"observed_at":"2026-08-10T17:00:33.541770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23682","last_updated":"2025-09-25T10:26:44Z","snapshot_observed_at":"2026-08-15T01:36:59.759529Z","submitted_at":"2025-07-31T15:57:46Z","title":"villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23682","snapshot_observed_at":"2026-08-10T17:00:31.946042Z","title":"Villa-x: enhancing la- tent action modeling in vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.946042Z"},"links":{"cited_paper":"/paper/2507.23682","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:2077e1639406108446ae78380149aa49722f4c0b0dc1c7ad7627d3e4f52b9f91","observation_id":"070cf01d-525e-4783-84a6-879f70ee9667","resolution":{"observed_at":"2026-08-10T17:00:31.946042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.528621Z","title":"Moto: Latent mo- tion token as the bridging language for learning robot ma- nipulation from videos","venue":null,"work_id":"02b5ca67-08af-4961-826c-748b4bad33b1","year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.949589Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:d944d7202a297fc3ad1c98addbbb28b2e7b4a78405f5da134faa458b75a4eec4","observation_id":"87f52928-e5c9-4a94-82d9-73807aef1dd4","resolution":{"observed_at":"2026-08-10T17:00:33.532068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02776","last_updated":"2026-07-12T06:20:43Z","snapshot_observed_at":"2026-08-13T19:09:23.113990Z","submitted_at":"2025-11-04T17:59:12Z","title":"XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.02776","snapshot_observed_at":"2026-08-10T17:00:31.953138Z","title":"Xr-1: Towards versatile vision-language-action models via learning unified vision-motion representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.953138Z"},"links":{"cited_paper":"/paper/2511.02776","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:29c55d099b354ec55fd7ffcf60f173ffaeb83209b815b51994ec86f81e127491","observation_id":"ab5949a4-a94d-45ae-b240-7ad55ab83bd6","resolution":{"observed_at":"2026-08-10T17:00:31.953138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-08-13T00:59:48.824306Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-08-10T17:00:31.956572Z","title":"Libero-plus: In-depth robustness analysis of vision- language-action models.arXiv:2510.13626, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.956572Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:b305430003b97f335747a66315a7d875af671bac575dd57d554f0b9d86d9093d","observation_id":"2e50e888-457c-475b-b922-03077f40a1f4","resolution":{"observed_at":"2026-08-10T17:00:31.956572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12898","last_updated":"2025-12-20T02:16:12Z","snapshot_observed_at":"2026-08-13T01:28:28.512361Z","submitted_at":"2025-07-17T08:31:55Z","title":"Vidar: Embodied Video Diffusion Model for Generalist Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12898","snapshot_observed_at":"2026-08-10T17:00:31.960459Z","title":"Vi- dar: Embodied video diffusion model for generalist manipu- lation.arXiv:2507.12898, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.960459Z"},"links":{"cited_paper":"/paper/2507.12898","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:03a43abe45f40e51e28fb435d7b95c68f755976324fe542e1ff14b73685eada7","observation_id":"abd75aa6-3669-4277-a98d-701cb97a4028","resolution":{"observed_at":"2026-08-10T17:00:31.960459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06949","last_updated":"2026-02-06T18:49:43Z","snapshot_observed_at":"2026-07-06T22:44:51.126114Z","submitted_at":"2026-02-06T18:49:43Z","title":"DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06949","snapshot_observed_at":"2026-08-10T17:00:31.963929Z","title":"Dreamdojo: A generalist robot world model from large-scale human videos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.963929Z"},"links":{"cited_paper":"/paper/2602.06949","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:75617a5d92e2d009c0226465fec77a404b9633701410db2f54c3674fe9b5a552","observation_id":"567f778a-3d9a-4037-80b7-296d594a1e8d","resolution":{"observed_at":"2026-08-10T17:00:31.963929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-10T17:00:31.967383Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.967383Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:b7736cb390353fed2330f0061b55b611d664930c6323d229a3e52b3697e64308","observation_id":"8aecb685-517e-4846-a7ae-77ec1f2c1e3e","resolution":{"observed_at":"2026-08-10T17:00:31.967383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-10T17:00:31.971270Z","title":"pi 0.5: a vision-language-action model with open-world generaliza- tion.arXiv:2504.16054, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.971270Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:e14e69547bac7169f591e3546e5b1ee71df90df9a9d779a2313dde2a477af6b7","observation_id":"29923d01-1697-4628-afb5-0c0fde1dda94","resolution":{"observed_at":"2026-08-10T17:00:31.971270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.518186Z","title":"Perceiver: General perception with iterative attention","venue":null,"work_id":"a9d6746a-225c-42eb-b267-61d90c3b638e","year":2021},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.974835Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:93d62dee8881251aff90ae369f5975e30aec372032d587c26040f3926632d8b0","observation_id":"e2a9bcc6-33d2-4d38-87dd-60c70f06a918","resolution":{"observed_at":"2026-08-10T17:00:33.522015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06388","last_updated":"2026-05-07T15:05:26Z","snapshot_observed_at":"2026-08-12T15:42:05.987893Z","submitted_at":"2026-05-07T15:05:26Z","title":"Reconstruction or Semantics? What Makes a Latent Space Useful for Robotic World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06388","snapshot_observed_at":"2026-08-10T17:00:31.977865Z","title":"Recon- struction or semantics? what makes a latent space useful for robotic world models.arXiv:2605.06388, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.977865Z"},"links":{"cited_paper":"/paper/2605.06388","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:9991d4845c03414ef26cb8451f8fd4afc69e51441137e24a440e0624773ef7ae","observation_id":"f3e3508d-486b-429f-955c-398e63c46d07","resolution":{"observed_at":"2026-08-10T17:00:31.977865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-10T17:00:31.981123Z","title":"Openvla: An open- source vision-language-action model.arXiv:2406.09246,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.981123Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:ef40e129fed935c9c4699eedd111102789409f5cfc5eb28d5b0c0df1b79b6fb8","observation_id":"f7fe3aeb-9bd5-49cf-bf3e-68730f4e59f9","resolution":{"observed_at":"2026-08-10T17:00:31.981123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-15T09:35:08.116329Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-10T17:00:31.984635Z","title":"Fine-tuning vision-language-action models: Optimizing speed and suc- cess.arXiv:2502.19645, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.984635Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:f3429dd002eee4efc6cc7d00b799db28dbe38c40cd9b9d3ab5d7c0be3fff1685","observation_id":"18179503-3e00-4ab0-98f4-d1ccb5af5648","resolution":{"observed_at":"2026-08-10T17:00:31.984635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-18T01:37:22.468162Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-10T17:00:31.988863Z","title":"Cosmos policy: Fine- tuning video models for visuomotor control and planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.988863Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:13541b01c1e43c1ca93fe986eaa9e9e5ec8f0136ca4e8d6c35b5d2b5a01414c4","observation_id":"4f82494b-3e37-4508-94ed-35af9989afcc","resolution":{"observed_at":"2026-08-10T17:00:31.988863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:31.992755Z","title":"Spatial forc- ing: Implicit spatial representation alignment for vision- language-action model.arXiv:2510.12276, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.992755Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:4a8c376545aa67c8a4aa4d83c98e1595cc943361efb208f68f4d036a31e495a1","observation_id":"80cce155-d306-4bf3-934d-36cb67d1938d","resolution":{"observed_at":"2026-08-10T17:00:31.992755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.507425Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"e972746a-24b4-4cd4-96d9-e6ac2393a6f5","year":2023},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.996354Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:5c5ab3b787e3b918f3936cbc02b106b673ee54ec4b0fcb2d5030bb2fd989bc50","observation_id":"62ba679e-c424-49e3-9b3e-acd3f6e6107a","resolution":{"observed_at":"2026-08-10T17:00:33.511317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-10T17:00:31.999464Z","title":"Causal world modeling for robot control","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:31.999464Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:cd03f2b59cc86d4e69d6a86a30035098e57901edd9661ecaf917efd5181298da","observation_id":"b97549ca-a40e-4873-a583-4090a0025914","resolution":{"observed_at":"2026-08-10T17:00:31.999464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01955","last_updated":"2026-06-01T09:14:51Z","snapshot_observed_at":"2026-08-03T02:17:56.167011Z","submitted_at":"2026-06-01T09:14:51Z","title":"WALL-WM: Carving World Action Modeling at the Event Joints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01955","snapshot_observed_at":"2026-08-10T17:00:32.003493Z","title":"Wall-wm: Carving world action model- ing at the event joints.arXiv:2606.01955, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.003493Z"},"links":{"cited_paper":"/paper/2606.01955","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:c1bedab3d0a4ba261b97ca1f2a559c18f2ce29b592da83c8af96744b1346a402","observation_id":"8a02c94f-d16a-43e1-967d-9607319b3665","resolution":{"observed_at":"2026-08-10T17:00:32.003493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.496009Z","title":"Cogvla: Cognition-aligned vision-language-action models via instruction-driven routing & sparsification.Advances in neural information processing systems, 38:137646–137675,","venue":null,"work_id":"24025fdf-8c46-4c83-a17c-a07c6ec5eafe","year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.007356Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:067ff3cc1a9e57bedbeb5419e08f536f16dfdd024f8fcc3002423f04cb5569cb","observation_id":"2e795383-072c-4f49-8595-bfb971babe98","resolution":{"observed_at":"2026-08-10T17:00:33.499667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.484350Z","title":"Langforce: Bayesian decomposition of vision language ac- tion models via latent action queries","venue":null,"work_id":"1d0f03da-c60c-4684-9bc5-a5a3c271c3dd","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.010433Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:d3c8e85cc05c5e20b716f12e6a108fa2246f434df72f6d5056dddd6a18145f9d","observation_id":"d1e767cd-cb6a-4371-aa62-708962903678","resolution":{"observed_at":"2026-08-10T17:00:33.488248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.014103Z","title":"Physbrain: Human egocentric data as a bridge from vision language models to physical intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.014103Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3aada1b17e627a1f1fc7d02b6d75d06318f99d6b0084858f4f704e1116ffb889","observation_id":"aa87a429-ce38-474c-9eb6-1d02b5f562f1","resolution":{"observed_at":"2026-08-10T17:00:32.014103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.473419Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.NeurIPS, 36: 44776–44791, 2023","venue":null,"work_id":"59decc9f-710e-4004-b9c4-89da9600460d","year":2023},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.018035Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:2770486eec63a7c8b538d204e9ed633215650aeb7b488f30b56143dc8f93d289","observation_id":"f549b9ae-51d1-4207-bc8d-6a5b41473e45","resolution":{"observed_at":"2026-08-10T17:00:33.477207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07100","snapshot_observed_at":"2026-08-10T17:00:32.021606Z","title":"Lara: Latent action representation align- ment for vision-language-action models.arXiv:2606.07100,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.021606Z"},"links":{"cited_paper":"/paper/2606.07100","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:5bd0a83377dcd86468cff1568ec1811f92302c096f0d1005bdfaa5c0e087d4c1","observation_id":"7fa14a53-d35f-4e4c-8b0e-c0a6d6af5c3c","resolution":{"observed_at":"2026-08-10T17:00:32.021606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.462186Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipulation","venue":null,"work_id":"cd85a409-db2a-44be-b2ab-9539cc44dd34","year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.025681Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:6981f9092e2d7ee7afc9bc7797da86d56b2a8ea426277752a2808c8cd70dd778","observation_id":"f7e8e1c6-2690-423c-8e81-fd43a6947219","resolution":{"observed_at":"2026-08-10T17:00:33.465532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00078","snapshot_observed_at":"2026-08-10T17:00:32.029118Z","title":"Being-h0","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.029118Z"},"links":{"cited_paper":"/paper/2605.00078","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:b9e933ec30d20300f6d79107cf834221b5fe163a39e88728ea4cc2fc7813f392","observation_id":"f1961117-0ec9-410e-922d-b27f3c8c6c03","resolution":{"observed_at":"2026-08-10T17:00:32.029118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06951","last_updated":"2025-09-09T09:42:16Z","snapshot_observed_at":"2026-08-17T11:41:32.127627Z","submitted_at":"2025-09-08T17:58:30Z","title":"F1: A Vision-Language-Action Model Bridging Understanding and Generation to Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06951","snapshot_observed_at":"2026-08-10T17:00:32.032361Z","title":"F1: A vision-language- action model bridging understanding and generation to ac- tions.arXiv:2509.06951, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.032361Z"},"links":{"cited_paper":"/paper/2509.06951","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:16b5dd1eae3f5b5877af70357c801f5334185acf826ac4b51cb7dfb9be2fccad","observation_id":"fdcf298a-8bfd-4354-a7ae-71956f7d4881","resolution":{"observed_at":"2026-08-10T17:00:32.032361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-02T23:57:43.860710Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-08-10T17:00:32.036619Z","title":"Lda-1b: Scaling latent dynam- ics action model via universal embodied data ingestion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.036619Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3835906f3f4a0fe339cddb02d106b9a5f11c60c2c3d1e5f324112d1dfa3bb0b0","observation_id":"d1e5520a-6bd0-44fc-82ec-9e97712eb615","resolution":{"observed_at":"2026-08-10T17:00:32.036619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.040157Z","title":"Dit4dit: Jointly modeling video dynamics and actions for generalizable robot control.arXiv:2603.10448, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.040157Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:e10a8b7b152b0915829697bc3719d1217da13c2dc06f74883a8b24b2b18bc6fa","observation_id":"afd87940-1450-4915-b556-6af6e9734fea","resolution":{"observed_at":"2026-08-10T17:00:32.040157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.450896Z","title":"Unifying perception and action: A hybrid- modality pipeline with implicit visual chain-of-thought for robotic action generation","venue":null,"work_id":"0cc058d2-1a28-436e-8348-7a618f467f66","year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.043910Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:ee0f366c5170b65500570bffd6d0491eaca871511a35ad1d4d714b7e5bd62e13","observation_id":"6a44cf57-a02e-4b4f-a4c7-5b2783088af9","resolution":{"observed_at":"2026-08-10T17:00:33.454478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.19312","last_updated":"2026-06-03T18:50:40Z","snapshot_observed_at":"2026-08-15T13:44:41.952181Z","submitted_at":"2026-03-13T19:48:14Z","title":"LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architecture from Pixels","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.19312","snapshot_observed_at":"2026-08-10T17:00:32.048422Z","title":"Leworldmodel: Stable end- to-end joint-embedding predictive architecture from pixels","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.048422Z"},"links":{"cited_paper":"/paper/2603.19312","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:bbe6ca941b09df2ea122e31d680bd74250ba6d1e53b35964ea5f36ae4d16390b","observation_id":"eaa253b6-7429-435e-8f23-8c6d8baba3ad","resolution":{"observed_at":"2026-08-10T17:00:32.048422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14482","last_updated":"2026-06-11T10:07:56Z","snapshot_observed_at":"2026-08-16T02:46:49.800923Z","submitted_at":"2026-03-15T17:02:40Z","title":"V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.14482","snapshot_observed_at":"2026-08-10T17:00:32.051924Z","title":"V-jepa 2.1: Unlocking dense fea- tures in video self-supervised learning.arXiv:2603.14482,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.051924Z"},"links":{"cited_paper":"/paper/2603.14482","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:9b1bf50da17b056b64c368bfdd0912994f94c13214fa87da616cca43362a1857","observation_id":"88bea4cc-136a-46aa-8bde-d1c4d74c1f57","resolution":{"observed_at":"2026-08-10T17:00:32.051924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.439001Z","title":"Gr00t n1: An open foundation model for gener- alist humanoid robots, 2025","venue":null,"work_id":"280768dc-58ce-4639-afd7-97d93006c426","year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.055590Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3ca6059956aaf880272dd75e39001185413e9a1a8d7a287afb6321e91ccc456f","observation_id":"af265f6c-77c1-4447-9688-5dea1195da10","resolution":{"observed_at":"2026-08-10T17:00:33.442711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15692","snapshot_observed_at":"2026-08-10T17:00:32.058660Z","title":"mimic-video: Video-action models for generalizable robot control beyond vlas.arXiv:2512.15692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.058660Z"},"links":{"cited_paper":"/paper/2512.15692","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:419b58496baa3f8447d7119b7f67a91c5e8c6b71d713ffb1cba9a222d7206b72","observation_id":"69e5a1de-ed43-4095-818c-74758b2b782d","resolution":{"observed_at":"2026-08-10T17:00:32.058660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-10T17:00:32.062599Z","title":"Fast: Effi- cient action tokenization for vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.062599Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:86034455256c46195912d51bef515885645f95782a932bf9e73d55e5d7f2f824","observation_id":"b60c265a-046a-4fb4-aff1-a4ebf12bca0a","resolution":{"observed_at":"2026-08-10T17:00:32.062599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-08-17T12:53:34.218587Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-10T17:00:32.065812Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model.arXiv:2501.15830, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.065812Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:fff99d46fdbab8e195ddf2108c0a6bbfc65b1346ac17733c179e5f348fee8cde","observation_id":"3854a794-c2e5-4ae4-b52e-d5b9fa7f4e7c","resolution":{"observed_at":"2026-08-10T17:00:32.065812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.069844Z","title":"Vipra: Video prediction for robot ac- tions.arXiv:2511.07732, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.069844Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3055c68487653477cf37513be17beeee194c8d3588f7c7f4eec03e5512d08c49","observation_id":"93dd8a31-6968-4851-beaa-23f04c283679","resolution":{"observed_at":"2026-08-10T17:00:32.069844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.073593Z","title":"World guidance: World modeling in condition space for action generation.arXiv:2602.22010,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.073593Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:5a826c62f5355f337bbda56d5e0c82db98a09083317ed83705c2be469ed8d2d1","observation_id":"f401b8f0-4631-491f-8c65-00bf2debfa8c","resolution":{"observed_at":"2026-08-10T17:00:32.073593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.077271Z","title":"Rocket: Residual-oriented multi-layer align- ment for spatially-aware vision-language-action models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.077271Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:c73174d015dc8d72b0c3df834139064ee55f678b77022164bc95d69013e1fa0a","observation_id":"3baf6ce4-64bc-4fb6-b64a-e21a0bed9a2e","resolution":{"observed_at":"2026-08-10T17:00:32.077271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.081033Z","title":"Vla-jepa: Enhancing vision-language-action model with latent world model.arXiv:2602.10098, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.081033Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:50895fa675134a34270fa74368d0e76ea092bb0f377451123bf7c1d3e841dee5","observation_id":"00586982-305a-4da7-8fe9-75617c1df193","resolution":{"observed_at":"2026-08-10T17:00:32.081033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27792","last_updated":"2026-07-15T07:09:44Z","snapshot_observed_at":"2026-08-02T15:15:08.869109Z","submitted_at":"2026-04-30T12:34:44Z","title":"Motubrain: An Advanced World Action Model for Robot Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27792","snapshot_observed_at":"2026-08-10T17:00:32.084437Z","title":"Motubrain: An advanced world ac- tion model for robot control.arXiv:2604.27792, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.084437Z"},"links":{"cited_paper":"/paper/2604.27792","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:2e7e02932df480c916925a10c0f8c82f3f646f1f9a4ba20595c963139127f334","observation_id":"8c6f30bf-9b12-4054-924b-992b7c618b1d","resolution":{"observed_at":"2026-08-10T17:00:32.084437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00482","last_updated":"2024-03-11T14:27:48Z","snapshot_observed_at":"2026-08-17T02:46:52.486829Z","submitted_at":"2023-02-01T14:47:17Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00482","snapshot_observed_at":"2026-08-10T17:00:32.088424Z","title":"Improving and generalizing flow- based generative models with minibatch optimal transport","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.088424Z"},"links":{"cited_paper":"/paper/2302.00482","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:2b83790fc17ce50f6f5568c60b56a24e2cd7f0e321ec36bfcaa1427d040de276","observation_id":"c75ca175-01ab-45b6-a20e-987ce0a9efce","resolution":{"observed_at":"2026-08-10T17:00:32.088424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.092512Z","title":"Visualizing data using t-sne.Journal of machine learning research, 9 (11), 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.092512Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:df08a9b9bbc15a13584eac405a5674245b7c46bfa5dceaf25c96d376c401e8a5","observation_id":"02160754-a9fb-4cce-b85f-e24c61abfcb5","resolution":{"observed_at":"2026-08-10T17:00:32.092512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-10T17:00:32.096154Z","title":"Wan: Open and advanced large-scale video generative models.arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.096154Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:ec32964e93d1466d7ac52ed8c0ec732fb0f2f942fbf9a54655e310bf009ebad7","observation_id":"7d6bec66-d9d9-4b97-9fbe-57b3a07771fa","resolution":{"observed_at":"2026-08-10T17:00:32.096154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.421154Z","title":"Learn- ing diffusion models with flexible representation guidance","venue":null,"work_id":"20473853-2d43-4286-91a9-d7ba0dafc3d2","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.099669Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:6249f93d3d16f04170c0e5b7046cbf5c05c3e5a5f77110c6527ad17971b36bd2","observation_id":"e895b101-bc65-4fc7-a6eb-1c8731f856e9","resolution":{"observed_at":"2026-08-10T17:00:33.424957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.409562Z","title":"Scaling proprioceptive-visual learning with heterogeneous pre-trained transformers.Advances in neural information processing systems, 37:124420–124450, 2024","venue":null,"work_id":"5316aaa7-6c79-414b-8ecc-dc63f1cb9099","year":2024},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.102790Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:6812ec018fa8c2362fbab4ebad5f21fcf68d669fa2c5a3d61f41b89bda307b00","observation_id":"48b4a773-aa14-4660-bd05-214d43f8d18a","resolution":{"observed_at":"2026-08-10T17:00:33.413639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.22003","last_updated":"2026-05-09T06:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-23T14:08:58Z","title":"VP-VLA: Visual Prompting as an Interface for Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.22003","snapshot_observed_at":"2026-08-10T17:00:32.106696Z","title":"Vp-vla: Visual prompting as an interface for vision-language-action models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.106696Z"},"links":{"cited_paper":"/paper/2603.22003","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:a8a2dff720832cd3f379e14ed4b97ee00042beaba3ffb9ab06bc32a019c3b056","observation_id":"1ea1eeb4-1c2a-427b-b99f-5c2328717dec","resolution":{"observed_at":"2026-08-10T17:00:32.106696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11951","last_updated":"2026-05-12T11:00:45Z","snapshot_observed_at":"2026-08-15T07:09:54.482177Z","submitted_at":"2026-05-12T11:00:45Z","title":"From Reaction to Anticipation: Proactive Failure Recovery through Agentic Task Graph for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11951","snapshot_observed_at":"2026-08-10T17:00:32.110126Z","title":"From reaction to anticipation: Proactive failure re- covery through agentic task graph for robotic manipulation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.110126Z"},"links":{"cited_paper":"/paper/2605.11951","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:cd3c58c3ebbc339e7ebfa3859e3ba5c627db57521efe274576fab82c18d53d8c","observation_id":"b5deb5a2-8540-4099-8c01-2f2213ab6bdf","resolution":{"observed_at":"2026-08-10T17:00:32.110126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.398426Z","title":"Thinking in space: How mul- timodal large language models see, remember, and recall spaces","venue":null,"work_id":"49407328-086a-49fa-b831-378ba3449833","year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.113498Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:7f76f1d9780bf56567b442a6a5dd4fd5f6d467e652a41c1fbe549499fbb15f2c","observation_id":"4263df61-6c45-4f70-a310-0414bd37066e","resolution":{"observed_at":"2026-08-10T17:00:33.402413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.388488Z","title":"Como: Learning continuous latent motion from in- ternet videos for scalable robot learning","venue":null,"work_id":"a599493e-54de-42c4-b51c-bcc53ab9bb61","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.117112Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:ff101f243e39919ef82c9a951244f23c22edd1a0b294eec11c685cd2da428b5c","observation_id":"aedbdb16-e5e1-48fe-8e21-c13a31f7983f","resolution":{"observed_at":"2026-08-10T17:00:33.391968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.377159Z","title":"Mantis: A versatile vision-language-action model with disentangled visual foresight","venue":null,"work_id":"961566fd-1bd1-4cdd-a8c9-c5e9cd6b78bb","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.121182Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:6b6fa9c2fb802c83bd42a6607fe5777ed93edc4f23a8bf304ec61c9290c04962","observation_id":"7ea2360c-2de2-47b1-b1e0-895f93d06ee9","resolution":{"observed_at":"2026-08-10T17:00:33.381127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11757","last_updated":"2026-04-13T17:30:01Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T17:30:01Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11757","snapshot_observed_at":"2026-08-10T17:00:32.124606Z","title":"Starvla: Reducing complexity in vision- language-action systems.arXiv preprint arXiv:2604.11757,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.124606Z"},"links":{"cited_paper":"/paper/2604.11757","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:5ab039d9c5201b148403740bc945686e852eddb1eee379f9ba3f4e6969e4428b","observation_id":"dc1e496e-d2cd-414e-b076-fb128369f9c1","resolution":{"observed_at":"2026-08-10T17:00:32.124606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.365301Z","title":"Latent action pretrain- ing from videos","venue":null,"work_id":"fc1e52a1-3678-4d5c-926f-45c6d5e4085f","year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.128313Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:84d0e911975255e11f02fbd08475f4244a1c512bd084bbc8bebe0188040d0a39","observation_id":"65c4f620-29f4-4a2f-b05c-91343f475bc9","resolution":{"observed_at":"2026-08-10T17:00:33.368899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-10T17:00:32.131691Z","title":"World ac- tion models are zero-shot policies.arXiv:2602.15922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.131691Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:3a390ff794843fdca62dc79d88528bc21a33c42904824089c7896e8c660a5b01","observation_id":"39bf5e95-fefb-42de-96ee-65331893c0b6","resolution":{"observed_at":"2026-08-10T17:00:32.131691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-08-15T14:30:41.084242Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-10T17:00:32.135524Z","title":"Fast-wam: Do world action models need test-time future imagination?arXiv:2603.16666, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.135524Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:004adb741ea6a1207d371c25fca1b559cf6da8d5b340835c253df2733408f8e7","observation_id":"08b40f8a-2249-463a-9515-23f4f412e3ea","resolution":{"observed_at":"2026-08-10T17:00:32.135524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-08-10T17:00:32.139111Z","title":"Robotic control via embodied chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.139111Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:f36e0b5a7e1e88d11aad1d4bf5893e0c7d06e91e147a1feb1646af1b80817a3d","observation_id":"b01a7212-78d0-4171-bb82-621339f31e3d","resolution":{"observed_at":"2026-08-10T17:00:32.139111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:32.143221Z","title":"Clap: Contrastive latent action pretraining for learn- ing vision-language-action models from human videos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.143221Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:559be4c5dde0473ee10299064425d644e8c6e13cd8e39e8fb7bc6d158c25bd34","observation_id":"c2406634-62b3-4b3c-b17b-6ec3689bbedb","resolution":{"observed_at":"2026-08-10T17:00:32.143221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.353870Z","title":"Dreamvla: a vision-language- action model dreamed with comprehensive world knowl- edge.NeurIPS, 38:24195–24228, 2026","venue":null,"work_id":"9f11b58f-27b0-4ec3-8633-6bebfc2e6d20","year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.147018Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:49d3db9c9e26af74beae1277557a2f3f94d814c81584f6228626b6611c0bbc38","observation_id":"99cd782e-ebd4-4b5d-b117-aead3bfaeb30","resolution":{"observed_at":"2026-08-10T17:00:33.357682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.16391","last_updated":"2026-03-27T17:20:10Z","snapshot_observed_at":"2026-08-18T13:02:41.347839Z","submitted_at":"2026-03-27T17:20:10Z","title":"Disentangled Robot Learning via Separate Forward and Inverse Dynamics Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.16391","snapshot_observed_at":"2026-08-10T17:00:32.150720Z","title":"Disentangled robot learning via separate forward and inverse dynamics pretraining.arXiv preprint arXiv:2604.16391, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.150720Z"},"links":{"cited_paper":"/paper/2604.16391","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:daea2721e91570cb70d753c8496fefe79a6a0e808ff5c0253135310967742438","observation_id":"bfea0b02-a55d-4e3c-846b-508ef041af5b","resolution":{"observed_at":"2026-08-10T17:00:32.150720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.19531","last_updated":"2026-06-17T19:25:28Z","snapshot_observed_at":"2026-08-17T04:58:30.005341Z","submitted_at":"2026-06-17T19:25:28Z","title":"ImageWAM: Do World Action Models Really Need Video Generation, or Just Image Editing?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.19531","snapshot_observed_at":"2026-08-10T17:00:32.154491Z","title":"Imagewam: Do world action models really need video generation, or just image editing?arXiv:2606.19531, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.154491Z"},"links":{"cited_paper":"/paper/2606.19531","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:044816a9760364f53dc0af6575a6b9f11e5da825a0fd7476fd665b6fba340473","observation_id":"6bdda776-9213-4af2-be0e-deff1fb38ecc","resolution":{"observed_at":"2026-08-10T17:00:32.154491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20834","last_updated":"2026-04-24T16:37:03Z","snapshot_observed_at":"2026-08-16T00:09:40.807956Z","submitted_at":"2026-04-22T17:58:19Z","title":"PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20834","snapshot_observed_at":"2026-08-10T17:00:32.158080Z","title":"Pokevla: Empowering pocket-sized vision- language-action model with comprehensive world knowl- edge guidance.arXiv:2604.20834, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.158080Z"},"links":{"cited_paper":"/paper/2604.20834","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:8a06fa931ce8c972ea4387666b280db04b720f535a4e52e416bc103fc82f0630","observation_id":"36bf5c5b-745a-4ec5-8b1e-c7af6b8932f6","resolution":{"observed_at":"2026-08-10T17:00:32.158080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12377","last_updated":"2024-04-18T17:58:03Z","snapshot_observed_at":"2026-08-12T22:44:50.325579Z","submitted_at":"2024-04-18T17:58:03Z","title":"RoboDreamer: Learning Compositional World Models for Robot Imagination","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12377","snapshot_observed_at":"2026-08-10T17:00:32.161827Z","title":"Robodreamer: Learn- ing compositional world models for robot imagination","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.161827Z"},"links":{"cited_paper":"/paper/2404.12377","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:d9ad3320c6081d64946f319595ccda6d0046bdfc12f39d6f6cdf6b1e43e6ef53","observation_id":"d082f207-2c9e-4f11-8006-8a14a84e2501","resolution":{"observed_at":"2026-08-10T17:00:32.161827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-08-10T02:54:28.264405Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-08-10T17:00:32.165777Z","title":"Unified world models: Coupling video and action diffusion for pre- training on large robotic datasets.arXiv:2504.02792, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.165777Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:e5075b0c5a09152cb867478198066699f636ea55e471d5ed50b5ac7d905d0c57","observation_id":"2dcbf5ef-d4e0-40ec-b0aa-e1535291878c","resolution":{"observed_at":"2026-08-10T17:00:32.165777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.343382Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":"36ddba88-766a-4d7c-b145-e63ca0b0d1de","year":2023},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.169373Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:cceb50a898cb283b82bee1e5cc0301f3090e6e5a79d30120332de9aaa0d68387","observation_id":"5a6b1494-60d9-4c7b-8378-ce9676f56153","resolution":{"observed_at":"2026-08-10T17:00:33.347097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.332235Z","title":"imagining","venue":null,"work_id":"f7a28f5f-1956-4713-85ac-f064f7241374","year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.173443Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:663673577faa5b83a850c09e55e02f674d09f6956a454ccc08b41d5e73eba90b","observation_id":"a6207a0c-c9a8-40ec-96a5-d613bab44224","resolution":{"observed_at":"2026-08-10T17:00:33.335804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:00:33.318480Z","title":"Training Algorithm Algorithm 1 details the full training procedure of W AM- VJEPA","venue":null,"work_id":"5f71e296-8af9-4571-8774-0e88cc1baed6","year":null},"citing_paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:32.177370Z"},"links":{"citing_paper":"/paper/2608.06994"},"observation_digest":"sha256:eacb033dfdfefc3e62dfb9cc0572f65c995ec37baeefa223503b0d427754b77f","observation_id":"0fc43aa2-19cc-42b0-bc4d-677dc1d5319e","resolution":{"observed_at":"2026-08-10T17:00:33.323517Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06994","last_updated":"2026-08-07T09:12:15Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-19T06:02:17.667459Z","submitted_at":"2026-08-07T09:12:15Z","title":"Decoupling Intention from Trajectory: A Representational Deduction Framework for World Action Models"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2608.06994."}