{"as_of":"2026-08-04T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e486fec2efbbe30e8f841cc21c8df20f5d331e082836b188d84d0792895df7bb","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T21:58:48.611343Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T20:46:04.923901Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T20:46:04.923901Z","title":"Demavla: A vision-language-action foundation model for generalizable deformable manipulation.arXiv preprint arXiv:2605.31286,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04234","last_updated":"2026-07-05T11:12:29Z","snapshot_observed_at":"2026-07-11T20:46:04.581079Z","submitted_at":"2026-07-05T11:12:29Z","title":"SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T20:46:04.923901Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.04234"},"observation_digest":"sha256:37605861e43ca29f8f70583cff0a4bf4198c6d592b49ea355773dd3ac7078655","observation_id":"a8523749-3fbd-4682-9e55-639488fd01b0","resolution":{"observed_at":"2026-07-11T20:46:04.923901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T11:21:18.588143Z","title":"DeMaVLA: A vision-language-action foundation model for generalizable deformable manipulation.arXiv preprint arXiv:2605.31286, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04927","last_updated":"2026-07-06T10:57:01Z","snapshot_observed_at":"2026-08-02T00:23:14.479389Z","submitted_at":"2026-07-06T10:57:01Z","title":"DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T11:21:18.588143Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.04927"},"observation_digest":"sha256:5dd429273fce0500a7e8b7482fb13318e6c93389a2cc399f81d27c1617821835","observation_id":"f8f84011-ab4c-4c8d-a5ac-eb0591ac4d79","resolution":{"observed_at":"2026-07-11T11:21:18.588143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T14:23:57.266710Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05468","last_updated":"2026-07-06T07:10:22Z","snapshot_observed_at":"2026-07-11T14:23:54.006633Z","submitted_at":"2026-07-06T07:10:22Z","title":"Learning 4D Geometric Priors for Inference-Efficient World Action Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-11T14:23:57.266710Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.05468"},"observation_digest":"sha256:04c5770232b083433208767aa5de7f71796b3d774d5340e4d16c876611ad15e4","observation_id":"1ccb8264-a599-42c5-bf2e-e74afb398eb1","resolution":{"observed_at":"2026-07-11T14:23:57.266710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.31286/citation-record","integrity":"/paper/2605.31286/integrity","json":"/paper/2605.31286/citation-record.json","paper":"/paper/2605.31286"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:4b49b4b27e91bcb0892a05b361702ca13c2aed4012666cec2af3cd5514b7e346","observation_id":"d31bef59-942d-4b01-b1d9-40da007ba36e","resolution":{"observed_at":"2026-07-01T19:56:10.394231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-04T10:58:38.750074Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":"2407.07726","doi":"10.48550/arxiv.2407.07726","metadata_source":"pith","pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-07-10T23:37:43.136584Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":"cs.CV","work_id":"df6f48b3-5792-47c7-9614-cb856ea31ad9","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:17f39195e5db06b398b611e1f9651e604c4b3b9eb7936254bfb1144a05fbf076","observation_id":"dc6a7625-44a6-42e1-9a5b-c858f355c4d5","resolution":{"observed_at":"2026-07-01T19:56:10.428612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":"2503.14734","doi":"10.48550/arxiv.2503.14734","metadata_source":"pith","pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-10T23:07:47.672265Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","venue":"cs.RO","work_id":"e2db69c7-ee8a-4cb7-a761-7b8de1dfcf97","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:2fbdf19335a6dc32f144a01387b41b37d75bab937d38d177251ff04b66dd9c61","observation_id":"d86c246f-5270-4827-81ed-4d82d80fa67e","resolution":{"observed_at":"2026-07-01T19:56:10.340717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-11T00:07:42.817654Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:86381416d9633303bbba5d11f6855b67ba93c5ba1d4b10ed9f27559a00228e14","observation_id":"86a0d7f4-aa26-40ff-a8cb-1ff68843b1dd","resolution":{"observed_at":"2026-07-01T19:56:10.423826Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.592261Z","title":"Training-time action conditioning for efficient real-time chunking","venue":null,"work_id":"6020f742-1ba8-46fa-9efb-b9088733c37a","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:75cb8916ba287dc1633e24ddd5faf2a999b7cdcf5aeda4949113cc240d763b66","observation_id":"b8b71efe-b976-4e16-8f61-badf360c53e5","resolution":{"observed_at":"2026-07-01T19:56:10.412825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Real-time execution of action chunking flow policies.Advances in Neural Information Processing Systems, 38:33383–33407, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:c2ef7b9f64e138fdb4f8eeb43c0aed55b84fbd6441f41e5a564a0864d3217265","observation_id":"3baeb24a-5909-4a9a-9bb7-c2ffca01c367","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:07:47.711193Z","title":"arXiv preprint arXiv:2602.12684 (2026)","venue":null,"work_id":"d4ca4245-5a33-487c-83b0-988ef4c60db7","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:11fbb544cec59167a912fecea3b65998d78a6061396b8fb9f7afcce10934c407","observation_id":"0bc8d3e1-d01f-4537-93fe-2d7e6d1492b5","resolution":{"observed_at":"2026-07-01T19:56:10.421785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Interactive imitation learning in robotics: A survey.Foundations and Trends®in Robotics, 10(1-2):1–197, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:f82fb7deb31eec565983a396321eced62200d776d8d73b6b74c77033aa200467","observation_id":"3b44f106-5c57-48d6-bd86-8313d80eb5d9","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17502","last_updated":"2026-05-30T03:49:39Z","snapshot_observed_at":"2026-08-03T20:59:48.866420Z","submitted_at":"2025-11-21T18:59:32Z","title":"RynnVLA-002: A Unified Vision-Language-Action and World Model","version":3},"cited_work":{"arxiv_id":"2511.17502","doi":"10.48550/arxiv.2511.17502","metadata_source":"pith","pith_arxiv_id":"2511.17502","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Rynnvla-002: A unified vision-language-action and world model","venue":"cs.RO","work_id":"f28355c2-726f-4492-899f-be74df2c09cd","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.17502","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:26721f0164ae04766a55df9ce2e6363dfb893bb266a8bd4818c3c07747617ce2","observation_id":"649ee648-8e63-44a7-8195-f24c1d4bb078","resolution":{"observed_at":"2026-07-01T19:56:10.427156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-07-06T22:00:18.950986Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":"2507.15493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-07-10T04:16:48.751910Z","title":"GR-3 Technical Report","venue":"cs.RO","work_id":"7f3b800b-0146-4c37-b178-0801cd4270db","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:0792dace45ff598fbebc853beeb078c799c361f3dd1d9db28e8e9d55f0835e7b","observation_id":"3546b866-9125-46e2-872e-6903d860429e","resolution":{"observed_at":"2026-07-01T19:56:10.424772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.18088","doi":"10.48550/arxiv.2506.18088","metadata_source":"pith","pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-07-10T23:17:45.135806Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","venue":"cs.RO","work_id":"9b985126-4a2f-4bdf-b014-2a7524ec634e","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:95df3637bb3f1129cdff435c9925ddb81d433ff37098be7a79c28c3d7fd1b862","observation_id":"baae2a12-7ed8-416f-a29f-65fc208ddc12","resolution":{"observed_at":"2026-07-01T19:56:10.429643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05014","last_updated":"2026-04-06T17:59:21Z","snapshot_observed_at":"2026-07-06T22:53:51.418227Z","submitted_at":"2026-04-06T17:59:21Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","version":1},"cited_work":{"arxiv_id":"2604.05014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05014","snapshot_observed_at":"2026-07-10T07:26:54.478996Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","venue":"cs.RO","work_id":"e9be5436-00f8-4b43-b82a-ff154145e079","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2604.05014","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:ddc7c72650ad2828af6d45bdc94495327538cefa6f932467ce48d95ab079052c","observation_id":"69b1b96c-2985-4494-996b-88bd41ff2eaf","resolution":{"observed_at":"2026-07-01T19:56:10.379180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":"2401.02117","doi":"10.48550/arxiv.2401.02117","metadata_source":"pith","pith_arxiv_id":"2401.02117","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","venue":"cs.RO","work_id":"5f6ff8ef-ed80-4c00-92c2-361c80bf8448","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2401.02117","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:13823e4dadc671234b19f2c6252bff864aed8984ff8c675b0aed6d0b2bfc8ed4","observation_id":"00efa83e-7c76-44d8-ae8b-4b4977cf3de8","resolution":{"observed_at":"2026-07-01T19:56:10.381185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08273","last_updated":"2021-09-17T01:21:16Z","snapshot_observed_at":"2026-07-06T11:48:35.206160Z","submitted_at":"2021-09-17T01:21:16Z","title":"ThriftyDAgger: Budget-Aware Novelty and Risk Gating for Interactive Imitation Learning","version":1},"cited_work":{"arxiv_id":"2109.08273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.08273","snapshot_observed_at":"2026-07-03T12:48:11.111034Z","title":"Thriftydagger: Budget-aware novelty and risk gating for interactive imitation learning","venue":null,"work_id":"f1678abd-ca2e-4c2f-a858-081c1f0fbc23","year":2021},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2109.08273","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:5d51e58228cacb9e2e2b2548255cb15e855d06d1e66941a3d88b3395ea52eb2d","observation_id":"5b63e49f-108f-4948-98ab-13e3850f0b70","resolution":{"observed_at":"2026-07-01T19:56:10.409160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07953","last_updated":"2025-09-09T17:41:29Z","snapshot_observed_at":"2026-08-04T21:32:53.985511Z","submitted_at":"2025-09-09T17:41:29Z","title":"RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction","version":1},"cited_work":{"arxiv_id":"2509.07953","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07953","snapshot_observed_at":"2026-07-03T12:28:07.233597Z","title":"Rac: Robot learning for long-horizon tasks by scaling recovery and correction","venue":null,"work_id":"0d6ddd41-d7e6-4fb7-aa20-a1a734ca73cb","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2509.07953","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:73da2b7cd6b89d864997c757c8a6120ebf62bb4cb61cec1005c19430cc52ae59","observation_id":"f3531602-0d1b-40cc-8a46-a9a56b74f387","resolution":{"observed_at":"2026-07-01T19:56:10.410282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:2e7ce2ea2a234543ad454665ee37caf73344b59fea761548a5f07afc5a5526dd","observation_id":"f25ab638-847b-491d-a10f-6304913606e0","resolution":{"observed_at":"2026-07-01T19:56:10.403716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":"2504.16054","doi":"10.1609/aaai.v40i28.39562","metadata_source":"pith","pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","venue":"cs.LG","work_id":"d1ad7304-d09a-49bc-809e-846439f6aff9","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:299ec68c3777ddbed043feef3d21c4b1068dd632409e43a60fcf0f4ebfb7ad47","observation_id":"6502b855-75d6-437b-b569-94d3fa4dfb64","resolution":{"observed_at":"2026-07-01T19:56:10.398578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-07-06T22:21:09.483995Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:5fa9bf87e7c477d6fd62a5fabb6f8db66c1252b69140244d2678e04486954b67","observation_id":"5f1ceea0-ab82-46d1-80f0-3a8b7b3fb9e9","resolution":{"observed_at":"2026-07-01T19:56:10.401207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Hg-dagger: Interactive imitation learning with human experts","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:3a74791ca7ad7d799c3bb0993ae596981c0b727a5fe789edf481f63ece9e3ad9","observation_id":"9971aaf8-5eb7-4986-a1e1-84f9dcfa6e4b","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:6797311ef2858c261943790c89382e12eb61af8f604918c8f995056eabde34e0","observation_id":"661eb9c4-c784-4ecd-9c89-3e375c28f63c","resolution":{"observed_at":"2026-07-01T19:56:10.426409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Reinforcement learning with augmented data.Advances in neural information processing systems, 33:19884–19895, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:7c41ba2c61f7254a7b6426ff57557c279c63021a43395f622ebda10d575c0c0b","observation_id":"c6209d33-3571-4bce-b111-00e70158b444","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10341","last_updated":"2022-02-17T06:29:46Z","snapshot_observed_at":"2026-07-06T12:39:58.089353Z","submitted_at":"2022-02-17T06:29:46Z","title":"Efficient Learning of Safe Driving Policy via Human-AI Copilot Optimization","version":1},"cited_work":{"arxiv_id":"2202.10341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.10341","snapshot_observed_at":"2026-07-01T19:56:10.416267Z","title":"Efficient learning of safe driving policy via human-ai copilot optimization","venue":null,"work_id":"1cf5f451-ec83-49bc-9711-3b28ade4c3e4","year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2202.10341","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:379ec4762bc3820a39c12d9e59b1c0e499c9f83b6a7070b69bc5e114c83e337d","observation_id":"b2c245e3-e9de-43e1-a95d-67ed23389d15","resolution":{"observed_at":"2026-07-01T19:56:10.417816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:40:00.364043Z","title":"Gr-rl: Going dexterous and precise for long-horizon robotic manipulation","venue":null,"work_id":"4f346bfa-1c16-4774-8008-440611a77af7","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:91012d635647d8877a81e5beefc99c02b4330f3c29bfc8b0884eed6686399fae","observation_id":"303ed987-7efa-4c1f-9f94-64bdbeb09045","resolution":{"observed_at":"2026-07-01T19:56:10.396125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12062","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:26:10.991036Z","title":"HoloBrain-0 technical report","venue":null,"work_id":"ae9c3bee-5775-4997-a93a-47049c7cab3e","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:83d24891ed880c5c81eea01c73c727fba8cd1e22208505e4c36e4d5cd692ff8f","observation_id":"7efd9857-db2a-4235-adf5-185c32fc30f5","resolution":{"observed_at":"2026-07-01T19:56:10.374801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:08d17debde55d743892d9b2863a0a7968875262e5755c2f46954eba935eb022f","observation_id":"0bfdb06d-9720-4581-ae5d-4454bc18913c","resolution":{"observed_at":"2026-07-01T19:56:10.361856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12993","doi":"10.48550/arxiv.2601.12993","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Being-h0","venue":null,"work_id":"2c66b688-268c-4501-bc7a-88376b03d92f","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:2779e2893fce77d74ffaa0a23e4a67fe9e14d1b6a484c49fe26946ec2b8b7c85","observation_id":"e0dcd32a-d2b5-437d-931b-7a0379f56b7d","resolution":{"observed_at":"2026-07-01T19:56:10.387419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06733","last_updated":"2020-12-12T05:30:35Z","snapshot_observed_at":"2026-07-06T10:23:43.246202Z","submitted_at":"2020-12-12T05:30:35Z","title":"Human-in-the-Loop Imitation Learning using Remote Teleoperation","version":1},"cited_work":{"arxiv_id":"2012.06733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.06733","snapshot_observed_at":"2026-07-04T13:09:50.357171Z","title":"Human-in-the-loop imitation learning using remote tele- operation","venue":null,"work_id":"d26db493-4fc8-4cd0-833f-2934093e0b1b","year":2012},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2012.06733","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:a75054f91982df777d8a266f074138e23ef81bb2834455ee7627885b330d6c3e","observation_id":"02bc5ddc-ea70-40d3-9c9f-bd502fcc6c9d","resolution":{"observed_at":"2026-07-01T19:56:10.370614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2501.09747","doi":"10.48550/arxiv.2501.09747","metadata_source":"pith","pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-07-10T11:47:02.947207Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","venue":"cs.RO","work_id":"83a8f966-6cfa-4f21-81f3-87440aae238f","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:bb84d8e0fd3853d4557f64acbe4a87e57220e272a5e7a17d3c63ffb058b5af18","observation_id":"6b0e00ea-2806-42c1-b3f1-4da682061fc8","resolution":{"observed_at":"2026-07-01T19:56:10.383901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:4babfbe66277a20b2378bc4cb14f7cb9105b8898a8739fb4dcbfda3d1392111e","observation_id":"282d1af0-5a82-4121-8dda-60230e9a3c7a","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12099","doi":"10.48550/arxiv.2602.12099","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:43.091462Z","title":"Gigabrain-0.5 m*: a vla that learns from world model-based reinforcement learning","venue":null,"work_id":"f07c9e2b-1cb9-49ef-b237-baf8dd3da0e4","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:26cb7bcab43e00c64381d7d91118a62345efc9ef6d0918683ca670921585d5b6","observation_id":"30b04f0f-7b75-4878-8525-60865447498e","resolution":{"observed_at":"2026-07-01T19:56:10.390427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07771","last_updated":"2025-03-10T18:52:54Z","snapshot_observed_at":"2026-07-06T20:50:14.273421Z","submitted_at":"2025-03-10T18:52:54Z","title":"RoboCopilot: Human-in-the-loop Interactive Imitation Learning for Robot Manipulation","version":1},"cited_work":{"arxiv_id":"2503.07771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07771","snapshot_observed_at":"2026-07-04T06:19:37.569345Z","title":"Robocopilot: Human-in-the-loop interactive imitation learning for robot manipulation","venue":null,"work_id":"704de9db-444f-4a85-9a6e-a8e9edc935e6","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2503.07771","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:f582cf25e55113d985023e6eeb88350945538e9ab3b4c4836a7b092bcbcd4d4d","observation_id":"144a15e2-87f3-4934-bac9-a89fd6d816c5","resolution":{"observed_at":"2026-07-01T19:56:10.411949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-08-03T03:53:18.422734Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":"2601.18692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-07-10T07:26:54.460833Z","title":"A Pragmatic VLA Foundation Model","venue":"cs.RO","work_id":"9b5a37fb-5c5d-4fbb-a804-d518173f2011","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:b5303eb478ec72cad9900b4db37280f9fe882f6364072db527d8ddd62f9e391b","observation_id":"a827281b-00c4-4db8-a95e-0a4cb8330a04","resolution":{"observed_at":"2026-07-01T19:56:10.415298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":"2602.11236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-07-08T07:14:45.378913Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","venue":"cs.CV","work_id":"30745958-0491-4e57-a989-e53b1a7fe19f","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:faf3692f7022e89b2b431aeff07f77ed74b1aefc266ed1f902a9d5ac56e8ef88","observation_id":"3226f6d6-6d58-4bd1-882d-ebfc51706b56","resolution":{"observed_at":"2026-07-01T19:56:10.393321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:10:07.664649Z","title":"χ0: Resource-aware robust manipulation via taming distributional inconsistencies","venue":null,"work_id":"4f11a14a-a1a6-4d0f-8175-106b806f50f2","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:761abdeaa57ada8fa0983d8f5ca43299aea6f765dd276ace93fd40dfffd94391","observation_id":"1e35cda1-f2a5-42f0-b844-59321df3fb55","resolution":{"observed_at":"2026-07-01T19:56:10.388956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.924974Z","title":"Igniting vlms toward the embodied space","venue":null,"work_id":"a0f111cf-bd1b-4bc6-ad3a-f8ffbc1045f4","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:f0cb2402f301d797d37bd7b1c65e805d02b0603624244b09160ddeb7ea2610ea","observation_id":"5d4ce01d-0765-4e20-a9ba-43dea1aa92a6","resolution":{"observed_at":"2026-07-01T19:56:10.376197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20100","last_updated":"2026-04-23T04:10:40Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:51:48Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","version":2},"cited_work":{"arxiv_id":"2604.20100","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20100","snapshot_observed_at":"2026-07-03T17:08:42.641379Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","venue":"cs.RO","work_id":"917f12b3-433d-4099-895a-95b79d353370","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2604.20100","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:46f8912ac95a7213d516cde4f5f05b1dfafb6fcdb6fdeb486c8b431ef97e8bb8","observation_id":"de67d6c5-8687-4df8-acd0-8354226005d1","resolution":{"observed_at":"2026-07-01T19:56:10.353861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2510.10274","doi":"10.48550/arxiv.2510.10274","metadata_source":"pith","pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-07-10T23:37:43.274860Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","venue":"cs.RO","work_id":"13faca8d-e96d-4e6c-a441-9f2683d11934","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:7604ef273221516767540ffda8b7171618708dd4d496df30d8c9316403d8df69","observation_id":"af956799-8209-4fc5-81da-52d926799d12","resolution":{"observed_at":"2026-07-01T19:56:10.363522Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:9ebe4ba576c26216e7ba7df01d546611c39ce437ca3ae6494e5dcaa30d565197","observation_id":"b3ef4f82-d55c-4413-bd89-f10d377a319c","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":31,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2605.31286."}