{"as_of":"2026-08-06T20:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b48a0d75829ac7d27262ecf6b4a6b42792bf51ff28384479056dbb61ed1336a8","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:44:15.613713Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18231/citation-record","integrity":"/paper/2607.18231/integrity","json":"/paper/2607.18231/citation-record.json","paper":"/paper/2607.18231"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-01T15:44:10.478396Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.478396Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:06aa240c9cb4f8041b3d32fdf93f5fa9ab18f98535e7b78f278bf93077edd71e","observation_id":"27a601c9-fb8d-45f9-8f24-8035793ffe50","resolution":{"observed_at":"2026-08-01T15:44:10.478396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-01T15:44:10.512756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.512756Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:15f5a5472c2fbd4d28d4c68d88329f102d58b1084c8147c23381342c304e2ee8","observation_id":"6bb13ed8-c4a7-482f-9830-158c6aa95452","resolution":{"observed_at":"2026-08-01T15:44:10.512756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-01T15:44:10.612101Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.612101Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:79128966e21dee01f9c4d76dcf4f248d02ce7975a091e539d37337534c2561e8","observation_id":"9cf63ea2-ca55-41f0-a1eb-6c87aa7e2232","resolution":{"observed_at":"2026-08-01T15:44:10.612101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-01T15:44:10.713098Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.713098Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:a9397773f203f659659b2ac8332002e13cab17e0613d94477bc1008e5a3e9640","observation_id":"6f820b95-3942-41c1-b091-52d42c087dc7","resolution":{"observed_at":"2026-08-01T15:44:10.713098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19236","last_updated":"2026-01-30T13:36:22Z","snapshot_observed_at":"2026-07-06T22:19:00.152099Z","submitted_at":"2025-08-26T17:57:16Z","title":"MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19236","snapshot_observed_at":"2026-08-01T15:44:10.802477Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.802477Z"},"links":{"cited_paper":"/paper/2508.19236","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:3d7c713fab9d130ececaa91260aa0a5f1d2cff407acd48cd0a9374c1bd669c86","observation_id":"a5a7b4b1-2220-48ac-aa07-e7a3b467db89","resolution":{"observed_at":"2026-08-01T15:44:10.802477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:10.903656Z","title":"Torne, K","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:10.903656Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:006f0748501413dd3385bcd014dc1512e4e7079cb64c7f4bc5dca616bdc13438","observation_id":"b1d8a137-6161-4cf0-95f3-c1bd2ea79554","resolution":{"observed_at":"2026-08-01T15:44:10.903656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:11.012398Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.012398Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:6b34e25b16e290bc8ac8227ca397314ecbe729dfdfe8f96c506f116434f075ed","observation_id":"73153bf7-75e3-481b-9a43-128e786b9905","resolution":{"observed_at":"2026-08-01T15:44:11.012398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07962","last_updated":"2025-09-09T17:50:37Z","snapshot_observed_at":"2026-08-04T21:29:05.648300Z","submitted_at":"2025-09-09T17:50:37Z","title":"TA-VLA: Elucidating the Design Space of Torque-aware Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07962","snapshot_observed_at":"2026-08-01T15:44:11.064685Z","title":"Zhang, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.064685Z"},"links":{"cited_paper":"/paper/2509.07962","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:34bc09ab71b37e953e5e774e944fa3d860a7bce5ab0d87f93ace12151f588122","observation_id":"a1b23ed1-bb07-4b7f-ae82-289f4764333f","resolution":{"observed_at":"2026-08-01T15:44:11.064685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:11.175958Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.175958Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:2bf62c219546261023b3e9617478f190e8b13f3de2ea093ecbee66fb9d02956f","observation_id":"e53b174f-0af6-41e8-bda6-44388980fcff","resolution":{"observed_at":"2026-08-01T15:44:11.175958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-01T15:44:11.364259Z","title":"Jaegle, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.364259Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:f48cb94e43aa10970570618d02969f4e67b9bde6320c208afe4fc720f7f1f7a3","observation_id":"c84246eb-7904-4c1c-8879-e5914e9e3cb2","resolution":{"observed_at":"2026-08-01T15:44:11.364259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-01T15:44:11.496958Z","title":"Steiner, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.496958Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:c4697cfc5346c8e1e3c218d4aa6c0697b56cb96c0dcb63b2f4cd5a91614d3ed9","observation_id":"9f7fba3e-51c1-42e7-9dd7-9659f5010b8d","resolution":{"observed_at":"2026-08-01T15:44:11.496958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-01T15:44:11.610124Z","title":"Comanici, E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.610124Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:070f48c7e79fbd0a8f086e331f0bb57bdbad13b31757803d5e666b37398ff09a","observation_id":"37c70f22-b828-42dc-94e4-ecbb4212a120","resolution":{"observed_at":"2026-08-01T15:44:11.610124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T15:44:11.743801Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.743801Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:8a2968802a800e5366a8cd8b2bdef92abe2816944a70d40b2ff4dbba5aaa6772","observation_id":"4273a034-b16f-46d6-82da-324e5b0716b3","resolution":{"observed_at":"2026-08-01T15:44:11.743801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-01T15:44:11.850482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.850482Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:70c577c508ccec02a3b5be187e934788bb42aca6b7fad8eebd044a666718783c","observation_id":"a566d980-af4e-4604-8ba7-be8a0e94ca71","resolution":{"observed_at":"2026-08-01T15:44:11.850482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-02T07:15:58.798604Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-01T15:44:11.960573Z","title":"Gemini Robotics: Bringing ai into the physical world.arXiv preprint arXiv:2503.20020, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:11.960573Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:718bd3fa26648154f2b8d995182c1eb90e426ace86a0f1a2fb5573a5cd5cbc4b","observation_id":"eed5b32e-a08c-4069-9ee4-b23cc0f51dff","resolution":{"observed_at":"2026-08-01T15:44:11.960573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-01T15:44:12.074872Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.074872Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:c0029113d461e993de54b633fc846cee0de85f715dfc3f1c0573734dc6c48ad2","observation_id":"15df2116-1fa0-49b2-a56c-ecfe2d63be22","resolution":{"observed_at":"2026-08-01T15:44:12.074872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-01T15:44:12.220954Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.220954Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:3176ec33d2a94046c020e01c860773cfa91e02fa36e8f7a04d6c6ccd248a2fa2","observation_id":"4ea5cd20-8b27-45f0-a882-fa487dfd3ca2","resolution":{"observed_at":"2026-08-01T15:44:12.220954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-01T15:44:12.320548Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.320548Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:dcac9159cbf90184acc9a72a69add1446f6bacb4a5f1cea7a16c47043fd7849d","observation_id":"3848fd6e-9ea5-4072-a5ed-95ea6ea758c7","resolution":{"observed_at":"2026-08-01T15:44:12.320548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-08-01T15:44:12.468644Z","title":"Cheang, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.468644Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:ee4e7cbabd991c2a130a0d915d7e0bf722b86efd223c2a428f1fe8f3fcfa2d07","observation_id":"f0c6eb69-92c8-4272-b4af-c563b659582e","resolution":{"observed_at":"2026-08-01T15:44:12.468644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:12.618627Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.618627Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:522d8d6f8e031e5285490b7d397a06197303c0c6860419c05ca1bb225e987906","observation_id":"77d5d839-c2e7-4957-910a-cc413d6f1906","resolution":{"observed_at":"2026-08-01T15:44:12.618627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:12.719003Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.719003Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:f85c1334017b07fcc5f8f777d6c8166db946ab1cb3f4c9b735b1e0e70e5f5803","observation_id":"05b5a359-c7df-4fde-bd44-3cb3db726c1e","resolution":{"observed_at":"2026-08-01T15:44:12.719003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-02T18:49:49.564552Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-08-01T15:44:12.793735Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.793735Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:6addc4d60cbd0326520dc0ecf30c9f97a7bbcca0a36b34afd66fcf8339378003","observation_id":"23dc111f-4928-4937-8559-dfddb2a5807e","resolution":{"observed_at":"2026-08-01T15:44:12.793735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:12.866931Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.866931Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:bc7bdb290524cf3093935c01b376347761a6632bedd6860bba225dd74324df39","observation_id":"7ad018c6-af90-4a51-8945-8adb9b306928","resolution":{"observed_at":"2026-08-01T15:44:12.866931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:13.020505Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.020505Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:348aa9444795be0ff58a13f8e5a2f241946905b0918df759964de60f40e7ebda","observation_id":"8773cf13-7cae-492d-ac5a-41240aea4ede","resolution":{"observed_at":"2026-08-01T15:44:13.020505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.21013","last_updated":"2026-05-29T17:02:38Z","snapshot_observed_at":"2026-08-02T21:12:09.620600Z","submitted_at":"2026-02-24T15:30:55Z","title":"Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.21013","snapshot_observed_at":"2026-08-01T15:44:13.140820Z","title":"Haresh, D","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.140820Z"},"links":{"cited_paper":"/paper/2602.21013","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:b8d869bbe2102cac7f11a3fbdf279f4e5129ecf71332f68b7528d371c6b70f0a","observation_id":"1dcf2d66-6526-485d-8270-80bd725c1ba1","resolution":{"observed_at":"2026-08-01T15:44:13.140820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:13.256638Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.256638Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:4f73c5a36a78202a07100c7f32ea52c6402ddd70e3d8b76c592e4268e865b9f8","observation_id":"4e1b70c3-153a-4e96-ba52-da5d16eb190f","resolution":{"observed_at":"2026-08-01T15:44:13.256638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:13.394550Z","title":"Chung, T","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.394550Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:aef0f69731630a8b161cf2846bc749119d1b7f885293e4659ab5821c9de5ddf1","observation_id":"279d041e-0499-4a3d-b8f8-46bf3df1ffb6","resolution":{"observed_at":"2026-08-01T15:44:13.394550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11048","last_updated":"2026-05-11T13:27:00Z","snapshot_observed_at":"2026-07-06T23:22:57.012338Z","submitted_at":"2026-05-11T13:27:00Z","title":"ForceFlow: Learning to Feel and Act via Contact-Driven Flow Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11048","snapshot_observed_at":"2026-08-01T15:44:13.539964Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.539964Z"},"links":{"cited_paper":"/paper/2605.11048","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:87c8177206532a589d51e58880e3d6fd1f7d84200c759e165241f747f5ee7093","observation_id":"a259a3fc-b618-47b1-afb0-b10cf73ddd33","resolution":{"observed_at":"2026-08-01T15:44:13.539964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:13.727588Z","title":"Zhang, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.727588Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:fb4530089772328e0286d28f5cd9a3fc190d1bbec493aa76c6c556d729da5754","observation_id":"da04747d-ef98-40c5-b2f0-1baa741af685","resolution":{"observed_at":"2026-08-01T15:44:13.727588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:13.914624Z","title":"Gubernatorov, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:13.914624Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:59a5801f1fdd9458d059a4500fc711c2b7e59860b461d902dbd05084785fde22","observation_id":"b19b268c-4432-48ee-bb2e-7e99ce8f3edd","resolution":{"observed_at":"2026-08-01T15:44:13.914624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07308","last_updated":"2026-05-18T04:08:11Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:17:08Z","title":"AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07308","snapshot_observed_at":"2026-08-01T15:44:14.060974Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.060974Z"},"links":{"cited_paper":"/paper/2605.07308","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:766f55c5b1f730e5ae05acec09a5403695de95cf22d7b28c50f03982d7b121ae","observation_id":"06e74158-77d4-400c-a8f8-4b443df136a9","resolution":{"observed_at":"2026-08-01T15:44:14.060974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:14.168248Z","title":"Huang, P","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.168248Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:5569025b81e54b9eeb6e197213ee24b09a75e5895a37e919ec026e5f715b23fd","observation_id":"6a3105d1-fa37-4c8e-8b0d-c1d5383ba08f","resolution":{"observed_at":"2026-08-01T15:44:14.168248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-06T02:46:39.750824Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-01T15:44:14.315740Z","title":"Zhang, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.315740Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:0ab767726a07a1417c7a1db20337b099799fc753989dbf7f1946864a5792c7a9","observation_id":"0be13bcd-9d77-4c44-befc-92e4441947ba","resolution":{"observed_at":"2026-08-01T15:44:14.315740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23864","last_updated":"2026-06-28T00:20:33Z","snapshot_observed_at":"2026-08-03T13:35:53.078536Z","submitted_at":"2025-12-29T21:06:33Z","title":"Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.23864","snapshot_observed_at":"2026-08-01T15:44:14.482881Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.482881Z"},"links":{"cited_paper":"/paper/2512.23864","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:bb08c1b18f2cc849fae267051822e4d4e6b9b2bf9596268ceac640593c58a189","observation_id":"5ebe75ed-773b-4d1c-93fb-690b33c8a1f5","resolution":{"observed_at":"2026-08-01T15:44:14.482881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-05T10:06:10.880743Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-01T15:44:14.694147Z","title":"Beyer, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.694147Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:3255956bbc4d21d9a30f3fdf14aa20fdbb529a5724bcb2db25d15888a923fcf8","observation_id":"39dcb036-722c-4923-8ae0-c2060b213662","resolution":{"observed_at":"2026-08-01T15:44:14.694147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-01T15:44:14.870038Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.870038Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:d9a0602c27405f9c8b9043e6389d4f8da5bb760ed7e101bf6c64351bd43c2128","observation_id":"b93c0780-29fa-4cf3-81f9-4ab214eeda50","resolution":{"observed_at":"2026-08-01T15:44:14.870038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-01T15:44:15.116574Z","title":"Lipman, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.116574Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:808fb2c0b1eb8d7c60f272e8f65081e63bc248737b45a7dbf6c226ef0100cdc8","observation_id":"b7398747-8169-4c3d-b526-5be0299ecce8","resolution":{"observed_at":"2026-08-01T15:44:15.116574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-01T15:44:15.243582Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.243582Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:79e0e1569253cee06007b24b58c8870df607a9df8a3f19607aedbf27be2c5b00","observation_id":"42a522ff-2d6a-49c1-abdc-3e3d09c51d7f","resolution":{"observed_at":"2026-08-01T15:44:15.243582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:15.353962Z","title":"Agibot g1 humanoid robot.https://www.agibot.com/products/G1,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.353962Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:1a60b41950527a3a929a19161c141045e1098830c24fec312fd715190c010e17","observation_id":"5a026672-5c2e-4302-874a-245a736e8bdd","resolution":{"observed_at":"2026-08-01T15:44:15.353962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3555","last_updated":"2014-12-11T06:46:53Z","snapshot_observed_at":"2026-08-03T11:40:51.182181Z","submitted_at":"2014-12-11T06:46:53Z","title":"Empirical Evaluation of Gated Recurrent Neural Networks on Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3555","snapshot_observed_at":"2026-08-01T15:44:15.520110Z","title":"Chung, C ¸","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.520110Z"},"links":{"cited_paper":"/paper/1412.3555","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:7d1b01dc624dd4894d820f3e72c1361c73c8d2365b6e9718d714ae892faa9e49","observation_id":"3ba81507-324e-4d0c-b5c9-0dcff3fb08f8","resolution":{"observed_at":"2026-08-01T15:44:15.520110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-01T15:44:15.613713Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.613713Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:61006b9d749728a81cb14cf86fa20846a2053d1c81b09416d9d54c01c11c5d74","observation_id":"6e23a91b-a454-418d-849e-d64d3295ded2","resolution":{"observed_at":"2026-08-01T15:44:15.613713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:44:15.462704Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:15.462704Z"},"links":{"citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:5b99a49826ae047c8e6626023d62740e87adbdb5ab9d601b32c7a87fb6914cc0","observation_id":"549e009b-4dd1-4faa-92d1-6622371c818f","resolution":{"observed_at":"2026-08-01T15:44:15.462704Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2607.18231."}