{"as_of":"2026-08-19T22:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d69b6837b6830357440f91dbea3d81f61a10a1eb10410d30b6fd0ac3cf88335a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:51:29.007610Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T11:18:32.259684Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:48:02.219705Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"cited_work":{"arxiv_id":"2603.15257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15257","snapshot_observed_at":"2026-08-04T02:30:26.749214Z","title":"Gubernatorov, M","venue":null,"work_id":"90ef3c1d-6ee4-4406-adc7-deeafbbd510e","year":2026},"citing_paper":{"arxiv_id":"2606.09337","last_updated":"2026-06-16T02:41:26Z","snapshot_observed_at":"2026-08-01T15:23:43.890468Z","submitted_at":"2026-06-08T11:05:05Z","title":"TORL-VLA: Tactile Guided Online Reinforcement Learning for Contact-Rich Manipulation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T16:30:35.385161Z"},"links":{"cited_paper":"/paper/2603.15257","citing_paper":"/paper/2606.09337"},"observation_digest":"sha256:ab1d6a876a5c946883f9085017627a275adab053cd4e3fefc8d166728a6e41aa","observation_id":"bf7bda18-d934-4cf0-96b5-a3773b699fe5","resolution":{"observed_at":"2026-08-04T02:30:26.749214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"cited_work":{"arxiv_id":"2603.15257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15257","snapshot_observed_at":"2026-08-04T02:30:26.749214Z","title":"Gubernatorov, M","venue":null,"work_id":"90ef3c1d-6ee4-4406-adc7-deeafbbd510e","year":2026},"citing_paper":{"arxiv_id":"2606.09777","last_updated":"2026-06-08T17:38:57Z","snapshot_observed_at":"2026-08-11T14:41:55.653504Z","submitted_at":"2026-06-08T17:38:57Z","title":"AetheRock: An Arm-Worn Robot Teaching System for Force-Guided Vision-Tactile Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T16:25:09.975308Z"},"links":{"cited_paper":"/paper/2603.15257","citing_paper":"/paper/2606.09777"},"observation_digest":"sha256:2a59fa5c9dcf3680b5557746dbeb08172b227b8bbc991fe8fb3168bc237f1a2d","observation_id":"04a6f155-1680-498e-aebf-e492e7f25f2c","resolution":{"observed_at":"2026-08-04T02:30:26.749214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"cited_work":{"arxiv_id":"2603.15257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15257","snapshot_observed_at":"2026-08-04T02:30:26.749214Z","title":"Gubernatorov, M","venue":null,"work_id":"90ef3c1d-6ee4-4406-adc7-deeafbbd510e","year":2026},"citing_paper":{"arxiv_id":"2606.11743","last_updated":"2026-06-10T07:20:36Z","snapshot_observed_at":"2026-08-04T03:57:45.233984Z","submitted_at":"2026-06-10T07:20:36Z","title":"TacCoRL: Integrating Tactile Feedback into VLA via Simulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T09:51:56.563479Z"},"links":{"cited_paper":"/paper/2603.15257","citing_paper":"/paper/2606.11743"},"observation_digest":"sha256:aaff56908f600a8ba2dea0b7204eb87066e73fa93c746a0605ca7f9f8201801c","observation_id":"42cf7704-7c5b-4249-8fe4-e70fb2fc7976","resolution":{"observed_at":"2026-08-04T02:30:26.749214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"cited_work":{"arxiv_id":"2603.15257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15257","snapshot_observed_at":"2026-08-04T02:30:26.749214Z","title":"Gubernatorov, M","venue":null,"work_id":"90ef3c1d-6ee4-4406-adc7-deeafbbd510e","year":2026},"citing_paper":{"arxiv_id":"2607.01067","last_updated":"2026-07-01T15:26:26Z","snapshot_observed_at":"2026-08-12T12:11:04.612463Z","submitted_at":"2026-07-01T15:26:26Z","title":"Human-Centric Transferable Tactile Pre-Training for Dexterous Robotic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T11:18:32.259684Z"},"links":{"cited_paper":"/paper/2603.15257","citing_paper":"/paper/2607.01067"},"observation_digest":"sha256:8562f17980646d6ce530b34d210289627d765e7e297fa6e2712c6270f7b2bf66","observation_id":"fc268539-8e45-4b54-953d-786e13894b7c","resolution":{"observed_at":"2026-08-04T02:30:26.749214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.15257/citation-record","integrity":"/paper/2603.15257/integrity","json":"/paper/2603.15257/citation-record.json","paper":"/paper/2603.15257"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-04T05:51:28.916443Z","title":"Open- vla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.916443Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:4bcd1042858f1fb9d2c8c7900974a00b470b011c53d8b625504dfe9bfd44ed33","observation_id":"90173b98-2b57-4275-b521-92a1c20a35f6","resolution":{"observed_at":"2026-08-04T05:51:28.916443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.920338Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.920338Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:3425740243c10108a0f301f8dbac6eb3e4a3cbc901cebecffd8318b3e60c8d90","observation_id":"c9f5b8ef-e4cf-4755-a4f5-1e9912d8bc60","resolution":{"observed_at":"2026-08-04T05:51:28.920338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-08-18T04:25:30.115862Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-04T05:51:28.926341Z","title":"Smolvla: A vision-language-action model for affordable and efficient robotics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.926341Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:6c9cb399a1fad9f0699ebed16ee563a6cdf42283c0bf8b081cf2e045622a4d25","observation_id":"b2bfa2a4-fe25-47e8-9a66-d4b92314ac36","resolution":{"observed_at":"2026-08-04T05:51:28.926341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-16T01:02:50.753208Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-04T05:51:28.929585Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.929585Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:befbb070397f48a6c6ce5c35128efe11d906fcf8a9f3af1f0175238b7b762ad2","observation_id":"6a1df052-d7e4-4675-8834-7f7842876603","resolution":{"observed_at":"2026-08-04T05:51:28.929585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.932642Z","title":"Mla: A multisensory language-action model for multimodal understanding and forecasting in robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.932642Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:001c14674e21362c1024c9cdde7b0ad69efa8977a6c4ab0037b2c4810d58121a","observation_id":"85657e0f-0277-4968-a106-3d9a25dd5081","resolution":{"observed_at":"2026-08-04T05:51:28.932642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.935435Z","title":"Omnivtla: Vision-tactile-language-action model with semantic-aligned tactile sensing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.935435Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:6d0f248bbb2b47694a28d679e448beabd53aac4094e109cffe34b67b94c39977","observation_id":"a234c51b-a5a4-4914-93f5-1c1eaa662f62","resolution":{"observed_at":"2026-08-04T05:51:28.935435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17294","last_updated":"2025-07-29T12:31:26Z","snapshot_observed_at":"2026-08-16T06:51:33.134350Z","submitted_at":"2025-07-23T07:54:10Z","title":"VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17294","snapshot_observed_at":"2026-08-04T05:51:28.938119Z","title":"Vla-touch: Enhanc- ing vision-language-action models with dual-level tactile feedback,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.938119Z"},"links":{"cited_paper":"/paper/2507.17294","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:ed4770dceafe0f850e43d65e2fc8fff6e7251df3ec1da024cb8540dd278abf45","observation_id":"c0ccf6e2-76ee-4597-87b5-6dddd07bf8dd","resolution":{"observed_at":"2026-08-04T05:51:28.938119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.941171Z","title":"Bitla: A bimanual tactile-language-action model for contact-rich robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.941171Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:0ef83babe9863fc5e8bfe075e8299f374f71f340888f1a2cfa29c8f22c0c4cb8","observation_id":"6d7e7467-b108-4023-931e-581d186e49b9","resolution":{"observed_at":"2026-08-04T05:51:28.941171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.943832Z","title":"Beyond sight: Finetuning generalist robot policies with heterogeneous sensors via language grounding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.943832Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:cc13a645cf089bf0acd24bfb202b23e7a34bee446e77d7f7f95feac0856bbff7","observation_id":"2b85a9a1-1677-46fa-8d23-f90661ec4f76","resolution":{"observed_at":"2026-08-04T05:51:28.943832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.946361Z","title":"Forcevla: Enhancing vla models with a force-aware moe for contact-rich manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.946361Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:1654a50d8fe32c29d3aeb9136a1a4d601f173aaf9ca7266ff837456085c34729","observation_id":"9fccd402-5dfb-416b-aec3-60cf803dd431","resolution":{"observed_at":"2026-08-04T05:51:28.946361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.948784Z","title":"Tactile-force alignment in vision-language-action models for force- aware manipulation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.948784Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:8315e67ae503940e5f91e69b71e9f38ac341357e112395b4d66dcc5fd88dfac1","observation_id":"34f8c26e-2596-4c66-b408-3bac981455e2","resolution":{"observed_at":"2026-08-04T05:51:28.948784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.951438Z","title":"Fd-vla: Force-distilled vision-language-action model for contact-rich manipulation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.951438Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:58082d454a226794d6a5fe525acbf56ff8146f79f8dfef80612436161b4da8c5","observation_id":"af5db02e-e72b-4ca6-8bcc-2a1f31ed6f17","resolution":{"observed_at":"2026-08-04T05:51:28.951438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09160","last_updated":"2025-07-12T06:44:37Z","snapshot_observed_at":"2026-08-14T22:20:44.490297Z","submitted_at":"2025-07-12T06:44:37Z","title":"Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09160","snapshot_observed_at":"2026-08-04T05:51:28.953856Z","title":"Tactile- vla: unlocking vision-language-action model’s physical knowledge for tactile generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.953856Z"},"links":{"cited_paper":"/paper/2507.09160","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:2456809a8db87b4d63f7771bfcba0f3ee0c9d89b3d88633b9c07da21e29a62d0","observation_id":"7271f9d3-a06c-4389-a06e-e75fe416a7e5","resolution":{"observed_at":"2026-08-04T05:51:28.953856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.956632Z","title":"Low-fidelity visuo-tactile pre-training improves vision-only manipulation performance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.956632Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:54524ddf14ebc17749c828289bcf89ccd4b045eb22b1401d5b128029fdd72e80","observation_id":"ed908e63-4120-423b-99f3-185cdb8236f1","resolution":{"observed_at":"2026-08-04T05:51:28.956632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15073","last_updated":"2025-07-20T18:15:18Z","snapshot_observed_at":"2026-08-15T09:13:08.749538Z","submitted_at":"2025-07-20T18:15:18Z","title":"Reinforcement Learning for Flow-Matching Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15073","snapshot_observed_at":"2026-08-04T05:51:28.959396Z","title":"Reinforcement learning for flow-matching policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.959396Z"},"links":{"cited_paper":"/paper/2507.15073","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:10357fba4e99f3400f6342395a6bfd4ad7c83a6ce5c44618cf297d0099c7c8ba","observation_id":"9761a3f3-fc2e-4afb-bc34-77176a4f413e","resolution":{"observed_at":"2026-08-04T05:51:28.959396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.962047Z","title":"Online reward-weighted fine-tuning of flow matching with wasserstein reg- ularization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.962047Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:0cd312238ff3d6f482e479d4789df259924a8d4b7d0f8ddd6bcdb82118a08886","observation_id":"328fdbae-d173-4933-b47c-d9bf5440b6c5","resolution":{"observed_at":"2026-08-04T05:51:28.962047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.964413Z","title":"Flowrl: Matching reward distributions for llm reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.964413Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:c122fe416574190e3cc590f3eed4c9e6c4437a89f2c658b5901c7ac967bc6de6","observation_id":"177ed4a9-1ec0-4312-b55d-5761fb25c9ca","resolution":{"observed_at":"2026-08-04T05:51:28.964413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04063","last_updated":"2025-09-04T09:48:43Z","snapshot_observed_at":"2026-08-14T09:41:04.189727Z","submitted_at":"2025-09-04T09:48:43Z","title":"Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04063","snapshot_observed_at":"2026-08-04T05:51:28.966906Z","title":"Balancing signal and variance: Adaptive offline rl post-training for vla flow models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.966906Z"},"links":{"cited_paper":"/paper/2509.04063","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:903a3de82ffbe4d3f2c56775cc0a16e139d7f4eaea8a0cd3f152db3449028fb3","observation_id":"523fe429-f1b8-4cb6-8c19-09b961db3bf4","resolution":{"observed_at":"2026-08-04T05:51:28.966906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.969469Z","title":"Flowram: Grounding flow matching policy with region-aware mamba framework for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.969469Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:5fb82c1f0b66eb394626d936ec76ac66047735d6cfee7c7972e8e9261dc7f99c","observation_id":"52beae3c-9512-4673-aea6-ea68f20d0ad0","resolution":{"observed_at":"2026-08-04T05:51:28.969469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.972042Z","title":"Reinflow: Fine-tuning flow matching policy with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.972042Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:c2482207b0e5edb92a3edd82d6e56bc24bc35de98d6e353fb13fb5cb21c88e14","observation_id":"00eb2799-d19f-42b6-9c1f-d86ea024cf72","resolution":{"observed_at":"2026-08-04T05:51:28.972042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.974624Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta-reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.974624Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:52df95fd44a8b70da6dbbffe334a40911de47d5edf57b389594c57f84f2a8022","observation_id":"f0214ac5-5f6e-4864-9c92-380b3a034722","resolution":{"observed_at":"2026-08-04T05:51:28.974624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.977083Z","title":"Learning complex dexterous manipulation with deep reinforcement learning and demonstrations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.977083Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:b982f930525ffc4e7ffb6bbc21bbde6eb87b7eb34b3c249cf61205a03b7df5a9","observation_id":"fcd108fa-ee62-4a34-9f5e-22bc5b9ef15d","resolution":{"observed_at":"2026-08-04T05:51:28.977083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.979562Z","title":"X- distill: Cross-architecture vision distillation for visuomotor learning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.979562Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:8d871480bfcdcfc8863c5a1fd9f35f178a4a29e1f0ac760f8a36656b9c581a99","observation_id":"fddf7671-d310-4608-852f-f6798a7ea73b","resolution":{"observed_at":"2026-08-04T05:51:28.979562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.981980Z","title":"Libero: Benchmarking knowledge transfer in lifelong robot learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.981980Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:bcbc3ab0fea1999e3b8463489187ec4b0d4e7ff0972eeb44f90ac64adb840548","observation_id":"ece9bace-7a7a-45a8-93a0-59646f5730f7","resolution":{"observed_at":"2026-08-04T05:51:28.981980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-04T05:51:28.984447Z","title":"Simpler: Mapping the gap between vla sim- ulation and real-world evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.984447Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:102774d84b0fa425477d44e965192801a2a9d95278b0c109b98fd4c809d4afe5","observation_id":"430a6271-cf01-4ccc-958e-70316ec0099b","resolution":{"observed_at":"2026-08-04T05:51:28.984447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.987237Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.987237Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:3d11b2aef90e79f83a06403163edc477a5beb0dd6c7fe5187b08ed6682b0085a","observation_id":"9d7fea25-c0df-4bbd-8547-58437000e44f","resolution":{"observed_at":"2026-08-04T05:51:28.987237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18082","last_updated":"2026-04-13T14:33:40Z","snapshot_observed_at":"2026-08-11T02:22:51.293115Z","submitted_at":"2025-11-22T14:44:03Z","title":"ActDistill: General Action-Guided Self-Derived Distillation for Efficient Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.18082","snapshot_observed_at":"2026-08-04T05:51:28.989779Z","title":"Actdistill: General action-guided self-derived distillation for efficient vision-language- action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.989779Z"},"links":{"cited_paper":"/paper/2511.18082","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:f188b44013eecd130ccec2a13b9959a82f97c3188655ff47c8caa246d1a80785","observation_id":"552abac9-e88f-4c06-99a6-92e4a1b5fdce","resolution":{"observed_at":"2026-08-04T05:51:28.989779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.992518Z","title":"Dysl-vla: Effi- cient vision-language-action model inference via dynamic-static layer- skipping for robot manipulation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.992518Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:fb8f594bd2f84c62a23275f3f95ab3f09e733c45285794cded4bd3251aa05e46","observation_id":"cf7aabb4-df97-446c-ad8a-9396985a00af","resolution":{"observed_at":"2026-08-04T05:51:28.992518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.995003Z","title":"Robobrain: A unified brain model for robotic manipulation from abstract to concrete,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.995003Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:212514e5233cc9cff2543a51aa1152dc720e00186808cf4d6804430feb6a6dfd","observation_id":"809303d0-e86a-42b4-bd52-18c5bb13a10a","resolution":{"observed_at":"2026-08-04T05:51:28.995003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.997506Z","title":"Move-kd: Knowledge distillation for vlms with mixture of visual encoders,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.997506Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:1b4da39f732e2d78b6c3020103eb6430c771c8a9bdc69fd6240b5890231168ab","observation_id":"e0badc25-c9d4-486e-9569-2ea54fd52113","resolution":{"observed_at":"2026-08-04T05:51:28.997506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:28.999968Z","title":"Fedvla: Federated vision-language-action learning with dual gating mixture-of-experts for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.999968Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:730d79e5cfc3783f636b4a938bd41d1912563045c7f0d37b1c1249bbeda1b8bc","observation_id":"b41a60fe-97de-4ea9-b587-7ad0dce311e9","resolution":{"observed_at":"2026-08-04T05:51:28.999968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:29.002389Z","title":"Lerobot: State-of-the-art machine learning for real-world robotics in pytorch,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:29.002389Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:9184d69f22052a23a57159975c37cb1f81d07c6cfd15ae13e36999a53038291b","observation_id":"e885dda3-72da-408b-8048-f2088e387bb6","resolution":{"observed_at":"2026-08-04T05:51:29.002389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-08-18T08:46:36.907284Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-08-04T05:51:29.004868Z","title":"X-vla: Soft-prompted transformer as scalable cross-embodiment vision-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:29.004868Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:16be86ae07468daee5e526eafc30d65250f059ef3f7bcc01eb6374ae96dd2cd4","observation_id":"87e36c83-6c3e-43c3-b99f-10a5635b2458","resolution":{"observed_at":"2026-08-04T05:51:29.004868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T05:51:29.007610Z","title":"Vla-0: Building state-of-the-art vlas with zero modification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:29.007610Z"},"links":{"citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:3aec81330d2ad1302e35da230769706bce40126922124893353b71fca34d9928","observation_id":"4f75d3d2-2b4b-410c-80e1-4a3f01c7356f","resolution":{"observed_at":"2026-08-04T05:51:29.007610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-04T05:51:28.923296Z","title":"Available: https://arxiv.org/abs/2410.24164","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.923296Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:6ef0ecce64881a8b841895ef8ec6986c05bfdf02d85750247dd2111c272af116","observation_id":"d62ed05e-4f1e-4b7a-97e2-7c8732ef16d3","resolution":{"observed_at":"2026-08-04T05:51:28.923296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 4 inbound Pith citation observations for arXiv:2603.15257."}