Pith. sign in

Paper Citation Record · LEDGER

Tactile Modality Fusion for Vision-Language-Action Models

As of 23 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 3 inbound Pith citation observations for arXiv:2603.14604.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.14604 v2

Coverage vector

measured 73 of 73 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:13:12.014696Z

measured 76 of 76 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T01:39:24.557281Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T01:37:31.010271Z

Reference resolution

73 of 73 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved73
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3f34ed4c-bba2-4b4d-b83d-cd35bf4dd2a5 · outbound

This paper cites Do As I Can, Not As I Say: Grounding Language in Robotic Affordances.

Tactile Modality Fusion for Vision-Language-Action Models Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:06.795351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:06.795351Z digest=sha256:ebd9a30349d9d635b08f80ee1148cda4ee9c6cbc7cc860a2548219e9e6464141

Observation 6258e8ec-64ec-4a78-a3bb-5a54aaf2a646 · outbound

This paper cites Advances in neural information processing systems35, 23716– 23736 (2022).

Tactile Modality Fusion for Vision-Language-Action Models Advances in neural information processing systems35, 23716– 23736 (2022)

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:06.841068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:06.841068Z digest=sha256:c3c6717b72a57f689cd565979543228cfdcf4de441b2675007adb099a50cdf5c

Observation d6494ec4-d000-4342-82fd-969f49bfc6a7 · outbound

This paper cites VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback.

Tactile Modality Fusion for Vision-Language-Action Models VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:06.907792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:06.907792Z digest=sha256:3484071d94823a0544a56441618403e14444380ac58c47c268c204e92bbd2a37

Observation a0d75951-e1f7-49cd-b782-e84dc536a45a · outbound

This paper cites $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control.

Tactile Modality Fusion for Vision-Language-Action Models $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:06.985926Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:06.985926Z digest=sha256:e856a3e4685096e7149df6c20698fc55bb610775cc554e2de27328e99a112b60

Observation 36c6dbcc-c8e5-4326-b572-2965663b0be4 · outbound

This paper cites Psychological science15(6), 397–402 (2004).

Tactile Modality Fusion for Vision-Language-Action Models Psychological science15(6), 397–402 (2004)

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.034820Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.034820Z digest=sha256:f8a8681cca35933df8c1630970220e623acf70afbf46a6da3ac4aad7d9057ff4

Observation e3b17f51-7d85-4bae-923c-7ae02da3768a · outbound

This paper cites RT-1: Robotics Transformer for Real-World Control at Scale.

Tactile Modality Fusion for Vision-Language-Action Models RT-1: Robotics Transformer for Real-World Control at Scale

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.096665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.096665Z digest=sha256:46698b609efaeee096ed37a653e9a311a87fb4128d830c06c16e2d9b105cebb0

Observation 9adab058-f014-43d7-9344-b052dadc815c · outbound

This paper cites Advances in neural information processing systems33, 1877–1901 (2020).

Tactile Modality Fusion for Vision-Language-Action Models Advances in neural information processing systems33, 1877–1901 (2020)

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.124463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.124463Z digest=sha256:8d1c238d57f366bee8b6d6d29cdfcd1b062fcb504f9e065fc36f32b5472c426e

Observation e4a86493-5e8d-4052-b600-8b08b057a8f6 · outbound

This paper cites IEEE Robotics and Automation Letters3(4), 3300–3307 (2018).

Tactile Modality Fusion for Vision-Language-Action Models IEEE Robotics and Automation Letters3(4), 3300–3307 (2018)

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.151602Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.151602Z digest=sha256:0b60e120ec13940968751080cf172aa22e5292076fee2c20217f1b4296187034

Observation 0ad129fb-16da-4a95-8e5c-a80c562723ce · outbound

This paper cites PaLI-X: On Scaling up a Multilingual Vision and Language Model.

Tactile Modality Fusion for Vision-Language-Action Models PaLI-X: On Scaling up a Multilingual Vision and Language Model

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.224966Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.224966Z digest=sha256:55b3c12da77f857cdc46489b1f6c991a42c3da15bc482d302229511c936b8e9f

Observation 601cb75c-89dd-4295-8929-91b68450fba3 · outbound

This paper cites PaLI: A Jointly-Scaled Multilingual Language-Image Model.

Tactile Modality Fusion for Vision-Language-Action Models PaLI: A Jointly-Scaled Multilingual Language-Image Model

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.308552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.308552Z digest=sha256:0166d363924640c57f6b251c71982267b5f878fb0a5e7f6c3594a738814c05a6

Observation a0b3892a-9e86-44c5-a093-09db641c0bf5 · outbound

This paper cites Information Fusion p.

Tactile Modality Fusion for Vision-Language-Action Models Information Fusion p

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.392605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.392605Z digest=sha256:306ce250803d7f675bb215ce12712bb8610f693f719d6e3e5d57e3f391c5aeaf

Observation ead208a5-67e0-4b85-9631-beacdaa80b8e · outbound

This paper cites arXiv preprint arXiv:2508.08706 (2025).

Tactile Modality Fusion for Vision-Language-Action Models arXiv preprint arXiv:2508.08706 (2025)

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.476091Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.476091Z digest=sha256:222b8bf430a029f95245874b900a513e532732ab933ebd900bc0b480bccc9e66

Observation 5e8d3e96-6df9-4fa1-8718-9714c9d8d3b5 · outbound

This paper cites Journal of machine learning research24(240), 1– 113 (2023).

Tactile Modality Fusion for Vision-Language-Action Models Journal of machine learning research24(240), 1– 113 (2023)

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.558364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.558364Z digest=sha256:57f7924583004a7e996069a365b4dfd13bb221c15be1d6ca8b7961732b68d03e

Observation 8d05bea7-43ce-4f13-872b-3f0090c21411 · outbound

This paper cites arXiv preprint arXiv:2510.06339 (2025).

Tactile Modality Fusion for Vision-Language-Action Models arXiv preprint arXiv:2510.06339 (2025)

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.615106Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.615106Z digest=sha256:a6ff6fe38c204e701a4e25896b32ce33d5b95429c0a55fa6e7a30344646f1106

Observation 7e6e979b-93a1-4c6b-b73a-881527bfe91b · outbound

This paper cites In: 2021 IEEE International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2021 IEEE International Conference on Robotics and Automation (ICRA)

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.706161Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.706161Z digest=sha256:cb2a163204dcc9456d21772a738c0fd7d02eeab66c0f1c81fd03e9ef6793165e

Observation 5918619e-4726-4b61-bbda-4ab2f23ea125 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

Tactile Modality Fusion for Vision-Language-Action Models An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.778147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.778147Z digest=sha256:0279738b6e514e842e37095d844ec6cd3f54d1eecedda7da9c9125f17c845b3f

Observation 861dd294-8eba-463c-a0ed-3e00aef39b82 · outbound

This paper cites PaLM-E: An Embodied Multimodal Language Model.

Tactile Modality Fusion for Vision-Language-Action Models PaLM-E: An Embodied Multimodal Language Model

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.837052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.837052Z digest=sha256:db96f3e0b9dc573f86eb295ffefeeaae1cab378bcded88944bb899bfae3f2fec

Observation e305a5a0-6309-4572-a440-c6880c811375 · outbound

This paper cites Vision-Language Models as Success Detectors.

Tactile Modality Fusion for Vision-Language-Action Models Vision-Language Models as Success Detectors

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:07.921806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:07.921806Z digest=sha256:4606ac61f39ad2b749e630c4cde3990b86a5bd113cc5bdcd42f7e26409bc68cb

Observation 40c8a758-a5a6-4bba-8d36-65869e596aaa · outbound

This paper cites AnyTouch: Learning Unified Static-Dynamic Representation across Multiple Visuo-tactile Sensors.

Tactile Modality Fusion for Vision-Language-Action Models AnyTouch: Learning Unified Static-Dynamic Representation across Multiple Visuo-tactile Sensors

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.015826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.015826Z digest=sha256:a2af0b2e2e289b46a577954a21eb08a967c7b6aea505e122814f238da90a0570

Observation 39061e10-d237-47bc-8498-d6e8b862c3cb · outbound

This paper cites arXiv preprint arXiv:2602.09617 (2026).

Tactile Modality Fusion for Vision-Language-Action Models arXiv preprint arXiv:2602.09617 (2026)

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.055469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.055469Z digest=sha256:cef007f80b01695b36eb6e3c4964b0f99e6bc2e6b16eb13709ee95f300aed17f

Observation dca2794f-f9a9-4f69-9640-131516996e8b · outbound

This paper cites In: 2025 IEEE International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2025 IEEE International Conference on Robotics and Automation (ICRA)

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.109251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.109251Z digest=sha256:6f056fea87f3147be7db7a9028bdd84c660e939fb141ad84ec239a4708ea2631

Observation ba64634d-3e1d-459e-bf6a-57ba1c06ca7b · outbound

This paper cites Sensor-Invariant Tactile Representation.

Tactile Modality Fusion for Vision-Language-Action Models Sensor-Invariant Tactile Representation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.161723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.161723Z digest=sha256:0ce805ccbe3efd3dad8847df421df363069d2bc5fb5e0b023dca21467b081a97

Observation 616c25a0-efb5-4371-942a-fb6cf81455b7 · outbound

This paper cites In: 2022 International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2022 International Conference on Robotics and Automation (ICRA)

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.223322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.223322Z digest=sha256:3e564cf7aa34a52ce57fce43a0233a8056803ab5cabd9da37388d847e42726c6

Observation c03427cf-0db2-4c44-8bf8-fbe1f5bee086 · outbound

This paper cites TLA: Tactile-Language-Action Model for Contact-Rich Manipulation.

Tactile Modality Fusion for Vision-Language-Action Models TLA: Tactile-Language-Action Model for Contact-Rich Manipulation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.267569Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.267569Z digest=sha256:e6e2fa8cab2748c88a53aeffc166705839ea5d84a699f6f60e47eb2cc1662493

Observation de5deb5a-7550-405d-b329-55a59f165636 · outbound

This paper cites ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation.

Tactile Modality Fusion for Vision-Language-Action Models ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.352641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.352641Z digest=sha256:e482dd0ac82735f85fb7d1f2c880f4dcc9bb62f8e71d6cd8c18a116c5adc5de7

Observation c27e80c4-4980-4c2b-bb94-7182c26d975e · outbound

This paper cites Sparsh: Self-supervised touch representations for vision-based tactile sensing.

Tactile Modality Fusion for Vision-Language-Action Models Sparsh: Self-supervised touch representations for vision-based tactile sensing

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.412026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.412026Z digest=sha256:7f1756df366b8446d462efadd948517e853ec3bf663f83f214bdcb1e92927a7d

Observation 4db7c627-f0c7-497c-88d6-25d77d59c1bf · outbound

This paper cites In: 2018 IEEE/RSJ In- ternational Conference on Intelligent Robots and Systems (IROS).

Tactile Modality Fusion for Vision-Language-Action Models In: 2018 IEEE/RSJ In- ternational Conference on Intelligent Robots and Systems (IROS)

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.454187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.454187Z digest=sha256:991f36d4c2289faff41995b6f404871aa7d58f17d6c61bbfa8659e1e1807b386

Observation 933b42ad-2553-4ba7-a0c6-3e80d15b7d35 · outbound

This paper cites In: Proceedings of the IEEE/CVF winter conference on applications of computer vision.

Tactile Modality Fusion for Vision-Language-Action Models In: Proceedings of the IEEE/CVF winter conference on applications of computer vision

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.505791Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.505791Z digest=sha256:4e9782f2e44c795b183464cb51011b11c5efe040bc382711a0c9e4ac8ba33c6e

Observation 20551140-11a6-4b6a-ba0c-f5b874ae7c6a · outbound

This paper cites ICLR1(2), 3 (2022).

Tactile Modality Fusion for Vision-Language-Action Models ICLR1(2), 3 (2022)

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.556229Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.556229Z digest=sha256:34a1f552f0919fd6b80e1c093562bf55d895688d9f3c18ced4644decea4728c8

Observation 04cdd81c-52e5-4a7b-86f1-4416e321dd33 · outbound

This paper cites Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization.

Tactile Modality Fusion for Vision-Language-Action Models Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.634601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.634601Z digest=sha256:34560420a25421977b547e04988a9e216bf00c4646c5db02f32e2177de8b7774

Observation 127b1add-ce06-4fdf-8957-37e9218ef891 · outbound

This paper cites $\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization.

Tactile Modality Fusion for Vision-Language-Action Models $\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.696040Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.696040Z digest=sha256:c26257f166a88cca7a8ec41eb9e8fc85b18276b0d2d8be5e7e6456730105cf13

Observation 1adf34a0-24c3-4c6b-880c-682db1f84b72 · outbound

This paper cites In: International conference on machine learning.

Tactile Modality Fusion for Vision-Language-Action Models In: International conference on machine learning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.777067Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.777067Z digest=sha256:8259b34947290d4d4fc5394c3f190dae7c2a54dc5b3516a1d3bfc8070ec8efff

Observation 041d3044-be7e-492a-b04e-8447821c8e84 · outbound

This paper cites Nature Reviews Neuroscience10(5), 345–359 (2009).

Tactile Modality Fusion for Vision-Language-Action Models Nature Reviews Neuroscience10(5), 345–359 (2009)

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.846773Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.846773Z digest=sha256:eb2b5a75961df04fc05a0cef186baf6a0439c03a90e1d2828053f8a824e978f8

Observation d3cb7da0-d8c5-4875-b423-34306bcb00d1 · outbound

This paper cites Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding.

Tactile Modality Fusion for Vision-Language-Action Models Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:08.910882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:08.910882Z digest=sha256:b782b72f5ddad01e1fc66ce51c4f115de0f779b06998aa2cf63b8dbd6b1ab5b4

Observation 34f57c71-facf-489c-be05-ae940a3238bd · outbound

This paper cites Language-Driven Representation Learning for Robotics.

Tactile Modality Fusion for Vision-Language-Action Models Language-Driven Representation Learning for Robotics

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.022758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.022758Z digest=sha256:24738a67361895a7c4f3fded665733eaff4e7d1dbc682eb5fd4b976b92318e69

Observation 76d7649f-3af9-4056-b086-8dd32e1b7076 · outbound

This paper cites Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success.

Tactile Modality Fusion for Vision-Language-Action Models Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.098895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.098895Z digest=sha256:8d43eda3e2ccff0966bdc212c9c5acff02c78ccc6ba0840bcf8f7a78799c686d

Observation c7443929-eb81-4f5c-bad4-79ebc5fbb9c8 · outbound

This paper cites OpenVLA: An Open-Source Vision-Language-Action Model.

Tactile Modality Fusion for Vision-Language-Action Models OpenVLA: An Open-Source Vision-Language-Action Model

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.169219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.169219Z digest=sha256:3d80e659397b8cfcea2934070958014ac28d7fa906f75df6081413dc0b1710c3

Observation 3f311d55-be2e-43a4-b03e-765903f3ed45 · outbound

This paper cites IEEE Robotics and Automation Letters5(3), 3838–3845 (2020).

Tactile Modality Fusion for Vision-Language-Action Models IEEE Robotics and Automation Letters5(3), 3838–3845 (2020)

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.212647Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.212647Z digest=sha256:e9b38fabd5c1dd4c368a306ae4320b4231813db8fc826fcd12af7896ae4b9d87

Observation 505a6ee5-60e7-4206-b5af-6c97a5288192 · outbound

This paper cites In: 2019 International conference on robotics and automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2019 International conference on robotics and automation (ICRA)

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.322227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.322227Z digest=sha256:58e4288422ab8d5af946346600038e1e9d4f920b9e65930e68f2592ec533c124

Observation e1797b32-a9b0-4844-9166-8f8ab2585014 · outbound

This paper cites In: 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS).

Tactile Modality Fusion for Vision-Language-Action Models In: 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.368990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.368990Z digest=sha256:d58b7f9679405728bab91961c054a3e2163abe13bd694d42ee666a5e3abf3b33

Observation aeb7f255-83c4-430a-b637-2e73ad2c1088 · outbound

This paper cites In: International conference on machine learning.

Tactile Modality Fusion for Vision-Language-Action Models In: International conference on machine learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.424325Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.424325Z digest=sha256:6b07d138ae9e48b8890ff6dbca231f38232611c5669f8e5b359f3b5cd3ff0fd6

Observation adce82ed-f6e7-4a26-ba11-fa37f4645376 · outbound

This paper cites In: International confer- ence on machine learning.

Tactile Modality Fusion for Vision-Language-Action Models In: International confer- ence on machine learning

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.478304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.478304Z digest=sha256:8a666796d3df9d6e0919804068746bd4cd766550f94d1b7ff8d909b02c6177ff

Observation e1caae98-d953-426b-ba1d-31ed564e9643 · outbound

This paper cites CLTP: Contrastive Language-Tactile Pre-training for 3D Contact Geometry Understanding.

Tactile Modality Fusion for Vision-Language-Action Models CLTP: Contrastive Language-Tactile Pre-training for 3D Contact Geometry Understanding

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.529978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.529978Z digest=sha256:1445230e2c1fb092f292e3ba4db6f5e53e3632043986652d545cc25125afe1ab

Observation 7de51efb-8644-4f82-98cf-575084e215bd · outbound

This paper cites R3M: A Universal Visual Representation for Robot Manipulation.

Tactile Modality Fusion for Vision-Language-Action Models R3M: A Universal Visual Representation for Robot Manipulation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.607919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.607919Z digest=sha256:90d27622e3e55147f24dbf65af1d24f98d7a3c39fa3e28d1e7766d2cc2c8d566

Observation c829cf96-cb03-4e4f-968a-95c9367961b9 · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

Tactile Modality Fusion for Vision-Language-Action Models DINOv2: Learning Robust Visual Features without Supervision

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.675980Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.675980Z digest=sha256:6044797f02cafb2691712e1b185fe23486ab81bb6c350c6d37f70fc8bf9efa4f

Observation 3c76438d-3963-47ce-ad6d-b0004ecab254 · outbound

This paper cites In: 2024 IEEE International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2024 IEEE International Conference on Robotics and Automation (ICRA)

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.717918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.717918Z digest=sha256:69595e00c45819b91b358d8acb36a9aa181abbcadc8646b1402cd9b4797c8dbc

Observation ef69fd43-3cac-4706-ad83-9d06de5c1209 · outbound

This paper cites In: Proceedings of the AAAI conference on artificial intelligence.

Tactile Modality Fusion for Vision-Language-Action Models In: Proceedings of the AAAI conference on artificial intelligence

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.792802Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.792802Z digest=sha256:87e39328898a06f9e8cdb54408d94cdd1b9d81d44906e28f824f89005d3a157d

Observation ded66399-8092-45b5-a5d4-5ab58bd745db · outbound

This paper cites In: Conference on Robot Learning.

Tactile Modality Fusion for Vision-Language-Action Models In: Conference on Robot Learning

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.848489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.848489Z digest=sha256:f18a12383baff088a07691eb7491a1fd95ce8525b0e37424d43f077bba86a658

Observation 2aa15305-7c81-4620-9cb7-c4fd8e002897 · outbound

This paper cites In: International conference on machine learning.

Tactile Modality Fusion for Vision-Language-Action Models In: International conference on machine learning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.905181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.905181Z digest=sha256:e65dbf6502958613d9836f05c30a641c48faaa0f76b6dc2097e79afb8c3e2b5b

Observation c63c0463-486f-4d07-afe8-796d0b118edf · outbound

This paper cites In: Conference on robot learning.

Tactile Modality Fusion for Vision-Language-Action Models In: Conference on robot learning

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:09.965173Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:09.965173Z digest=sha256:dc5ceb8977fd501a088cae002a13fb5be01b6fab93f43388e5c01e1c7392053b

Observation 23669dcf-f178-4663-8333-323d850e7a7f · outbound

This paper cites Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts.

Tactile Modality Fusion for Vision-Language-Action Models Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.024015Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.024015Z digest=sha256:b8a4555a873ea6899d340beef488dbe1914492590a2b8006ab396c7b4d8c80f6

Observation 32ac22bf-acff-4cc6-9a9a-592459ba4bbf · outbound

This paper cites The International Journal of Robotics Research40(12-14), 1385–1401 (2021).

Tactile Modality Fusion for Vision-Language-Action Models The International Journal of Robotics Research40(12-14), 1385–1401 (2021)

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.082001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.082001Z digest=sha256:0999171d0318508a4859310143e838732a9477e65ae3eb2235cbbb7c46aa9af4

Observation 885c24c1-a978-40be-85e0-aee70ce2b7bd · outbound

This paper cites In: Conference on robot learning.

Tactile Modality Fusion for Vision-Language-Action Models In: Conference on robot learning

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.157420Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.157420Z digest=sha256:4fcbe6130c3b2996b4da39e6e22eda938ed38cfcf6e744f8b69c59c7e935f80d

Observation c80735aa-51fb-49ea-b4f0-a69e76cfb67e · outbound

This paper cites Open-World Object Manipulation using Pre-trained Vision-Language Models.

Tactile Modality Fusion for Vision-Language-Action Models Open-World Object Manipulation using Pre-trained Vision-Language Models

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.246106Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.246106Z digest=sha256:415ec78950a2d5721a6c56ba83eace71d2e0a3f8074c478b064f1ef732ee1905

Observation 24cd187c-f8b5-4314-be61-a802fb0bf898 · outbound

This paper cites Octo: An Open-Source Generalist Robot Policy.

Tactile Modality Fusion for Vision-Language-Action Models Octo: An Open-Source Generalist Robot Policy

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.319568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.319568Z digest=sha256:db12ae87668f4b9f9d2f9807f1fd30983e0330b50d6a947042dd84aa0c63fbd7

Observation d0b97498-a348-4d1e-8dfd-732af6bfa9c4 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Tactile Modality Fusion for Vision-Language-Action Models LLaMA: Open and Efficient Foundation Language Models

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.399210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.399210Z digest=sha256:fbd80f64b98cc614264eaa2d41f5ced7ff4ddd9bcd686842bcf1578ca72d4832

Observation 57bb3016-a743-42e1-8178-cbc91e5f8ba8 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Tactile Modality Fusion for Vision-Language-Action Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.481317Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.481317Z digest=sha256:b542f63ea630038b627cd44e4fe640def92fa6e3fbb40a5606ae02560c86f09a

Observation eb60596a-a6a9-4b1a-ab2e-be93d1c0dcd0 · outbound

This paper cites Advances in neural information pro- cessing systems30(2017).

Tactile Modality Fusion for Vision-Language-Action Models Advances in neural information pro- cessing systems30(2017)

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.537110Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.537110Z digest=sha256:5f5eee3451bd5ead53d7e5b01723130bba8bb630ee73f00162d51c1bd1d50398

Observation 654216c6-3e0d-420a-8b21-d7a05231b02e · outbound

This paper cites an unresolved cited work.

Tactile Modality Fusion for Vision-Language-Action Models Unresolved cited work

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.593287Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.593287Z digest=sha256:159e7bf924e177a124c6711b50adcb60cb5386a8ec882b9f3d487d69ed511d80

Observation 805b1cfa-eb08-4b7b-ad36-2e07087fa9bf · outbound

This paper cites Advances in neural information processing systems35, 24824–24837 (2022).

Tactile Modality Fusion for Vision-Language-Action Models Advances in neural information processing systems35, 24824–24837 (2022)

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.648350Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.648350Z digest=sha256:4963f74f221e311ead504a2564b629a302d984df8e89a375ae9cdf3fa93e9330

Observation f905c60a-f98b-4f24-b296-8c46a576bc4d · outbound

This paper cites Cable Routing and Assembly using Tactile-driven Motion Primitives.

Tactile Modality Fusion for Vision-Language-Action Models Cable Routing and Assembly using Tactile-driven Motion Primitives

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.690047Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.690047Z digest=sha256:f103d34286d797dc0392d11dfb2fdb08df892408248cec7856fc26f614ca7025

Observation 007e1999-317f-4737-ba4e-bc7ac70bc2dd · outbound

This paper cites In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition.

Tactile Modality Fusion for Vision-Language-Action Models In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.771971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.771971Z digest=sha256:1a3900fd647aa26baf634ebf17aacbc906ad28f3752c0c340615f96399ed535b

Observation efc1d857-1338-4e96-8a43-541ab4f035da · outbound

This paper cites arXiv preprint arXiv:2505.22159 (2025).

Tactile Modality Fusion for Vision-Language-Action Models arXiv preprint arXiv:2505.22159 (2025)

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.837649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.837649Z digest=sha256:a4e3428c832584edc23b8d27633573cb8b377e28e234ae7b452ddb6a08514aaa

Observation 70506059-6dd4-423e-8a34-b5902ce5266e · outbound

This paper cites Octopi: Object Property Reasoning with Large Tactile-Language Models.

Tactile Modality Fusion for Vision-Language-Action Models Octopi: Object Property Reasoning with Large Tactile-Language Models

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:10.937804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:10.937804Z digest=sha256:5669bfe5b9955a8da7642eb5da4563294efa0ba8533728a16bdc83f174b4f183

Observation 45bb2ade-7cf6-41e8-9b86-28f9a6eb6a40 · outbound

This paper cites Sensors17(12), 2762 (2017).

Tactile Modality Fusion for Vision-Language-Action Models Sensors17(12), 2762 (2017)

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.043398Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.043398Z digest=sha256:0f5c00f3e01219570b59cca3ae952ac0a02bbb7bfe3e6badddbc724fedcfa11d

Observation 160e4104-c656-4a46-a88b-1743004779b9 · outbound

This paper cites In: 2024 IEEE International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2024 IEEE International Conference on Robotics and Automation (ICRA)

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.147689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.147689Z digest=sha256:e77a38ec0f10aaabc757bb361179b1a670b3e325e0c25c16413598111c7e1b17

Observation 8dc72ecf-bcf6-4563-9508-354e09bf5898 · outbound

This paper cites In: Proceedings of the IEEE/CVF international conference on computer vision.

Tactile Modality Fusion for Vision-Language-Action Models In: Proceedings of the IEEE/CVF international conference on computer vision

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.249555Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.249555Z digest=sha256:1a58c5918c220c2271da6f8c6347db72a8c309eec855da7912e6503a0bd12458

Observation 54ebce5b-3ef5-44da-bbed-05a604582b7d · outbound

This paper cites VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation.

Tactile Modality Fusion for Vision-Language-Action Models VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.413729Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.413729Z digest=sha256:376830e4f5523ef107f1134017fdd4064d60f4e18485fc2cc7761538d483ea53

Observation 274813c4-d68f-485c-86d6-adaa706c12bd · outbound

This paper cites Grounding Classical Task Planners via Vision-Language Models.

Tactile Modality Fusion for Vision-Language-Action Models Grounding Classical Task Planners via Vision-Language Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.550160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.550160Z digest=sha256:3326e4b431b793ae362e42ecf6934c5fa1e422a54414bb0bc16413410e270fe6

Observation 56ea649e-b5ae-4847-b257-295bb132218d · outbound

This paper cites TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance.

Tactile Modality Fusion for Vision-Language-Action Models TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.618026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.618026Z digest=sha256:6f35cba02d9edef5d16abed95137105009fdc253bce747460487365192613290

Observation e685ac13-732c-4348-8399-c7fb9c1e5eb4 · outbound

This paper cites In: 2025 IEEE International Conference on Robotics and Automation (ICRA).

Tactile Modality Fusion for Vision-Language-Action Models In: 2025 IEEE International Conference on Robotics and Automation (ICRA)

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.776055Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.776055Z digest=sha256:36afe3a074f97cfd3e5071087bf44e5dba223a4c9d255b53eaa149b265f3dc17

Observation a4fc770a-4ea1-4e38-ae89-9b6867973401 · outbound

This paper cites Transferable Tactile Transformers for Representation Learning Across Diverse Sensors and Tasks.

Tactile Modality Fusion for Vision-Language-Action Models Transferable Tactile Transformers for Representation Learning Across Diverse Sensors and Tasks

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:11.893666Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:11.893666Z digest=sha256:56378ff93f83c44a7cd0fefea4d8838f187ce035ce099d04f4d3739897424d01

Observation 60b0970f-0bc4-4100-9a3b-05a0391c5163 · outbound

This paper cites In: Conference on Robot Learning.

Tactile Modality Fusion for Vision-Language-Action Models In: Conference on Robot Learning

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-02T18:13:12.014696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:13:12.014696Z digest=sha256:90b045721b559c7820066603415a5e7520c9b278f3880484376b044e2ffe4765

Pith citing papers

Observation dd273e23-845d-4651-9400-69a0ec62ba92 · inbound

AetheRock: An Arm-Worn Robot Teaching System for Force-Guided Vision-Tactile Learning cites this paper.

AetheRock: An Arm-Worn Robot Teaching System for Force-Guided Vision-Tactile Learning Tactile Modality Fusion for Vision-Language-Action Models

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-07-16T01:21:46.008504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-27T16:25:09.975308Z digest=sha256:44ecab206caec63d168eeeddb45708c27fa126ae43cba67d60d225382fc45436

Observation 7ce87b69-0e10-49be-a370-409bad48f53e · inbound

Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation cites this paper.

Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation Tactile Modality Fusion for Vision-Language-Action Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T01:39:24.557281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T01:39:24.557281Z digest=sha256:07da9842d12b2275676ce7e6bdf10eec221c80da222c8372d9d183416986a596

Observation a81ff2ac-2c64-42ae-8331-e3d5c19db8a6 · inbound

ViTacWorld: Scaling Visuo-Tactile World Models for Contact-Rich Robot Manipulation cites this paper.

ViTacWorld: Scaling Visuo-Tactile World Models for Contact-Rich Robot Manipulation Tactile Modality Fusion for Vision-Language-Action Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-01T04:28:09.527853Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T04:28:09.527853Z digest=sha256:e7cff7ef10c74add644e9de14b559c63f2ad47b73ed05cd29de31210b5cf633f