Pith. sign in

Human-timescale adaptation in an open-ended task space.arXiv preprint arXiv:2301.07608,

3 Pith papers cite this work, alongside 22 external citations. Polarity classification is still indexing.

3 Pith papers citing it
22 external citations · external index

citation-role summary

background 2

citation-polarity summary

years

2026 2 2023 1

verdicts

UNVERDICTED 3

roles

background 2

polarities

background 2

representative citing papers

Towards Scalable Multi-Task Reinforcement Learning with Large Decision Models

cs.LG · 2026-06-23 · unverdicted · novelty 6.0

A multi-task multi-modal transformer policy pretrained on offline trajectories from thousands of RL environments matches task-specific reference policies on approximately 1000 environments spanning robotics, driving, inventory, cybersecurity, trading, and games.

citing papers explorer

Showing 3 of 3 citing papers.