Pith. sign in

Paper Citation Record · LEDGER

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model

As of 13 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2412.05675.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.05675 v2

Coverage vector

measured 26 of 26 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T20:32:18.656785Z

measured 27 of 27 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-29T12:24:18.025364Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-29T12:33:25.164851Z

Reference resolution

26 of 26 outbound references displayed

  • verified exact0
  • verified fuzzy7
  • unresolved18
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 181ed39c-f0c7-4343-a107-62256d6de476 · outbound

This paper cites Language models are few-shot learners.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Language models are few-shot learners

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.563899Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.563899Z digest=sha256:48f9339989eb2a82446c3f747149127407998e0c5912f8785c2e0f13db3745ce

Observation dc8f86b5-d896-4c10-b3b1-208059240b4d · outbound

This paper cites Off-policy deep reinforcement learning without exploration.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Off-policy deep reinforcement learning without exploration

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.572264Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.572264Z digest=sha256:0563e474585026821268fe86a852054752b5f6d2b88af32051577cf8a8168afe

Observation 46a8fd12-52be-4c2b-add6-584764076ba3 · outbound

This paper cites Dream to Control: Learning Behaviors by Latent Imagination.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Dream to Control: Learning Behaviors by Latent Imagination

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.575875Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.575875Z digest=sha256:f3243d601265d3ea33076c5d060e1773cfd218ea44d70757b6f78bc070a4b08b

Observation e490d802-0e77-432d-8f79-19980a56fe49 · outbound

This paper cites The value of planning for infinite-horizon model predictive control.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model The value of planning for infinite-horizon model predictive control

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.943190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.584124Z digest=sha256:fa182b897d6fb1e94109978557faa3fc96b0bb4d9e5f2939834db0f80beead74

Observation 4bbf532c-2d8d-4842-9892-e708dba960b0 · outbound

This paper cites Masked au- toencoders are scalable vision learners.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Masked au- toencoders are scalable vision learners

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.931958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.587943Z digest=sha256:cb49cb0e293fe43c461648223a59b3f18f075174715698daac9df8760058c64b

Observation 388e5cf5-c65f-44bf-89bf-2fb3eb9f5ff3 · outbound

This paper cites Chain-of-Thought Predictive Control.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Chain-of-Thought Predictive Control

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.591826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.591826Z digest=sha256:902cf0116a9398a2427391a2d955dcca1fa2a159fe010b36716efdcba3111c6c

Observation 78c3f00a-7501-4879-b11a-17e65e021181 · outbound

This paper cites All inference times were benchmarked on a single NVIDIA RTX 3090 GPU.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model All inference times were benchmarked on a single NVIDIA RTX 3090 GPU

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.864544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.649434Z digest=sha256:d8d707d0b8f6d0ba70ce422525e2fbcf9a7cd6c8448fbd1be1c43bd1534f0996

Observation 4811f991-637c-488c-865b-b8c99ce44b75 · outbound

This paper cites Plan Online, Learn Offline: Efficient Learning and Exploration via Model-Based Control.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Plan Online, Learn Offline: Efficient Learning and Exploration via Model-Based Control

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.600862Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.600862Z digest=sha256:8ee8790c561ca6fb02017e24ea80310d4ea5adf45a264d8b75a87be1f5dd5c0b

Observation 7d5ff5ca-a68c-45b4-addb-6edf43a2621f · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.604933Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.604933Z digest=sha256:a49fd48768721fbe4008e97e8fe6b2aa12a35f697b28f238a33e8f29c8247ba1

Observation 9f13d8c6-5f05-42f2-8593-effa4303fa6e · outbound

This paper cites A Generalist Agent.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model A Generalist Agent

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.613196Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.613196Z digest=sha256:0ae77d2a839cda0886fd3ef0b7edcb58d226a316da647b3c5e27a42374bdbf6f

Observation a435497e-df43-4660-b34a-fc18c81ccf35 · outbound

This paper cites GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.620544Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.620544Z digest=sha256:accfe6aff629122cfb27fd2f1e14e692e7038417f7e3220df71fa2b99620321b

Observation 2a0afd8c-b50a-491c-9b98-f1c96a3e68bd · outbound

This paper cites Model-Based Offline Planning with Trajectory Pruning.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Model-Based Offline Planning with Trajectory Pruning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.624775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.624775Z digest=sha256:37baf1afb4484c44f5a1eb339869b25c2edb5c170a07a43ddd9d5efcf9da976f

Observation 712f12e3-9d2a-4a02-b6b7-65ad735be461 · outbound

This paper cites Policy Expansion for Bridging Offline-to-Online Reinforcement Learning.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Policy Expansion for Bridging Offline-to-Online Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.629173Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.629173Z digest=sha256:6d3b0d452042f52131ae1554e2bb865c83db8c5fa9a115b182fbb365aa8917f4

Observation b68b531d-d261-49ee-af29-2cb384c90582 · outbound

This paper cites We consider the Lagrangian of Equation 2 given by: L(θ, σ) =J(θ) +σ(β − HT θ ), (5) where σ is a non-negative Lagrange multiplier.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model We consider the Lagrangian of Equation 2 given by: L(θ, σ) =J(θ) +σ(β − HT θ ), (5) where σ is a non-negative Lagrange multiplier

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.909147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.632994Z digest=sha256:3a45dcec247278b68ac2682d1d689122507adb54cf34856549b862356c9aaac5

Observation 8cb545e4-1ae0-4755-8587-cf6305bb74d2 · outbound

This paper cites an unresolved cited work.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-11T20:32:18.897241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.636598Z digest=sha256:2c4b8679ab176567c41b853ae67576d68bb224046a6459902cf5e2fc21d7c1f6

Observation 67f8cc43-788d-4055-b11e-14397b755041 · outbound

This paper cites Per-task Online Training Curves for M3PC and baseline methods.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Per-task Online Training Curves for M3PC and baseline methods

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.886443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.641683Z digest=sha256:f1edca1cdaa3dbe3551f4e51a2cd0084b84fb5e0fc66c4110f240a0bb5672539

Observation 9cf25376-5d1c-4b5b-a7f6-c5dfe5d6d305 · outbound

This paper cites an unresolved cited work.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-11T20:32:18.875461Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.645508Z digest=sha256:385c21a82992fc01d62ded86ea81a99635fa8d447707c8ba04a92559dbbb36f8

Observation 8581bc05-3fe9-411c-854f-87457d7c2a29 · outbound

This paper cites an unresolved cited work.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Unresolved cited work

Reference 25

Resolution
malformed identifier
raw_fallback, observed 2026-08-11T20:32:18.852329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.652979Z digest=sha256:d4e43007a9f9bc6a728d2f7d3d36dbc29d5e1d163663f5ce4c4f6d9e13f028b2

Observation 42dd29ef-3e0d-4833-a6b7-dd264a78d5d5 · outbound

This paper cites The medium-replay dataset consists of recording all samples in the replay buffer observed during training until the agent reaches the ”medium” level.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model The medium-replay dataset consists of recording all samples in the replay buffer observed during training until the agent reaches the ”medium” level

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.839544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.656785Z digest=sha256:a06e3f0096572e26042cea303859f9cc82ad67af406405aceba8dbc1d24bdf65

Observation 0eab2578-cba9-4b7f-bf08-70433dbb47f8 · outbound

This paper cites Bootstrapped transformer for offline reinforcement learning.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Bootstrapped transformer for offline reinforcement learning

Reference 2010

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T20:32:18.919999Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-11T20:32:18.617106Z digest=sha256:b84d1519ce01a731b3aa7deeba753ff93627642ae80c5b5a22f196fce2ef3d64

Observation d07fca34-9f76-43e2-bbb5-8f8abaf99eab · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.568000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.568000Z digest=sha256:6b6af5f412f75c7280cea08f9de1f922bcf0b61f1612ec50e9076d556e57dd0c

Observation a135d1da-935d-4f9b-a3f2-b127dfbc5708 · outbound

This paper cites Temporal Difference Learning for Model Predictive Control.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Temporal Difference Learning for Model Predictive Control

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.579987Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.579987Z digest=sha256:573689738f1cfa7e2a598af63c5066a69109000ca4cd25dccfe8c788d008f793

Observation 2d65fb9a-2880-4565-bcc6-235000170ca3 · outbound

This paper cites Model-Based Offline Planning.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Model-Based Offline Planning

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.554720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.554720Z digest=sha256:e4a25b22dc820014535989a3d05c7a441baf4b1b14856df5f71c3e1de5062a74

Observation 4d24cab1-1d72-4be0-b565-6c243a0519c5 · outbound

This paper cites RT-1: Robotics Transformer for Real-World Control at Scale.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model RT-1: Robotics Transformer for Real-World Control at Scale

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.559449Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.559449Z digest=sha256:7677fa33d813e591aa6269f6423280d44de723be750be4527ffc00466a76b570

Observation 37207536-62d8-4920-bace-ae8556332596 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Offline Reinforcement Learning with Implicit Q-Learning

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.596213Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.596213Z digest=sha256:159657019665117a92668e6c2830042eea25ea0ac86624c586441c3e5615fa4b

Observation 116c6966-ddd5-4120-90c6-869670ec2059 · outbound

This paper cites Temporal Difference Models: Model-Free Deep RL for Model-Based Control.

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model Temporal Difference Models: Model-Free Deep RL for Model-Based Control

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-11T20:32:18.609198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:32:18.609198Z digest=sha256:12fee5ce40a87d99d65910dd4918438ec427b6b589ccda3f6126c1b4f06f701c

Pith citing papers

Observation 3644a998-fcaa-450e-8cbe-7737757c0be9 · inbound

World Models for Robotic Manipulation: A Survey cites this paper.

World Models for Robotic Manipulation: A Survey M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model

Reference 95

Resolution
verified exact
arxiv_id, observed 2026-06-29T12:33:25.166387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-06-29T12:24:18.025364Z digest=sha256:f81645ddfe15a362c5c41c994e6e1d72149df413006c87106ea035b8fa8b5c54