{"as_of":"2026-08-13T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15e63628ef3814cfdce1404cd33cbf312abf5db8d1be8350dcca845d5e426c87","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:32:18.656785Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:24:18.025364Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:33:25.164851Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"cited_work":{"arxiv_id":"2412.05675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05675","snapshot_observed_at":"2026-06-29T12:33:25.164851Z","title":"M3pc: Test-time model predictive control for pretrained masked trajectory model,","venue":null,"work_id":"45c7ce06-9343-46b2-a4e3-983ef5be5763","year":2025},"citing_paper":{"arxiv_id":"2606.00113","last_updated":"2026-05-27T05:32:17Z","snapshot_observed_at":"2026-08-12T06:30:48.206457Z","submitted_at":"2026-05-27T05:32:17Z","title":"World Models for Robotic Manipulation: A Survey","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-29T12:24:18.025364Z"},"links":{"cited_paper":"/paper/2412.05675","citing_paper":"/paper/2606.00113"},"observation_digest":"sha256:866fd962ce1bb86da482ff006120577d11744cb820f2e3e1eb03342e6edc5d5d","observation_id":"3644a998-fcaa-450e-8cbe-7737757c0be9","resolution":{"observed_at":"2026-06-29T12:33:25.166387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05675/citation-record","integrity":"/paper/2412.05675/integrity","json":"/paper/2412.05675/citation-record.json","paper":"/paper/2412.05675"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.563899Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.563899Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:48f9339989eb2a82446c3f747149127407998e0c5912f8785c2e0f13db3745ce","observation_id":"181ed39c-f0c7-4343-a107-62256d6de476","resolution":{"observed_at":"2026-08-11T20:32:18.563899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.572264Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.572264Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:0563e474585026821268fe86a852054752b5f6d2b88af32051577cf8a8168afe","observation_id":"dc8f86b5-d896-4c10-b3b1-208059240b4d","resolution":{"observed_at":"2026-08-11T20:32:18.572264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-11T20:32:18.575875Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.575875Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:f3243d601265d3ea33076c5d060e1773cfd218ea44d70757b6f78bc070a4b08b","observation_id":"46a8fd12-52be-4c2b-add6-584764076ba3","resolution":{"observed_at":"2026-08-11T20:32:18.575875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.939361Z","title":"The value of planning for infinite-horizon model predictive control","venue":null,"work_id":"90bc00cc-6c5e-467d-bf06-c1694cd9a6b9","year":2021},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.584124Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:516760415529a526f627d596c379c551277d5d5a5ec2b22cca04cf2a64ce8a75","observation_id":"e490d802-0e77-432d-8f79-19980a56fe49","resolution":{"observed_at":"2026-08-11T20:32:18.943190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.928236Z","title":"Masked au- toencoders are scalable vision learners","venue":null,"work_id":"9680c78d-5f13-4e00-a3aa-c2f6c214a747","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.587943Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:dc04c03ec838b9ea30c7db56a2d536a1f4105592ffde318fc9626150a04be8ce","observation_id":"4bbf532c-2d8d-4842-9892-e708dba960b0","resolution":{"observed_at":"2026-08-11T20:32:18.931958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00776","last_updated":"2024-07-07T22:06:34Z","snapshot_observed_at":"2026-08-13T12:10:35.605653Z","submitted_at":"2023-04-03T07:59:13Z","title":"Chain-of-Thought Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00776","snapshot_observed_at":"2026-08-11T20:32:18.591826Z","title":"Chain-of- thought predictive control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.591826Z"},"links":{"cited_paper":"/paper/2304.00776","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:9bd601a43680ef1c0888e0ac3f78ceb08430620507734e6a84e950c19b319b90","observation_id":"388e5cf5-c65f-44bf-89bf-2fb3eb9f5ff3","resolution":{"observed_at":"2026-08-11T20:32:18.591826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.860317Z","title":"All inference times were benchmarked on a single NVIDIA RTX 3090 GPU","venue":null,"work_id":"4bfdab94-889b-4032-a1fd-1bf9fa318a7f","year":2021},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.649434Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:112565c4baaa9bae645016ee446011013db02d43f66a6213584cd73e5cd5747e","observation_id":"78c3f00a-7501-4879-b11a-17e65e021181","resolution":{"observed_at":"2026-08-11T20:32:18.864544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.01848","last_updated":"2019-01-28T16:39:23Z","snapshot_observed_at":"2026-07-06T07:12:44.495733Z","submitted_at":"2018-11-05T17:09:18Z","title":"Plan Online, Learn Offline: Efficient Learning and Exploration via Model-Based Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.01848","snapshot_observed_at":"2026-08-11T20:32:18.600862Z","title":"Plan online, learn offline: Efficient learning and exploration via model-based control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.600862Z"},"links":{"cited_paper":"/paper/1811.01848","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:8ee8790c561ca6fb02017e24ea80310d4ea5adf45a264d8b75a87be1f5dd5c0b","observation_id":"4811f991-637c-488c-865b-b8c99ce44b75","resolution":{"observed_at":"2026-08-11T20:32:18.600862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-11T20:32:18.604933Z","title":"Awac: Accelerating online rein- forcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.604933Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:a49fd48768721fbe4008e97e8fe6b2aa12a35f697b28f238a33e8f29c8247ba1","observation_id":"7d5ff5ca-a68c-45b4-addb-6edf43a2621f","resolution":{"observed_at":"2026-08-11T20:32:18.604933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-08T03:18:33.595658Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-11T20:32:18.613196Z","title":"A generalist agent","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.613196Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:0ae77d2a839cda0886fd3ef0b7edcb58d226a316da647b3c5e27a42374bdbf6f","observation_id":"9f13d8c6-5f05-42f2-8593-effa4303fa6e","resolution":{"observed_at":"2026-08-11T20:32:18.613196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20025","last_updated":"2024-05-16T14:08:55Z","snapshot_observed_at":"2026-08-13T05:37:07.705838Z","submitted_at":"2023-10-30T21:19:52Z","title":"GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20025","snapshot_observed_at":"2026-08-11T20:32:18.620544Z","title":"Goplan: Goal- conditioned offline reinforcement learning by planning with learned models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.620544Z"},"links":{"cited_paper":"/paper/2310.20025","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:00813ba0a7ef319a97c188afdc4a304f9e06181ac3d5289c5344d7051cfa43ee","observation_id":"a435497e-df43-4660-b34a-fc18c81ccf35","resolution":{"observed_at":"2026-08-11T20:32:18.620544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.07351","last_updated":"2022-04-21T08:43:40Z","snapshot_observed_at":"2026-08-10T16:11:52.054089Z","submitted_at":"2021-05-16T05:00:54Z","title":"Model-Based Offline Planning with Trajectory Pruning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.07351","snapshot_observed_at":"2026-08-11T20:32:18.624775Z","title":"Model-based offline planning with trajectory prun- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.624775Z"},"links":{"cited_paper":"/paper/2105.07351","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:37baf1afb4484c44f5a1eb339869b25c2edb5c170a07a43ddd9d5efcf9da976f","observation_id":"2a0afd8c-b50a-491c-9b98-f1c96a3e68bd","resolution":{"observed_at":"2026-08-11T20:32:18.624775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00935","last_updated":"2025-08-28T20:06:01Z","snapshot_observed_at":"2026-08-13T12:52:57.691880Z","submitted_at":"2023-02-02T08:25:12Z","title":"Policy Expansion for Bridging Offline-to-Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00935","snapshot_observed_at":"2026-08-11T20:32:18.629173Z","title":"Policy expansion for bridging offline-to-online reinforce- ment learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.629173Z"},"links":{"cited_paper":"/paper/2302.00935","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:64aff6598584b8e8a2137def74e5ffdf461b984ad863a25aa6c78b48809dae83","observation_id":"712f12e3-9d2a-4a02-b6b7-65ad735be461","resolution":{"observed_at":"2026-08-11T20:32:18.629173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.904956Z","title":"We consider the Lagrangian of Equation 2 given by: L(θ, σ) =J(θ) +σ(β − HT θ ), (5) where σ is a non-negative Lagrange multiplier","venue":null,"work_id":"2e589b73-c2de-4c48-b6a5-a8e2b3081639","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.632994Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:c444d70e5f4268ad8ecea7fe2ad6d019f77d63edf6d6bb6bab01a0c48bf81d65","observation_id":"b68b531d-d261-49ee-af29-2cb384c90582","resolution":{"observed_at":"2026-08-11T20:32:18.909147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.893865Z","title":null,"venue":null,"work_id":"4d555cef-0f42-4f93-b299-e1990e4f035e","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.636598Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:77aa26bedfedaf68f20da11b5aaa367b92aca551a2596d7d39a40da9b6cc0df6","observation_id":"8cb545e4-1ae0-4755-8587-cf6305bb74d2","resolution":{"observed_at":"2026-08-11T20:32:18.897241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.882639Z","title":"Per-task Online Training Curves for M3PC and baseline methods","venue":null,"work_id":"6b234447-d2bf-4059-aaae-d8910f1d5118","year":2022},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.641683Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:7b8099898f87181cbfcecc499ce030abdb0bf5c6b87717e536015ec1b95348f1","observation_id":"67f8cc43-788d-4055-b11e-14397b755041","resolution":{"observed_at":"2026-08-11T20:32:18.886443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.871819Z","title":null,"venue":null,"work_id":"70454ea1-e975-41f1-b5b7-30987ef27396","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.645508Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:5b0b559048f119764cb3992e2581edaefe175f5dd4968ffcc52000840fd6c35c","observation_id":"9cf25376-5d1c-4b5b-a7f6-c5dfe5d6d305","resolution":{"observed_at":"2026-08-11T20:32:18.875461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.848238Z","title":null,"venue":null,"work_id":"d2e62d5a-a663-467e-916e-15f6a47d6300","year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.652979Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:a32b4fbcc98d3e0fe939f5a517b60691cafe9f4ebc7dfaeaa2b2c97abfd10013","observation_id":"8581bc05-3fe9-411c-854f-87457d7c2a29","resolution":{"observed_at":"2026-08-11T20:32:18.852329Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.833586Z","title":"The medium-replay dataset consists of recording all samples in the replay buffer observed during training until the agent reaches the ”medium” level","venue":null,"work_id":"1cabbca3-9361-4f74-a69a-24c7ed051166","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.656785Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:bbc0818fc48cfb249cb41e408434fccd6b7aeb23225c3b6d5ec9df9ca7e6629c","observation_id":"42dd29ef-3e0d-4833-a6b7-dd264a78d5d5","resolution":{"observed_at":"2026-08-11T20:32:18.839544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:32:18.916228Z","title":"Bootstrapped transformer for offline reinforcement learning","venue":null,"work_id":"86d7fda5-a5ac-480e-a2ba-8363c3ce4762","year":2025},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.617106Z"},"links":{"citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:50eb49fa90bb7f04e8124e8edfe81ebd80d7a26797ff77886f95443295b1f662","observation_id":"0eab2578-cba9-4b7f-bf08-70433dbb47f8","resolution":{"observed_at":"2026-08-11T20:32:18.919999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T20:32:18.568000Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.568000Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:6b6af5f412f75c7280cea08f9de1f922bcf0b61f1612ec50e9076d556e57dd0c","observation_id":"d07fca34-9f76-43e2-bbb5-8f8abaf99eab","resolution":{"observed_at":"2026-08-11T20:32:18.568000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-08-10T15:55:33.977855Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-08-11T20:32:18.579987Z","title":"Temporal difference learning for model predictive control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.579987Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:573689738f1cfa7e2a598af63c5066a69109000ca4cd25dccfe8c788d008f793","observation_id":"a135d1da-935d-4f9b-a3f2-b127dfbc5708","resolution":{"observed_at":"2026-08-11T20:32:18.579987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05556","last_updated":"2021-03-17T17:22:51Z","snapshot_observed_at":"2026-08-01T17:10:08.501525Z","submitted_at":"2020-08-12T20:06:52Z","title":"Model-Based Offline Planning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.05556","snapshot_observed_at":"2026-08-11T20:32:18.554720Z","title":"Model-based offline planning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.554720Z"},"links":{"cited_paper":"/paper/2008.05556","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:e4a25b22dc820014535989a3d05c7a441baf4b1b14856df5f71c3e1de5062a74","observation_id":"2d65fb9a-2880-4565-bcc6-235000170ca3","resolution":{"observed_at":"2026-08-11T20:32:18.554720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-11T20:32:18.559449Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.559449Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:7677fa33d813e591aa6269f6423280d44de723be750be4527ffc00466a76b570","observation_id":"4d24cab1-1d72-4be0-b565-6c243a0519c5","resolution":{"observed_at":"2026-08-11T20:32:18.559449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-11T20:32:18.596213Z","title":"Offline reinforcement learning with implicit q- learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.596213Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:5de7678172db7960ed082b5005f6f825218ca159cdbf1b0bc985502c6aad5237","observation_id":"37207536-62d8-4920-bace-ae8556332596","resolution":{"observed_at":"2026-08-11T20:32:18.596213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09081","last_updated":"2020-02-24T06:34:11Z","snapshot_observed_at":"2026-08-10T01:20:45.693057Z","submitted_at":"2018-02-25T21:14:44Z","title":"Temporal Difference Models: Model-Free Deep RL for Model-Based Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09081","snapshot_observed_at":"2026-08-11T20:32:18.609198Z","title":"Temporal difference models: Model- free deep rl for model-based control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T20:32:18.609198Z"},"links":{"cited_paper":"/paper/1802.09081","citing_paper":"/paper/2412.05675"},"observation_digest":"sha256:12fee5ce40a87d99d65910dd4918438ec427b6b589ccda3f6126c1b4f06f701c","observation_id":"116c6966-ddd5-4120-90c6-869670ec2059","resolution":{"observed_at":"2026-08-11T20:32:18.609198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.05675","last_updated":"2025-02-06T13:39:31Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T20:26:21.496485Z","submitted_at":"2024-12-07T14:44:22Z","title":"M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2412.05675."}