{"as_of":"2026-08-08T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d2cb7b1d42f6a511eafbe3c8321c361ec6b817e7137274bb151812c99d1436a","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:32:52.655581Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21867/citation-record","integrity":"/paper/2607.21867/integrity","json":"/paper/2607.21867/citation-record.json","paper":"/paper/2607.21867"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1812.06298","last_updated":"2019-01-03T18:11:15Z","snapshot_observed_at":"2026-07-06T07:21:24.277262Z","submitted_at":"2018-12-15T14:47:21Z","title":"Residual Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06298","snapshot_observed_at":"2026-08-01T06:32:50.887493Z","title":"Residual policy learning.arXiv preprint arXiv:1812.06298,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:50.887493Z"},"links":{"cited_paper":"/paper/1812.06298","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:c6023897aeb4efd823430f63fcee039b595f252f4bb9855b4fccc4985d459ed9","observation_id":"dd5571a2-bd30-483a-bca8-35fd6f2cc1cb","resolution":{"observed_at":"2026-08-01T06:32:50.887493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-01T06:32:51.170921Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.170921Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:f70793fd97f6e2c9070dbc8946ea3e079e5b5d7895610007151d13a1ebe05d71","observation_id":"68e1e66d-4eae-4f6a-b47e-19f2bd22b0c6","resolution":{"observed_at":"2026-08-01T06:32:51.170921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-01T06:32:51.329299Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.329299Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:95d15db44ace149126fdd57b82458295e79d75d192f4c27b056bf1a7957d6a31","observation_id":"1ceecee9-6f43-4165-b013-4e2d32e4e80d","resolution":{"observed_at":"2026-08-01T06:32:51.329299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-07-06T12:46:08.838773Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-08-01T06:32:51.940717Z","title":"Anusha Nagabandi, Gregory Kahn, Ronald S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.940717Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:0eaecd611ededc2f00fee616f542bf45064964841cee51d9f3b1f27397be4599","observation_id":"7de8c998-94cb-4d96-98a8-5f39e1582169","resolution":{"observed_at":"2026-08-01T06:32:51.940717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02596","last_updated":"2017-12-02T02:04:21Z","snapshot_observed_at":"2026-07-06T05:54:32.113521Z","submitted_at":"2017-08-08T18:13:03Z","title":"Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02596","snapshot_observed_at":"2026-08-01T06:32:52.100841Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.100841Z"},"links":{"cited_paper":"/paper/1708.02596","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:892d91ebfd69026d2083eaa99862d18d46e20c41a43b62e60b27020ecc0c0962","observation_id":"a2b4da04-c527-460e-af13-c78f14397976","resolution":{"observed_at":"2026-08-01T06:32:52.100841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-07-06T06:23:52.853341Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-01T06:32:52.397160Z","title":"Archit Sharma, Shixiang Gu, Sergey Levine, Vikash Kumar, and Karol Hausman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.397160Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:0809da8b2fde945edba54edaf502247238d3b7a5068544ee684357dc52625c5e","observation_id":"6b56dd92-bc6e-4e47-858a-a29b23e322df","resolution":{"observed_at":"2026-08-01T06:32:52.397160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-01T06:32:52.458556Z","title":"Xue Bin Peng, Yunrong Guo, Lina Halper, Sergey Levine, and Sanja Fidler","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.458556Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:2854aef688c50dbb801ee214a14527dfad8b2513b0197c318a740138ce56de98","observation_id":"534371e1-d8ba-4b70-9bdd-0db6848e22e7","resolution":{"observed_at":"2026-08-01T06:32:52.458556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01906","last_updated":"2022-05-05T17:25:14Z","snapshot_observed_at":"2026-08-06T05:44:08.634910Z","submitted_at":"2022-05-04T06:13:28Z","title":"ASE: Large-Scale Reusable Adversarial Skill Embeddings for Physically Simulated Characters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01906","snapshot_observed_at":"2026-08-01T06:32:52.570650Z","title":"Jean-Baptiste Mouret and Jeff Clune","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.570650Z"},"links":{"cited_paper":"/paper/2205.01906","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:041cfe3ccfe9100b181b1dc41b679dcdaccbaad9b5f63a33af01cca3fd4b42fd","observation_id":"00cb38aa-ef1b-4b01-864b-0b246d255b4c","resolution":{"observed_at":"2026-08-01T06:32:52.570650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-01T06:32:52.655581Z","title":"Clemens Schwarke, Mayank Mittal, Nikita Rudin, David Hoeller, and Marco Hutter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.655581Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:45035fd32e4cf7f12d844398934905c5248202dc16ddbbb0c634bd05a0cee3e5","observation_id":"20c25c21-39ef-4342-9fd5-27e017d99792","resolution":{"observed_at":"2026-08-01T06:32:52.655581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12114","last_updated":"2018-11-02T17:19:02Z","snapshot_observed_at":"2026-07-06T06:42:05.870167Z","submitted_at":"2018-05-30T17:55:21Z","title":"Deep Reinforcement Learning in a Handful of Trials using Probabilistic Dynamics Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12114","snapshot_observed_at":"2026-08-01T06:32:51.539244Z","title":"Michael Janner, Justin Fu, Marvin Zhang, and Sergey Levine","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.539244Z"},"links":{"cited_paper":"/paper/1805.12114","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:5e43083fb78655eec790583510c9cc8c2b4d84b4692fece195838e1934b0cab4","observation_id":"a6dff5b1-97df-438d-893e-688193e00db2","resolution":{"observed_at":"2026-08-01T06:32:51.539244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08253","last_updated":"2021-11-29T00:49:49Z","snapshot_observed_at":"2026-08-08T08:31:07.385498Z","submitted_at":"2019-06-19T17:54:53Z","title":"When to Trust Your Model: Model-Based Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08253","snapshot_observed_at":"2026-08-01T06:32:51.649648Z","title":"Danijar Hafner, Timothy Lillicrap, Jimmy Ba, and Mohammad Norouzi","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.649648Z"},"links":{"cited_paper":"/paper/1906.08253","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:3d0bd0be099513134ce77a64533e87fd81fedbda271760f3ac4f2d5ba808019f","observation_id":"c482f795-6a45-4a5e-a87c-793b915f2edb","resolution":{"observed_at":"2026-08-01T06:32:51.649648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-01T06:32:51.832057Z","title":"Nicklas Hansen, Xiaolong Wang, and Hao Su","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.832057Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:2655481324f37c17791325517e89e85f5c63503f484c1081fee7bee735b20f5f","observation_id":"3bbeb77a-ad30-4e99-a635-d965f6f44562","resolution":{"observed_at":"2026-08-01T06:32:51.832057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-01T06:32:50.938941Z","title":"Gabriel B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:50.938941Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:35cb8a8fba462bbf81a808e1dd0af8a2ef1831a4a6fe9d255ad21574055091eb","observation_id":"59b43bd1-af11-4855-85dd-673f503c0edf","resolution":{"observed_at":"2026-08-01T06:32:50.938941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03238","last_updated":"2022-12-06T18:59:34Z","snapshot_observed_at":"2026-08-07T12:24:18.479380Z","submitted_at":"2022-12-06T18:59:34Z","title":"Walk These Ways: Tuning Robot Control for Generalization with Multiplicity of Behavior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03238","snapshot_observed_at":"2026-08-01T06:32:51.068053Z","title":"Nikita Rudin, David Hoeller, Philipp Reist, and Marco Hutter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.068053Z"},"links":{"cited_paper":"/paper/2212.03238","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:32855eabe670af1a5a4018978e0e1dd645a45e7a6ba5408a87e3c30461c73c90","observation_id":"0e242fb6-8977-4625-b4a6-b4f7bc8bb96c","resolution":{"observed_at":"2026-08-01T06:32:51.068053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04195","last_updated":"2024-02-16T13:45:11Z","snapshot_observed_at":"2026-07-06T14:40:08.765591Z","submitted_at":"2023-01-10T20:19:17Z","title":"Orbit: A Unified Simulation Framework for Interactive Robot Learning Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04195","snapshot_observed_at":"2026-08-01T06:32:51.438757Z","title":"Joonho Lee, Jemin Hwangbo, Lorenz Wellhausen, Vladlen Koltun, and Marco Hutter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:51.438757Z"},"links":{"cited_paper":"/paper/2301.04195","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:e01cad94a1d0b39797ee268a112fe46db5e5c0a6fae6c29b82a5c65dff4256de","observation_id":"cfbb742c-233b-4798-bac4-8f990ee4df73","resolution":{"observed_at":"2026-08-01T06:32:51.438757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17583","last_updated":"2024-05-21T05:49:52Z","snapshot_observed_at":"2026-08-03T20:28:50.971367Z","submitted_at":"2024-01-31T03:58:28Z","title":"Agile But Safe: Learning Collision-Free High-Speed Legged Locomotion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17583","snapshot_observed_at":"2026-08-01T06:32:52.241114Z","title":"Jeonghwan Kim, Yunhai Han, Harish Ravichandar, and Sehoon Ha","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.241114Z"},"links":{"cited_paper":"/paper/2401.17583","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:53cf4c74230b95e0e5b0ea35ce94eb29783851a07ee185d054bddd34171630a6","observation_id":"18528b75-9185-43de-b92c-ed41a0246967","resolution":{"observed_at":"2026-08-01T06:32:52.241114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.08951","last_updated":"2026-07-09T21:21:19Z","snapshot_observed_at":"2026-08-03T19:45:22.456780Z","submitted_at":"2026-07-09T21:21:19Z","title":"A Statistical Test for the Benefits of Personalizing Interventions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08951","snapshot_observed_at":"2026-08-01T06:32:52.338091Z","title":"arXiv:2607.08951","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.338091Z"},"links":{"cited_paper":"/paper/2607.08951","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:ff76bbcadcd22be76c1c1986a4877208758c5a668f4f603d025be32abde60077","observation_id":"5602058d-dd11-402a-bb59-70839d0d8ad8","resolution":{"observed_at":"2026-08-01T06:32:52.338091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2607.21867."}