{"as_of":"2026-08-23T02:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:95baccd316c7cd45d501fc14a03c5fda50c9159b3ae642252b1d8d9acd056860","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:14:54.312313Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T11:39:46.881274Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-14T11:35:46.497355Z","title":"Residual Reinforcement Learning for Robot Control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.08659","last_updated":"2019-08-23T04:26:26Z","snapshot_observed_at":"2026-08-21T12:56:52.469235Z","submitted_at":"2019-08-23T04:26:26Z","title":"A Comparison of Action Spaces for Learning Manipulation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T11:35:46.497355Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/1908.08659"},"observation_digest":"sha256:c9b1e0e4cd03b35d508c843e65331a54b73af94b6e55c51a446ded7c15262a7b","observation_id":"7cbfcf38-225d-4b6b-86dd-a8881ceed2c1","resolution":{"observed_at":"2026-08-14T11:35:46.497355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-16T10:14:54.312313Z","title":"Residual reinforcement learning for robot control, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.18766","last_updated":"2025-04-26T02:12:02Z","snapshot_observed_at":"2026-08-19T17:48:52.882478Z","submitted_at":"2025-04-26T02:12:02Z","title":"Dynamic Action Interpolation: A Universal Approach for Accelerating Reinforcement Learning with Expert Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:54.312313Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2504.18766"},"observation_digest":"sha256:c4924f49a49ba4fd4761e8411ca95c4f0f7241fd5c7bcfe283db15129a669437","observation_id":"7119433e-63c7-4298-b95b-6aefad78ae80","resolution":{"observed_at":"2026-08-16T10:14:54.312313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-05T13:31:27.531515Z","title":"Residual Reinforcement Learning for Robot Control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00571","last_updated":"2025-08-30T17:38:17Z","snapshot_observed_at":"2026-08-18T01:37:23.454612Z","submitted_at":"2025-08-30T17:38:17Z","title":"Gray-Box Computed Torque Control for Differential-Drive Mobile Robot Tracking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:31:27.531515Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2509.00571"},"observation_digest":"sha256:c491d7cc1476ad22cc99be857feb7dcc4b7d4f086ab2d7ca8a19b5327c66f89e","observation_id":"8ce3016e-b097-4050-92bf-5297e3ec3799","resolution":{"observed_at":"2026-08-05T13:31:27.531515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2603.12243","last_updated":"2026-05-15T22:34:49Z","snapshot_observed_at":"2026-08-15T17:17:41.222361Z","submitted_at":"2026-03-12T17:56:29Z","title":"HandelBot: Real-World Piano Playing via Fast Adaptation of Dexterous Robot Policies","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T11:48:13.368844Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2603.12243"},"observation_digest":"sha256:0718bbfa6e0a4054b45e091bd0753fcfac60dc2fa851cdb68f3394a1af1d6958","observation_id":"f1f749c5-d387-44fe-83df-a196f3fa2d02","resolution":{"observed_at":"2026-05-15T11:49:58.839323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2603.12243","last_updated":"2026-05-15T22:34:49Z","snapshot_observed_at":"2026-08-15T17:17:41.222361Z","submitted_at":"2026-03-12T17:56:29Z","title":"HandelBot: Real-World Piano Playing via Fast Adaptation of Dexterous Robot Policies","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-21T11:54:57.866685Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2603.12243"},"observation_digest":"sha256:a0d4a84af765c6eab33036e5cee51438fa201f2b8c082eecdc23e546a4bed8c7","observation_id":"60af5cfe-a0dd-4186-a658-502e982feb52","resolution":{"observed_at":"2026-05-21T11:55:04.216099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2605.22082","last_updated":"2026-05-28T04:09:52Z","snapshot_observed_at":"2026-08-02T07:24:12.826465Z","submitted_at":"2026-05-21T07:21:56Z","title":"CoRMA: Contrastive RMA for Contact-Rich Meta-Adaptation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T05:37:26.290308Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2605.22082"},"observation_digest":"sha256:af71eacf4c7352b395e84497074e124a9397436ee98ca1f4830b75ff2525c771","observation_id":"234ac503-a19e-45c7-9930-6f19e4ce2861","resolution":{"observed_at":"2026-05-22T05:41:08.548801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2605.22082","last_updated":"2026-05-28T04:09:52Z","snapshot_observed_at":"2026-08-02T07:24:12.826465Z","submitted_at":"2026-05-21T07:21:56Z","title":"CoRMA: Contrastive RMA for Contact-Rich Meta-Adaptation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T16:54:39.269896Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2605.22082"},"observation_digest":"sha256:f4186d60a9e1176f0c21762c60afdaac2198e0a608beec99fab8159324d55e0e","observation_id":"9541a2f8-49ec-46b3-ac82-f0ac0fe5695b","resolution":{"observed_at":"2026-06-30T16:54:57.936474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2605.27895","last_updated":"2026-05-27T03:19:01Z","snapshot_observed_at":"2026-08-09T23:39:09.089348Z","submitted_at":"2026-05-27T03:19:01Z","title":"Application of Reinforcement Learning for Multigroup Energy Grid Optimization for Neutron Transport Criticality Problems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T09:46:28.025449Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2605.27895"},"observation_digest":"sha256:9d2b488d7e823da67ca10086ab406b38797409240abf70174493b7bb516cbe5c","observation_id":"d9cba8f6-dd07-489d-bb94-55d0fe0ea713","resolution":{"observed_at":"2026-06-29T09:53:17.539724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2606.09825","last_updated":"2026-06-08T17:59:39Z","snapshot_observed_at":"2026-08-02T05:45:28.658980Z","submitted_at":"2026-06-08T17:59:39Z","title":"An Agency-Transferring Model-Free Policy Enhancement Technique","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T17:11:45.240357Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2606.09825"},"observation_digest":"sha256:c280839b828dd870937b558fa156ecd77f4bba73af0d0d21288b7b309681e424","observation_id":"bebe6664-399a-4ba9-b720-4dff9787566e","resolution":{"observed_at":"2026-07-03T00:27:29.870338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2606.13675","last_updated":"2026-06-11T17:59:45Z","snapshot_observed_at":"2026-07-30T00:58:38.369141Z","submitted_at":"2026-06-11T17:59:45Z","title":"Improving Robotic Generalist Policies via Flow Reversal Steering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T06:20:19.209180Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2606.13675"},"observation_digest":"sha256:97a6ae76d75af96490090728f02c7bd806504ede12408f954e9df4c04f6604eb","observation_id":"3761bc26-95ef-42b8-b939-6853d3dcc301","resolution":{"observed_at":"2026-07-03T15:48:35.768547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2606.23640","last_updated":"2026-06-22T17:30:24Z","snapshot_observed_at":"2026-08-02T09:22:48.099895Z","submitted_at":"2026-06-22T17:30:24Z","title":"Learning Process Rewards via Success Visitation Matching for Efficient RL","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T09:20:35.062060Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2606.23640"},"observation_digest":"sha256:2c18fc3acb6fe70625400d6006d071679e74924c6dffcef732b4453bcb2228d7","observation_id":"c11115b6-9542-46fe-a824-fa97fed4c48e","resolution":{"observed_at":"2026-07-04T09:59:44.446333Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2606.23848","last_updated":"2026-06-22T18:30:36Z","snapshot_observed_at":"2026-08-08T06:38:38.263049Z","submitted_at":"2026-06-22T18:30:36Z","title":"Enforcing Human-like Kinematics in Dexterous Piano Playing via Adversarial Posture Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T07:50:18.384238Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2606.23848"},"observation_digest":"sha256:e9b8f6059f9addd40a57a36ec65e62f3a523e7a241b12007afedff875bf18b12","observation_id":"e8529928-3a4f-42e9-8364-524f5585d5f5","resolution":{"observed_at":"2026-07-04T11:39:46.882694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":"1812.03201","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-04T11:39:46.881274Z","title":"Residual Reinforcement Learning for Robot Control","venue":"cs.RO","work_id":"461aa2f3-828f-4273-8a30-90fe0c89f5e6","year":2018},"citing_paper":{"arxiv_id":"2607.02092","last_updated":"2026-07-03T08:21:35Z","snapshot_observed_at":"2026-08-13T06:00:09.923935Z","submitted_at":"2026-07-02T12:30:50Z","title":"Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-03T11:50:49.215046Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.02092"},"observation_digest":"sha256:332fe518298333a91f9b6cce685a8f11237fe16c5f43240e6e384a7648306221","observation_id":"d08ac51b-1aec-47fe-9596-488bcd4bbe77","resolution":{"observed_at":"2026-07-03T11:58:05.715130Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-12T08:26:59.428524Z","title":"Residual reinforcement learning for robot control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.02092","last_updated":"2026-07-03T08:21:35Z","snapshot_observed_at":"2026-08-13T06:00:09.923935Z","submitted_at":"2026-07-02T12:30:50Z","title":"Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T08:26:59.428524Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.02092"},"observation_digest":"sha256:f1472c47c1d93b5bfe95f57984c5b0eedd99e9cec480d5f1ba0652ac15e7d13f","observation_id":"1fa53bb1-1a65-4934-a5ca-9dbd428d84a3","resolution":{"observed_at":"2026-07-12T08:26:59.428524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-13T06:05:18.192691Z","title":"Johannink, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.08877","last_updated":"2026-07-09T19:07:33Z","snapshot_observed_at":"2026-08-15T23:10:14.161705Z","submitted_at":"2026-07-09T19:07:33Z","title":"FlowDAgger: Human-in-the-Loop Adaptation of Generative Robot Policies in Latent Space","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T06:05:18.192691Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.08877"},"observation_digest":"sha256:b8afb49f61098cced77165c18783cf71f7740ce225aa5b79c693ea835ca910d3","observation_id":"20293ff1-8855-489a-8e40-1989dc659d38","resolution":{"observed_at":"2026-07-13T06:05:18.192691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-01T22:35:37.354247Z","title":"Residual reinforcement learning for robot control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.15701","last_updated":"2026-07-17T07:23:54Z","snapshot_observed_at":"2026-08-16T23:46:40.764759Z","submitted_at":"2026-07-17T07:23:54Z","title":"RAVEN: Reinforcement-Adaptive Visibility-Graph Planning for Robust Humanoid Navigation with Collision-Free MPC","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T22:35:37.354247Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.15701"},"observation_digest":"sha256:976fa5e885570df5199b663694e7e9f7d2e9fd3d031f96c68317b28ee5347833","observation_id":"552d55ff-da37-46a2-9d0d-199328349152","resolution":{"observed_at":"2026-08-01T22:35:37.354247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-01T04:54:12.185761Z","title":"Residual reinforcement learning for robot control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22409","last_updated":"2026-07-24T15:27:07Z","snapshot_observed_at":"2026-08-15T22:16:32.905062Z","submitted_at":"2026-07-24T15:27:07Z","title":"Conformal Constraint Tightening for Chance-Constrained Motion Planning with Unknown Dynamics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T04:54:12.185761Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.22409"},"observation_digest":"sha256:003660cd63b26f31061339d2502ed330aa90765e5b46c6f6d2419e6117f818d0","observation_id":"2db3407d-4d38-4fbe-814c-718dca8eb7b6","resolution":{"observed_at":"2026-08-01T04:54:12.185761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-07-30T11:06:22.954758Z","title":"Residual reinforcement learning for robot control, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27203","last_updated":"2026-08-03T21:04:51Z","snapshot_observed_at":"2026-08-19T15:53:26.918304Z","submitted_at":"2026-07-29T17:59:51Z","title":"Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-30T11:06:22.954758Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.27203"},"observation_digest":"sha256:331be319fbe87ba05f3eafe41cd870326188b89750b67d1bf808259e6f81a3a7","observation_id":"f5db7fea-11db-4820-981c-ddc72416d264","resolution":{"observed_at":"2026-07-30T11:06:22.954758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03201","snapshot_observed_at":"2026-08-05T04:27:43.895668Z","title":"Residual reinforcement learning for robot control, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27203","last_updated":"2026-08-03T21:04:51Z","snapshot_observed_at":"2026-08-19T15:53:26.918304Z","submitted_at":"2026-07-29T17:59:51Z","title":"Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T04:27:43.895668Z"},"links":{"cited_paper":"/paper/1812.03201","citing_paper":"/paper/2607.27203"},"observation_digest":"sha256:3dcc591983c9606520568f92703ddc4de556e5a65d6f29c9379933dc6dede9d8","observation_id":"4ef21e19-4a49-49a0-bd4e-28aec6a260ac","resolution":{"observed_at":"2026-08-05T04:27:43.895668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1812.03201/citation-record","integrity":"/paper/1812.03201/integrity","json":"/paper/1812.03201/citation-record.json","paper":"/paper/1812.03201"},"outbound":[],"paper":{"arxiv_id":"1812.03201","last_updated":"2018-12-18T23:40:20Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T21:50:42.167249Z","submitted_at":"2018-12-07T20:10:23Z","title":"Residual Reinforcement Learning for Robot Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:1812.03201."}