{"as_of":"2026-08-18T08:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:193781ca8f1d6aafdde18c2eb32d67d37e4ef96fc7b2491d2b6aa0fa7713a0a0","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:17:52.997124Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.06714/citation-record","integrity":"/paper/2509.06714/integrity","json":"/paper/2509.06714/citation-record.json","paper":"/paper/2509.06714"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.00210","last_updated":"2021-12-12T04:24:08Z","snapshot_observed_at":"2026-08-16T17:45:15.672999Z","submitted_at":"2021-10-30T09:13:39Z","title":"Mastering Atari Games with Limited Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00210","snapshot_observed_at":"2026-08-04T23:17:52.930033Z","title":"Mastering atari games with limited data,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.930033Z"},"links":{"cited_paper":"/paper/2111.00210","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:44e2404b19ae1c68dda0666e5d768ea4faab9a9df54d16953e7f91c7bd56001c","observation_id":"4c6c90fd-7ab9-4913-afb6-a314dfb57db7","resolution":{"observed_at":"2026-08-04T23:17:52.930033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.434064Z","title":"Benchmarking deep reinforcement learning for continuous control,","venue":null,"work_id":"09468fbc-17fc-4691-b7a6-381dfd59bc56","year":2016},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.933714Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:3568d2a08e6d691f624c08a8b12cbf9d7b0df77b3f05f6b78f82baaab2d2cd86","observation_id":"9c0ed7d4-ee9a-45aa-a5db-40db248b73c6","resolution":{"observed_at":"2026-08-04T23:17:53.437423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-08-14T16:39:48.171461Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-04T23:17:52.936919Z","title":"Challenges of real-world reinforcement learning,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.936919Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:086e34aea2487334b6c3a9a8d320d540c025048c92f5c231f729b773f5ce32e4","observation_id":"18cb8405-05ea-4bf5-808b-2629b29ce7b5","resolution":{"observed_at":"2026-08-04T23:17:52.936919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:52.940309Z","title":"Deep rein- forcement learning in a handful of trials using probabilistic dynamics models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.940309Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:44e675f128d33c6184ee9c23aacfe6376b3754230d06f68db09464a209e8070e","observation_id":"1d1b1fb9-2eff-4342-af17-76a135ed5001","resolution":{"observed_at":"2026-08-04T23:17:52.940309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.419277Z","title":"pytorch implementation of PETS,","venue":null,"work_id":"c4b43138-9f48-4424-a24d-ff9d2dfd4783","year":2019},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.944216Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:b551fe1b3ccbc44819dbcdba8936f981a71bd152cda80f5307fde55b32637669","observation_id":"79dc81a1-e6d5-48e5-87c3-59d3c67a005f","resolution":{"observed_at":"2026-08-04T23:17:53.422452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.409908Z","title":"Temporal difference learning for model predictive control,","venue":null,"work_id":"178506e6-5361-45f0-88f8-a3914ce8e20e","year":2022},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.947299Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:65106e93b8b2c08232542cc26bc2875c2345b46e888f27a4ec4d8fb3795c1890","observation_id":"91d08693-7794-4eb0-a448-98289fa54a57","resolution":{"observed_at":"2026-08-04T23:17:53.413253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.401337Z","title":"A tutorial on the cross-entropy method,","venue":null,"work_id":"056250e7-234d-4220-85bb-eeaab1a32618","year":2005},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.950294Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:5b6c2aad2ba5cf70c6a53d5255859f81e6de53c7f2c4971828b2402ac6ced721","observation_id":"548e413c-2f3b-4059-bf33-79a1ffd82d68","resolution":{"observed_at":"2026-08-04T23:17:53.404379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.391607Z","title":"Physics-informed model and hybrid planning for efficient dyna-style reinforcement learning,","venue":null,"work_id":"8c42c20a-f39f-4ca3-86fc-b2bb9622d694","year":2024},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.953607Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:eab6d73dfc7b44e003cc4d7ca161dab329a4365f7c945b78b82bc25221a7b9f4","observation_id":"d912b7dc-cd61-4b6d-ac16-2ac9599f30c3","resolution":{"observed_at":"2026-08-04T23:17:53.395132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.381304Z","title":"Swing-up control of inverted pendulum using pseudo-state feedback,","venue":null,"work_id":"344e0778-bc60-490c-bf70-81a580c22137","year":1992},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.956330Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:a7a4daf35743de8e792e4640ad373172b622ab0f21fc9535e5188819272417be","observation_id":"1f429d61-5cef-4fc6-a29e-139f40dba3a5","resolution":{"observed_at":"2026-08-04T23:17:53.384561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08649","last_updated":"2019-06-20T14:13:12Z","snapshot_observed_at":"2026-08-14T16:05:26.608538Z","submitted_at":"2019-06-20T14:13:12Z","title":"Exploring Model-based Planning with Policy Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08649","snapshot_observed_at":"2026-08-04T23:17:52.960328Z","title":"Exploring model-based planning with policy networks,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.960328Z"},"links":{"cited_paper":"/paper/1906.08649","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:472b76dcd06d99eada68cf85617dbb6dac6a9e676891a35f4b57d35262eff735","observation_id":"0771da8d-6426-4dda-987e-382c391ab11e","resolution":{"observed_at":"2026-08-04T23:17:52.960328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05909","last_updated":"2021-04-13T18:07:49Z","snapshot_observed_at":"2026-08-16T18:59:34.411887Z","submitted_at":"2020-12-10T11:32:01Z","title":"Blending MPC & Value Function Approximation for Efficient Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.05909","snapshot_observed_at":"2026-08-04T23:17:52.963414Z","title":"Blending mpc & value function approximation for efficient reinforcement learning,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.963414Z"},"links":{"cited_paper":"/paper/2012.05909","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:9377765efc55e0f035d3cca726456d44cdf20db73f60daaa242d0450aa759696","observation_id":"c06e1088-12c5-45ca-98b4-f21f0ac7a269","resolution":{"observed_at":"2026-08-04T23:17:52.963414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.371808Z","title":"Markov decision processes with delays and asynchronous cost collection,","venue":null,"work_id":"2be0c3e7-5518-420d-ad0d-6446eeded974","year":2003},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.968180Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:80f5833368f2c430a208752c2c7ec2958b3f64327a0efe9757fb49749ada6b14","observation_id":"b4c7ba73-8e9e-4eec-9d31-3881148487f2","resolution":{"observed_at":"2026-08-04T23:17:53.375094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.361969Z","title":"Delay-aware model-based reinforcement learning for continuous control,","venue":null,"work_id":"5987891c-376d-4b02-af19-cf1bea8129e1","year":2020},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.971895Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:c91838fa640650b622b6e85ea6d819c26cc52e0bc65a9a89427c757a7f285022","observation_id":"55e75dce-bca5-4cea-a543-0a9077aa5a68","resolution":{"observed_at":"2026-08-04T23:17:53.365601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02966","last_updated":"2021-05-04T20:27:33Z","snapshot_observed_at":"2026-08-16T19:15:25.225760Z","submitted_at":"2020-10-06T18:39:23Z","title":"Reinforcement Learning with Random Delays","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02966","snapshot_observed_at":"2026-08-04T23:17:52.975477Z","title":"Rein- forcement learning with random delays,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.975477Z"},"links":{"cited_paper":"/paper/2010.02966","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:ce2e4c38902207abab2f4ea576dde979c3ca6176e0ac2ae6daaed8ebcf5e2f1e","observation_id":"737389b3-d76b-49b6-bdfd-91c40f7c0d0d","resolution":{"observed_at":"2026-08-04T23:17:52.975477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.237555Z","title":"Real-time reinforcement learning,","venue":null,"work_id":"2436a7f0-b91c-425f-b709-03bdd8bccd76","year":2019},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.981423Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:e1b4c2ce81ce19d3256531d100fe947364dcafb5e78d43a0c7de958015bfda5c","observation_id":"a6f0662c-5921-48e1-939e-f5f0d224bcf5","resolution":{"observed_at":"2026-08-04T23:17:53.347779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06089","last_updated":"2020-04-25T21:19:45Z","snapshot_observed_at":"2026-08-09T19:35:09.981035Z","submitted_at":"2020-04-13T17:49:29Z","title":"Thinking While Moving: Deep Reinforcement Learning with Concurrent Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06089","snapshot_observed_at":"2026-08-04T23:17:52.985074Z","title":"Thinking while moving: Deep reinforcement learning with concurrent control,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.985074Z"},"links":{"cited_paper":"/paper/2004.06089","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:bda69ecc7aca4115015783c08f3a3a9f531a7e17b8ffc4f3a0b97fbf20ea5ac5","observation_id":"9765e955-04fd-46fc-b5c1-b2eec546fc1c","resolution":{"observed_at":"2026-08-04T23:17:52.985074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.111842Z","title":"Asynchronous reinforcement learning for real-time control of physical robots,","venue":null,"work_id":"4c35a637-c6de-4c86-aa4d-db158691fcbf","year":2022},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.989752Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:7163a405808059d2dea4338b412aad7fa67085dc541792561772b9e0bb2ed1ca","observation_id":"69c94fc2-3f69-4c1a-996f-3e05f072397d","resolution":{"observed_at":"2026-08-04T23:17:53.161264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14355","last_updated":"2024-12-18T21:43:40Z","snapshot_observed_at":"2026-08-16T19:55:46.427257Z","submitted_at":"2024-12-18T21:43:40Z","title":"Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14355","snapshot_observed_at":"2026-08-04T23:17:52.993979Z","title":"Enabling realtime reinforcement learning at scale with staggered asynchronous inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.993979Z"},"links":{"cited_paper":"/paper/2412.14355","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:bba64e964b860ccc63754a546c020ee5fb82a1fb452fb881e7c539207c22a229","observation_id":"7a2b46ba-fbf4-420c-bf80-95161b1c80c2","resolution":{"observed_at":"2026-08-04T23:17:52.993979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:52.997124Z","title":"Addressing function approxi- mation error in actor-critic methods,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.997124Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:95e0699400aa1599a37205e8caeb08db07354864323e336351210317671fb354","observation_id":"c4b97198-a9d4-4c58-863e-6e31743cf741","resolution":{"observed_at":"2026-08-04T23:17:52.997124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2509.06714."}