{"as_of":"2026-08-08T02:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5d8761b7d543f79d5c13a185fd4fd5527fbf698f7e675e7ece03cdb070ecfdb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:56.960598Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:09:52.691576Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-05-14T17:27:35.733800Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2310.16828"},"observation_digest":"sha256:4f0cf7706225d81d0e9d7921f866248318217fda5dd670060cfaf0ffebf49288","observation_id":"846be998-4b5d-4b84-88b3-3d0b3627e9a5","resolution":{"observed_at":"2026-05-14T17:27:35.853102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T17:29:49.186565Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2407.17032"},"observation_digest":"sha256:0d8ae5cb50e5ceb2a3383fe1010a43070b0f7fef016c6ea61ee313b33081b13e","observation_id":"dcf5e911-491b-4013-b9ad-76fa0aa02644","resolution":{"observed_at":"2026-05-11T17:29:49.533695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-07T15:29:56.960598Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14986","last_updated":"2025-05-21T00:21:38Z","snapshot_observed_at":"2026-08-07T15:23:41.217672Z","submitted_at":"2025-05-21T00:21:38Z","title":"AnyBody: A Benchmark Suite for Cross-Embodiment Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:56.960598Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2505.14986"},"observation_digest":"sha256:923c09a7e020520bd2cb94d9edd985989bf287f0f9a9a2cb31f68c90c2473be5","observation_id":"032392b3-b7e5-4f61-b24a-1614214eeac3","resolution":{"observed_at":"2026-08-07T15:29:56.960598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-07T11:06:47.427864Z","title":"Meta-world: A benchmark and evaluation for multi- task and meta reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03568","last_updated":"2025-06-05T02:35:36Z","snapshot_observed_at":"2026-08-07T10:57:31.810767Z","submitted_at":"2025-06-04T04:31:10Z","title":"Confidence-Guided Human-AI Collaboration: Reinforcement Learning with Distributional Proxy Value Propagation for Autonomous Driving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:47.427864Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2506.03568"},"observation_digest":"sha256:2bb2155742b69536032fab6ef45472553951ba4fe13bba58c1b5f2d95d371ad4","observation_id":"ace12819-7be9-4dbb-8251-53a121e283b2","resolution":{"observed_at":"2026-08-07T11:06:47.427864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-07T04:59:41.871352Z","title":"Zellers, R., Holtzman, A., Bisk, Y ., Farhadi, A., and Choi, Y","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.09172","last_updated":"2025-06-17T03:30:48Z","snapshot_observed_at":"2026-08-07T04:53:04.543955Z","submitted_at":"2025-06-10T18:38:19Z","title":"An Open-Source Software Toolkit & Benchmark Suite for the Evaluation and Adaptation of Multimodal Action Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:59:41.871352Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2506.09172"},"observation_digest":"sha256:d7d4db0168e0ab556871af373b73c11dd5867c3167ec0a89b177c3a42b3499a0","observation_id":"a2e551cf-2fb8-40fc-a387-d64f945924d8","resolution":{"observed_at":"2026-08-07T04:59:41.871352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-06T22:23:48.547874Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.21782","last_updated":"2025-06-26T21:39:01Z","snapshot_observed_at":"2026-08-06T22:16:51.342320Z","submitted_at":"2025-06-26T21:39:01Z","title":"M3PO: Massively Multi-Task Model-Based Policy Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:48.547874Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2506.21782"},"observation_digest":"sha256:89e7f5ceb313f44089ff2a36b5abaa649b51ae9d58c21199df24473f97db0344","observation_id":"81a6273c-6ca9-480b-9cf9-1d8e263842e3","resolution":{"observed_at":"2026-08-06T22:23:48.547874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2507.05331","last_updated":"2025-07-07T17:56:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:56:01Z","title":"A Careful Examination of Large Behavior Models for Multitask Dexterous Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-25T04:32:56.397350Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2507.05331"},"observation_digest":"sha256:5a1dc9f73cd47df3258b2fe7e60117510b726738a1ed63daebd771df421214f6","observation_id":"8c392d02-622c-4d53-87e5-5a936ab95710","resolution":{"observed_at":"2026-05-25T04:32:56.558240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-06T16:49:08.722732Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12644","last_updated":"2025-07-16T21:30:05Z","snapshot_observed_at":"2026-08-07T14:06:21.459730Z","submitted_at":"2025-07-16T21:30:05Z","title":"VLMgineer: Vision Language Models as Robotic Toolsmiths","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:49:08.722732Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2507.12644"},"observation_digest":"sha256:da18749f1b5f0498867f0b3c161888617525804abb608f606ab486c3fc79baa0","observation_id":"914a5390-5546-4116-a704-24b43d785c39","resolution":{"observed_at":"2026-08-06T16:49:08.722732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-06T15:55:36.985972Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14736","last_updated":"2025-07-19T19:53:08Z","snapshot_observed_at":"2026-08-06T15:46:49.918611Z","submitted_at":"2025-07-19T19:53:08Z","title":"Balancing Expressivity and Robustness: Constrained Rational Activations for Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T15:55:36.985972Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2507.14736"},"observation_digest":"sha256:57f0c384d0183365679e7b2e6784494321d9aae2366300d9acb3ec76804d279a","observation_id":"0d035fc3-3f1e-4084-8484-0a04baf6e10c","resolution":{"observed_at":"2026-08-06T15:55:36.985972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-06T15:26:24.663113Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.16139","last_updated":"2025-07-22T01:13:45Z","snapshot_observed_at":"2026-08-06T18:14:52.248033Z","submitted_at":"2025-07-22T01:13:45Z","title":"Equivariant Goal Conditioned Contrastive Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:26:24.663113Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2507.16139"},"observation_digest":"sha256:5d1a99b8e108742ca44a9efbacf46c7d2505392792a6062e6d0fa7e1e71a5de9","observation_id":"38595e7e-4b50-4c39-9c3b-64849ca100ca","resolution":{"observed_at":"2026-08-06T15:26:24.663113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-06T11:03:31.574523Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23172","last_updated":"2025-08-01T01:21:35Z","snapshot_observed_at":"2026-08-06T19:28:36.018078Z","submitted_at":"2025-07-31T00:52:05Z","title":"Benchmarking Massively Parallelized Multi-Task Reinforcement Learning for Robotics Tasks","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T11:03:31.574523Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2507.23172"},"observation_digest":"sha256:da4167404d68b07185d1814dbf1af5c24acd5579de434dbc21e9e1d882b7b885","observation_id":"54e0e1a9-2db9-4aba-94b0-ea133a08d417","resolution":{"observed_at":"2026-08-06T11:03:31.574523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2509.20869","last_updated":"2026-04-15T19:40:08Z","snapshot_observed_at":"2026-07-06T22:30:46.129271Z","submitted_at":"2025-09-25T08:01:13Z","title":"Model-Based Reinforcement Learning under Random Observation Delays","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-18T14:35:04.201252Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2509.20869"},"observation_digest":"sha256:5f25a8db8f11e1361dd5edc49c08e1f90a59291f9d9a0e17b945eb6fcd21478e","observation_id":"b6fcf3af-f5b0-4693-8cf9-56201cff736d","resolution":{"observed_at":"2026-05-18T14:36:28.692263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-03T19:49:23.601741Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.22445","last_updated":"2026-05-31T13:04:20Z","snapshot_observed_at":"2026-08-03T19:49:22.971066Z","submitted_at":"2025-11-27T13:31:38Z","title":"DIPOLE: Fusing Vision and Geometry for Robust Visuomotor Generalization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T19:49:23.601741Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2511.22445"},"observation_digest":"sha256:eddd610a87a47b0e8e434eeccb7cf2d543e5aaf470b5cdb71ea6ff123a8fa35f","observation_id":"dbb18c19-446a-4473-9b6f-530e1c27b171","resolution":{"observed_at":"2026-08-03T19:49:23.601741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2512.20974","last_updated":"2026-05-08T01:20:50Z","snapshot_observed_at":"2026-07-06T22:39:58.137482Z","submitted_at":"2025-12-24T06:00:51Z","title":"Generalised Linear Models in Deep Bayesian RL with Learnable Basis Functions","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-16T20:28:46.739742Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2512.20974"},"observation_digest":"sha256:d25d10257dc6ed41c55f86f3cfa97180a4648e5ce0cfaec27d2cdac31b225440","observation_id":"5d7b7d33-db2f-4047-9bc0-8a1a495a46da","resolution":{"observed_at":"2026-05-16T20:31:14.973742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2601.02078","last_updated":"2026-06-30T05:51:48Z","snapshot_observed_at":"2026-08-03T12:41:49.134646Z","submitted_at":"2026-01-05T12:59:39Z","title":"Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T18:02:11.393346Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2601.02078"},"observation_digest":"sha256:612575483f1fcef7e81ed339a480e93dd730e7b61102f58ee65fe9efbe46a6d3","observation_id":"b060b4c2-c937-4879-af64-61f8eb6bad38","resolution":{"observed_at":"2026-05-16T18:03:12.254711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-03T12:41:52.377539Z","title":"Meta-World: A Benchmark and Eval- uation for Multi-Task and Meta Reinforcement Learn- ing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.02078","last_updated":"2026-06-30T05:51:48Z","snapshot_observed_at":"2026-08-03T12:41:49.134646Z","submitted_at":"2026-01-05T12:59:39Z","title":"Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:41:52.377539Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2601.02078"},"observation_digest":"sha256:2c33b14aca6ffdd764bcaad5f707dfb91c11c20ee43076b8b1c7f853e708e34b","observation_id":"e5b699d9-b8bd-45e2-b267-8f2aad3b133e","resolution":{"observed_at":"2026-08-03T12:41:52.377539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-03T07:04:45.145593Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.21416","last_updated":"2026-06-24T09:10:01Z","snapshot_observed_at":"2026-08-07T14:43:05.513047Z","submitted_at":"2026-01-29T08:55:53Z","title":"Spotlighting Task-Relevant Features: Object-Centric Representations for Better Generalization in Robotic Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T07:04:45.145593Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2601.21416"},"observation_digest":"sha256:c0dcc2c3c617b586d11ae7b6f99c61fc80ee0e646286167d75e3892edbca7ca3","observation_id":"1eb96b86-9466-4797-9884-693295768816","resolution":{"observed_at":"2026-08-03T07:04:45.145593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-02T23:49:03.275426Z","title":"Meta- world: A benchmark and evaluation for multi-task and meta reinforcement learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.12628","last_updated":"2026-06-04T11:43:40Z","snapshot_observed_at":"2026-08-07T04:25:54.227988Z","submitted_at":"2026-02-13T05:15:50Z","title":"Beyond Imitation: Reinforcement Learning-Based Sim-Real Co-Training for VLA Models","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:03.275426Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2602.12628"},"observation_digest":"sha256:ba3feca394b629c6c4686ff536cc7fb40c10d688ca7fa75f220870a25ecf6d7c","observation_id":"1a8bc444-43a8-4f04-963c-e6bc63f7afc4","resolution":{"observed_at":"2026-08-02T23:49:03.275426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2604.02349","last_updated":"2026-02-19T02:11:01Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-02-19T02:11:01Z","title":"OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-15T21:38:53.792221Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2604.02349"},"observation_digest":"sha256:b79784f60c09c955a7081d90505be030c0f16b334bb7f00178d1645b40fa8d4f","observation_id":"b202aa51-212b-4f49-92dc-9b10bf3266f7","resolution":{"observed_at":"2026-05-15T21:40:20.975501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2604.09860","last_updated":"2026-05-14T17:31:57Z","snapshot_observed_at":"2026-08-03T02:21:58.413211Z","submitted_at":"2026-04-10T19:42:21Z","title":"RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:16.091095Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2604.09860"},"observation_digest":"sha256:69c389760d9b198db59871aa85cbdf59e5c4d46bcc3a8400724b2616ef1d4dea","observation_id":"0caa017d-3bf2-4430-8796-f0be4dfd4438","resolution":{"observed_at":"2026-05-11T08:11:05.047902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2604.09860","last_updated":"2026-05-14T17:31:57Z","snapshot_observed_at":"2026-08-03T02:21:58.413211Z","submitted_at":"2026-04-10T19:42:21Z","title":"RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T06:28:08.468872Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2604.09860"},"observation_digest":"sha256:25c907c25b130805d1b1ea077f94f646a9e02183f618516dbdf00229c487cf4a","observation_id":"2f0cae3d-c263-4016-9386-ec76e126e983","resolution":{"observed_at":"2026-05-15T06:29:49.656170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2604.17876","last_updated":"2026-04-20T06:38:01Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:38:01Z","title":"OFlow: Injecting Object-Aware Temporal Flow Matching for Robust Robotic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T04:50:33.134927Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2604.17876"},"observation_digest":"sha256:16228a4920f26a5caae99cdab376dbd0c30040385ee5505b4b6a7393e4a4c44e","observation_id":"f2537333-ad9f-4c1c-9e01-a3072b159154","resolution":{"observed_at":"2026-05-10T11:30:20.092660Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2604.23001","last_updated":"2026-04-24T20:41:59Z","snapshot_observed_at":"2026-07-06T23:09:19.041332Z","submitted_at":"2026-04-24T20:41:59Z","title":"Vision-Language-Action in Robotics: A Survey of Datasets, Benchmarks, and Data Engines","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T11:30:49.414976Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2604.23001"},"observation_digest":"sha256:51d1c4cb69a1b119c12f57d524ee594954fedc06cfe9f59504de3c313268e006","observation_id":"b6e8c212-2c22-4ea8-9dd8-2b4887c5a391","resolution":{"observed_at":"2026-05-11T19:36:14.199217Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.09727","last_updated":"2026-05-10T19:52:29Z","snapshot_observed_at":"2026-07-31T17:23:23.893636Z","submitted_at":"2026-05-10T19:52:29Z","title":"One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T03:46:21.786972Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.09727"},"observation_digest":"sha256:237dc5daa105fc4128f04d9371e4df83a915cbf46ef3b51b2b05ddbfaa8afe65","observation_id":"8fd0347b-5701-4638-ba50-a720e98b9bf6","resolution":{"observed_at":"2026-05-12T06:56:32.016009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T05:33:19.038889Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:535e6856ae46947eaa370c2d3bb8966785ca52106f6ae589fac3bcff5ba8508c","observation_id":"ca892969-ab63-47de-8e28-6d7787f02cd4","resolution":{"observed_at":"2026-05-12T05:36:24.551858Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T06:27:38.643667Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:0111a2dd75ad045a5b03b994464bf95eaaf587cb7ccec3ae17c034b0a154eb7c","observation_id":"258d10cd-746b-45ce-a440-ec8a8cb5eb87","resolution":{"observed_at":"2026-05-13T06:32:24.795487Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T23:04:12.943222Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:5cbdbfab22f05a09f165ff7daa152f59ec8eedfe85f7929d435b56de8012b675","observation_id":"d1523e7b-96be-4edc-bded-f9f91f037422","resolution":{"observed_at":"2026-05-20T23:09:12.691712Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":221,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:17fcbd3a0bb18c3f5687cb1769287f5b401311789fae2156fb973168216bec49","observation_id":"819ffc5c-76a4-492c-a821-6c4d6cf21501","resolution":{"observed_at":"2026-05-13T05:07:18.022270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.14598","last_updated":"2026-05-21T03:24:31Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:06:01Z","title":"DSSP: Diffusion State Space Policy with Full-History Encoding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T10:17:44.804745Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.14598"},"observation_digest":"sha256:4a19b30cc6f49aa2d4be9ba1475891b072bb061afd764ccaf2b89d4d8d253fca","observation_id":"21a976ec-06e3-434e-b6c2-6983734eeb25","resolution":{"observed_at":"2026-05-22T10:21:24.477079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2605.18617","last_updated":"2026-05-18T16:26:22Z","snapshot_observed_at":"2026-08-02T22:44:13.274745Z","submitted_at":"2026-05-18T16:26:22Z","title":"ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T09:55:17.865828Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2605.18617"},"observation_digest":"sha256:ba629d60a91fda480c4f744beadfffb97e5c9e781b9e49718cb5c75776ab8514","observation_id":"34ebb7b3-8e34-4a12-89b7-929353053f8f","resolution":{"observed_at":"2026-05-20T09:58:11.292322Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.17446","last_updated":"2026-06-16T03:00:58Z","snapshot_observed_at":"2026-07-06T23:53:02.028020Z","submitted_at":"2026-06-16T03:00:58Z","title":"AnnotateAnything: Automatic Annotation of 3D Assets for Robot Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T01:15:50.904741Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.17446"},"observation_digest":"sha256:24c23a4a439a41e9fd3806ba45490412013b559271e920c122053ea24020ae81","observation_id":"0640bdf4-86d7-477c-8bbb-779080011d17","resolution":{"observed_at":"2026-07-03T20:38:55.399084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.17511","last_updated":"2026-06-16T04:42:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-16T04:42:43Z","title":"MagicSim: A Unified Infrastructure for Executable Embodied Interaction","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-06-27T01:00:07.465292Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.17511"},"observation_digest":"sha256:a93626f61ed5df7e680530e9a637b5c3f6e3e284f91c1c9dd9d2251673384f1d","observation_id":"c2b63716-6a45-4e35-b8c7-7ce7def21f27","resolution":{"observed_at":"2026-07-03T20:58:58.042858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.19328","last_updated":"2026-06-22T15:12:05Z","snapshot_observed_at":"2026-07-06T23:54:37.596257Z","submitted_at":"2026-06-17T17:54:32Z","title":"UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T21:27:31.026539Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.19328"},"observation_digest":"sha256:e595abaa883193a035ed4b038b39a14f0fc4cd4c377be6881861e5b8813b5ce4","observation_id":"0eba7caf-d046-41a7-aa0a-c69bf7836554","resolution":{"observed_at":"2026-07-04T00:09:14.984897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.20272","last_updated":"2026-06-18T14:17:38Z","snapshot_observed_at":"2026-08-07T11:42:09.084013Z","submitted_at":"2026-06-18T14:17:38Z","title":"Efficiently Linking Real Scenes with Synthetic Data Generation for AI-based Cognitive Robotics and Computer Vision Applications","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T16:56:34.009246Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.20272"},"observation_digest":"sha256:fbdfa26ef09825f7975561096cd0eddfdf446e5a482f15e652f78a21d84eb858","observation_id":"29cae255-e016-4900-bc62-da97fc6e54b2","resolution":{"observed_at":"2026-07-04T04:29:35.490985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.20781","last_updated":"2026-06-18T17:05:19Z","snapshot_observed_at":"2026-08-03T05:46:19.564000Z","submitted_at":"2026-06-18T17:05:19Z","title":"World Action Models: A Survey","version":1},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-06-26T17:11:12.686936Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.20781"},"observation_digest":"sha256:b87a1cfab8591a99ebaa7db8c0fc5ff2ec68b93822e775ad7a9a4a8b451db790","observation_id":"b2ef1e5d-3fa9-459f-8a35-289d1acbdf8f","resolution":{"observed_at":"2026-07-04T04:09:35.502417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.10897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-04T14:09:52.691576Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"42b3081e-43bd-451c-b777-259c81be7953","year":2021},"citing_paper":{"arxiv_id":"2606.27348","last_updated":"2026-06-25T17:54:36Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:54:36Z","title":"Bridging Performance and Generalization in Reinforcement Learning for Agile Flight","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T04:33:20.981811Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2606.27348"},"observation_digest":"sha256:73eba7a9b7bf4fcec756b6bc1ed26356a5bbdc371d33242dfe299fc8e872c3f5","observation_id":"8868467a-30b5-499b-b8d0-70de6622717a","resolution":{"observed_at":"2026-07-04T14:09:52.693618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-14T12:45:19.511401Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10309","last_updated":"2026-07-11T13:28:50Z","snapshot_observed_at":"2026-08-04T14:09:35.332189Z","submitted_at":"2026-07-11T13:28:50Z","title":"Measure the Sim-to-Real Gap: Designing an Affordable Real-World Benchmark Platform for Reinforcement Learning in AIoT Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T12:45:19.511401Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2607.10309"},"observation_digest":"sha256:c613e3a45e4e9a4e7059711c3df9a018ed453cf9fb3b26f29cb6b6adef70d157","observation_id":"77e6409c-2337-4703-aad7-5bfe76c1ab26","resolution":{"observed_at":"2026-07-14T12:45:19.511401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-07-31T19:04:35.520074Z","title":"Meta- world: A benchmark and evaluation for multi-task and meta reinforcement learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.24292","last_updated":"2026-07-27T11:39:22Z","snapshot_observed_at":"2026-08-07T12:54:19.753424Z","submitted_at":"2026-07-27T11:39:22Z","title":"Learning Adaptive Multi-Task Guidance, Navigation, and Control via Hypernetworks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-31T19:04:35.520074Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2607.24292"},"observation_digest":"sha256:0fa6b68c45514e9d02c3a772d9e16f2a5fb87e3f37457b94d4b5d1cc6ba220d3","observation_id":"475cc60e-e3f6-4151-b798-6b1f392b64a8","resolution":{"observed_at":"2026-07-31T19:04:35.520074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10897","snapshot_observed_at":"2026-08-04T19:45:35.411244Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":292,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.411244Z"},"links":{"cited_paper":"/paper/1910.10897","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:d39068e9f2de8656a32a5f8249597abe2eda6c4a0c1713485b59d662045d13dd","observation_id":"16198af1-af7c-42f5-9203-57d531e0a003","resolution":{"observed_at":"2026-08-04T19:45:35.411244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1910.10897/citation-record","integrity":"/paper/1910.10897/integrity","json":"/paper/1910.10897/citation-record.json","paper":"/paper/1910.10897"},"outbound":[],"paper":{"arxiv_id":"1910.10897","last_updated":"2021-06-14T18:45:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T08:31:50.962710Z","submitted_at":"2019-10-24T03:19:46Z","title":"Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:1910.10897."}