{"as_of":"2026-08-09T23:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65296dd43d8be749708a91bbad15347849281559178002dba551c1d9d757860b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:09:25.527110Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":48,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-11T10:47:44.152066Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2309.07864"},"observation_digest":"sha256:fe0e274977171d1372b67a663f821162b6d65af56a9bc368e8b6f85fea6e54db","observation_id":"bd31f41d-5841-42f9-bb41-4f9d1443c9dc","resolution":{"observed_at":"2026-05-11T10:47:49.601815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-09T17:09:25.527110Z","title":"A survey of meta-reinforcement learn- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.527110Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:81bcf551f1e906f706221c64d07fef7dc0ee4f8a4a692beb21f357dd4c49b95d","observation_id":"827f82a1-f7ad-441d-a5ac-50b99948f016","resolution":{"observed_at":"2026-08-09T17:09:25.527110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-09T15:09:20.446330Z","title":"Z., Xiong, Z., Zintgraf, L., Finn, C., and Whiteson, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01492","last_updated":"2025-02-03T16:26:17Z","snapshot_observed_at":"2026-08-09T15:05:11.762339Z","submitted_at":"2025-02-03T16:26:17Z","title":"Develop AI Agents for System Engineering in Factorio","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T15:09:20.446330Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2502.01492"},"observation_digest":"sha256:adfdcf709faa72324a6fa8bff2dea7bbc7d7463feaf8d0e1ec37d70110c5a64f","observation_id":"ae91eb9c-5e3a-4e74-971c-2b444f76ddc9","resolution":{"observed_at":"2026-08-09T15:09:20.446330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T23:14:16.328951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08950","last_updated":"2025-02-13T04:17:43Z","snapshot_observed_at":"2026-08-09T16:50:33.452673Z","submitted_at":"2025-02-13T04:17:43Z","title":"Single-Agent Planning in a Multi-Agent System: A Unified Framework for Type-Based Planners","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T23:14:16.328951Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2502.08950"},"observation_digest":"sha256:174f1d1e31507f305043ecf9280aaa3eaae0957c93c3ff85f6d4be23c5839ada","observation_id":"85f5dfe9-ec56-472c-bd9a-99d729a56631","resolution":{"observed_at":"2026-08-07T23:14:16.328951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T19:10:00.113728Z","title":"A survey of meta-reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10177","last_updated":"2025-03-02T08:14:27Z","snapshot_observed_at":"2026-08-07T19:03:58.124857Z","submitted_at":"2025-02-14T14:12:09Z","title":"STMA: A Spatio-Temporal Memory Agent for Long-Horizon Embodied Task Planning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T19:10:00.113728Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2502.10177"},"observation_digest":"sha256:8ec428956b9706ca907a42fa5ff326cb08273c0b471d69dda8e6181cf600f6f3","observation_id":"69d9991e-1950-405c-bbc6-0ecfb25be90b","resolution":{"observed_at":"2026-08-07T19:10:00.113728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T15:27:53.611965Z","title":"A survey of meta-reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15143","last_updated":"2025-05-21T06:00:41Z","snapshot_observed_at":"2026-08-08T06:05:52.295070Z","submitted_at":"2025-05-21T06:00:41Z","title":"Filtering Learning Histories Enhances In-Context Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:27:53.611965Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2505.15143"},"observation_digest":"sha256:fa527888982b7614b81102f11c5a6ecd1369e4b236bdc1fbe7c07629425a4801","observation_id":"45f2e769-48f3-4c95-83cd-1b4cea426905","resolution":{"observed_at":"2026-08-07T15:27:53.611965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T13:15:57.942175Z","title":"A survey of meta-reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22442","last_updated":"2026-07-15T19:14:08Z","snapshot_observed_at":"2026-08-07T13:04:48.525626Z","submitted_at":"2025-05-28T15:07:24Z","title":"Fully Offline Reinforcement Learning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:15:57.942175Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2505.22442"},"observation_digest":"sha256:ba84e251aa96ab08db4fa3cf51d2f2fa6077e062c6feb877d06444cf5bfb5bf0","observation_id":"14fff60b-933b-4eff-8483-c0f9dc237f61","resolution":{"observed_at":"2026-08-07T13:15:57.942175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T10:47:01.535236Z","title":"A survey of meta-reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-09T22:09:44.577765Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.535236Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:aee2f2986a1d16c9d59f2cdf8b9879aca2f7702e1d1b312811ac5df4565bc7da","observation_id":"d3912036-18b6-4530-8977-ca777f3445fc","resolution":{"observed_at":"2026-08-07T10:47:01.535236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T05:52:47.134864Z","title":"doi: 10.1023/A: 1013689704352","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06891","last_updated":"2026-06-05T23:54:28Z","snapshot_observed_at":"2026-08-08T05:12:56.302606Z","submitted_at":"2025-06-07T18:39:47Z","title":"Robust In-Context Reinforcement Learning Under Reward Poisoning Attacks","version":3},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-07T05:52:47.134864Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2506.06891"},"observation_digest":"sha256:c7a3584146f8f1f6dba997a8f89c44ed85332dfc104f8f39e7aba9d041ea9384","observation_id":"60c842f6-b19c-4219-8770-a2d2879e6b58","resolution":{"observed_at":"2026-08-07T05:52:47.134864Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-06T18:15:42.311817Z","title":"Z., Xiong, Z., Zintgraf, L., Finn, C., and Whiteson, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09041","last_updated":"2025-07-11T21:36:19Z","snapshot_observed_at":"2026-08-09T05:31:23.348356Z","submitted_at":"2025-07-11T21:36:19Z","title":"Behavioral Exploration: Learning to Explore via In-Context Adaptation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T18:15:42.311817Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2507.09041"},"observation_digest":"sha256:b923888743ca9b0026ae96c825dd38d74e509500ce98acc0f1ca3090a383e765","observation_id":"225f2833-5557-4fcc-893b-3bf91fd56b0f","resolution":{"observed_at":"2026-08-06T18:15:42.311817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-06T14:48:45.339004Z","title":"A Survey of Meta - Reinforcement Learning , August 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17668","last_updated":"2025-09-10T12:25:27Z","snapshot_observed_at":"2026-08-08T15:32:47.481175Z","submitted_at":"2025-07-23T16:31:38Z","title":"How Should We Meta-Learn Reinforcement Learning Algorithms?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:48:45.339004Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2507.17668"},"observation_digest":"sha256:29d1453981b4806ee06fef5851a1b549c769d89e59483106f5a64f233ccc1983","observation_id":"59369bea-951d-4879-922e-ac071fdf0ea3","resolution":{"observed_at":"2026-08-06T14:48:45.339004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T05:59:56.168767Z","title":"A Survey of Meta-Reinforcement Learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04628","last_updated":"2025-09-04T19:29:02Z","snapshot_observed_at":"2026-08-09T14:07:17.651207Z","submitted_at":"2025-09-04T19:29:02Z","title":"Action Chunking with Transformers for Image-Based Spacecraft Guidance and Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:59:56.168767Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2509.04628"},"observation_digest":"sha256:7123c51e9ac6aa7ce7044cfd92f4715fc851068306e107af94918e8a18ae9494","observation_id":"683289fe-91dc-4791-8999-9af641b436c9","resolution":{"observed_at":"2026-08-05T05:59:56.168767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2512.04341","last_updated":"2026-05-01T06:11:28Z","snapshot_observed_at":"2026-07-31T11:39:06.488911Z","submitted_at":"2025-12-04T00:07:08Z","title":"Long-Horizon Model-Based Offline Reinforcement Learning Without Explicit Conservatism","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T01:46:16.923948Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2512.04341"},"observation_digest":"sha256:db34229a809a6b71981fc539be009f0dd2a9555dc642561717f1941474b396ff","observation_id":"c6e774a5-87ba-4673-8d53-e47ee57090eb","resolution":{"observed_at":"2026-05-17T01:48:51.163438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2512.20974","last_updated":"2026-05-08T01:20:50Z","snapshot_observed_at":"2026-07-06T22:39:58.137482Z","submitted_at":"2025-12-24T06:00:51Z","title":"Generalised Linear Models in Deep Bayesian RL with Learnable Basis Functions","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-16T20:28:46.739742Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2512.20974"},"observation_digest":"sha256:ee52469db93e7a52b349f795f50c82076676db28f24aefe2d84112674d086952","observation_id":"98d02217-19bb-4280-9dea-a4aaf06a2ef1","resolution":{"observed_at":"2026-05-16T20:31:14.988946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2602.10503","last_updated":"2026-05-16T03:35:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T04:05:03Z","title":"Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T14:07:10.387869Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2602.10503"},"observation_digest":"sha256:aa0a64bbf51120bd050b71f3f55b4a56e57d6d6e94f4ea8fa8357a39bae9b4ec","observation_id":"9abd82dd-6b71-4ffd-90e8-b502cdbc6eed","resolution":{"observed_at":"2026-05-21T14:10:13.258937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2602.19837","last_updated":"2026-05-06T07:57:45Z","snapshot_observed_at":"2026-07-06T22:46:45.213871Z","submitted_at":"2026-02-23T13:39:58Z","title":"Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T20:46:15.275441Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2602.19837"},"observation_digest":"sha256:6a32d636a76b9000463d3af106df226ecc07c558f5f46f93a29bb10be0682578","observation_id":"4238129d-7615-4b4d-9c33-b2ff00c67f38","resolution":{"observed_at":"2026-05-15T20:46:35.716309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2605.02300","last_updated":"2026-05-04T07:48:02Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T07:48:02Z","title":"A Meta Reinforcement Learning Approach to Goals-Based Wealth Management","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-08T18:42:50.962120Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2605.02300"},"observation_digest":"sha256:7d11d5068cab9a355667611fead3389a5e10daa0a5fe89d3aef2ff3d88c3f5c2","observation_id":"363f90f5-c360-4fe4-b15c-2e3d8c7c6886","resolution":{"observed_at":"2026-05-08T18:44:01.443264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2606.00840","last_updated":"2026-05-30T18:31:57Z","snapshot_observed_at":"2026-07-06T23:41:30.158879Z","submitted_at":"2026-05-30T18:31:57Z","title":"Certificate-Guided Evaluation of Reinforcement Learning Generalization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T18:23:27.059117Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2606.00840"},"observation_digest":"sha256:5723d37dc8b1d53bee86f0343e5e3ff9dafbaf537f980566646838d440baab9f","observation_id":"53776305-ded8-4d2d-94b3-18c786f45477","resolution":{"observed_at":"2026-06-28T20:42:37.754644Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:599b0200cf74979dfeb0b75c8c909fb5c974ebc1341f82126812cea926027800","observation_id":"6db16b8c-5030-40f9-b1c8-2c7c846815d2","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2301.08028","doi":"10.48550/arxiv.2301.08028","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of meta-reinforcement learning","venue":"arXiv (Cornell University)","work_id":"501c5ba8-56a6-438e-8f03-a93ee1175c82","year":2023},"citing_paper":{"arxiv_id":"2606.24962","last_updated":"2026-06-23T09:13:08Z","snapshot_observed_at":"2026-08-04T02:44:08.654755Z","submitted_at":"2026-06-23T09:13:08Z","title":"Towards Scalable Multi-Task Reinforcement Learning with Large Decision Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T00:38:48.912290Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2606.24962"},"observation_digest":"sha256:bac79b1dc2eb5a188981b246d6a8bdc87f7353fc3b2e9cb34ee394f8a11e9acb","observation_id":"1426b008-29c7-463d-8e8c-353fc32af201","resolution":{"observed_at":"2026-07-04T16:29:57.133896Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-07-31T19:04:32.205336Z","title":"A tutorial on meta-reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24292","last_updated":"2026-07-27T11:39:22Z","snapshot_observed_at":"2026-08-07T12:54:19.753424Z","submitted_at":"2026-07-27T11:39:22Z","title":"Learning Adaptive Multi-Task Guidance, Navigation, and Control via Hypernetworks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T19:04:32.205336Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2607.24292"},"observation_digest":"sha256:93b6fa4f9e37c586bf57416b0181175653dc9ef1e4bdf1f9c31f1fb53c6a4784","observation_id":"e9a06953-df1a-4324-a09c-43cd8d594085","resolution":{"observed_at":"2026-07-31T19:04:32.205336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-06T00:32:39.844330Z","title":"arXiv preprint arXiv:2301.08028 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01205","last_updated":"2026-08-02T12:42:20Z","snapshot_observed_at":"2026-08-08T14:31:26.602348Z","submitted_at":"2026-08-02T12:42:20Z","title":"ReBRAC-v2: The Return of the King","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:32:39.844330Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2608.01205"},"observation_digest":"sha256:b3b381c9a9dbfd337720499d9db47c4674b03a4ae49ec6548c7517609d666e2e","observation_id":"03c40415-f36f-4610-b4ec-c8eb3f89f805","resolution":{"observed_at":"2026-08-06T00:32:39.844330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2301.08028/citation-record","integrity":"/paper/2301.08028/integrity","json":"/paper/2301.08028/citation-record.json","paper":"/paper/2301.08028"},"outbound":[],"paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2301.08028."}