{"as_of":"2026-08-08T12:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb6700e6294873187a2bf3cc8b59f93c25c0c1d98fba53b94d7d82d3cd51cf14","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:47:01.637523Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.04399/citation-record","integrity":"/paper/2506.04399/integrity","json":"/paper/2506.04399/citation-record.json","paper":"/paper/2506.04399"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T10:47:01.527997Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.527997Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:b7d5765ad24d3aeae3db015f9eed701ec53de7b16cf594dd605f9ebf5759ec9a","observation_id":"579c6bc8-2a7d-4361-ad89-3f9283335fc5","resolution":{"observed_at":"2026-08-07T10:47:01.527997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T10:47:01.531930Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.531930Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:b087fa9fe2e221bdbb463c44e5f92c63dac3283600af3e48724805bb5017947a","observation_id":"6d2dc8e3-3aed-4d96-8f56-1dfd00551205","resolution":{"observed_at":"2026-08-07T10:47:01.531930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-07T10:47:01.535236Z","title":"A survey of meta-reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.535236Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:040b5cd55f418c1e4a229c961d7a402672309a956965f4b5f52f18bc9270c5d0","observation_id":"d3912036-18b6-4530-8977-ca777f3445fc","resolution":{"observed_at":"2026-08-07T10:47:01.535236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:02.011345Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":"5bca44da-4d5b-4316-946b-7d49356114d6","year":2017},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.538523Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:0924945306f19737666d32a7189aaef08cbe5121503434b95bd44942ecf42663","observation_id":"08137d0e-0594-4be5-b703-4753709c0a9b","resolution":{"observed_at":"2026-08-07T10:47:02.014207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:02.002158Z","title":"A survey on offline reinforcement learning: Taxonomy, review, and open problems,","venue":null,"work_id":"0b34d8ce-b8af-43c2-b079-03756f64f006","year":2022},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.541793Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:136f5b736e74a43d32e1e283abbd23a63cb14f3718b02beccce0a11c51385aa8","observation_id":"699662dc-d3b9-45ae-a91c-06dbe4e96118","resolution":{"observed_at":"2026-08-07T10:47:02.005212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.01063","last_updated":"2019-03-04T04:00:38Z","snapshot_observed_at":"2026-07-06T07:36:47.845926Z","submitted_at":"2019-03-04T04:00:38Z","title":"NoRML: No-Reward Meta Learning","version":1},"cited_work":{"arxiv_id":"1903.01063","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.01063","snapshot_observed_at":"2026-08-07T10:47:01.735691Z","title":"NoRML: No-Reward Meta Learning","venue":"cs.LG","work_id":"3accbdb8-5c3c-46e4-9086-bc6b628b4c05","year":2019},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.544830Z"},"links":{"cited_paper":"/paper/1903.01063","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:7a96d4afa0c51ab8309f4ddb5c638ddbec518fdb46dfc0df085fd27f35b6bf70","observation_id":"0def7e88-2112-4f73-a5e7-22cca0e1754d","resolution":{"observed_at":"2026-08-07T10:47:01.738830Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11347","last_updated":"2019-02-27T19:23:41Z","snapshot_observed_at":"2026-08-07T15:15:34.263627Z","submitted_at":"2018-03-30T05:47:11Z","title":"Learning to Adapt in Dynamic, Real-World Environments Through Meta-Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11347","snapshot_observed_at":"2026-08-07T10:47:01.548476Z","title":"Learning to adapt: Meta-learning for model-based control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.548476Z"},"links":{"cited_paper":"/paper/1803.11347","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:5776db123b6b4b27dac821c96bd09850044128134cbaf999a63a312fc1ce201f","observation_id":"ca788da2-b6d1-47a6-a4a2-db18046ea372","resolution":{"observed_at":"2026-08-07T10:47:01.548476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.992931Z","title":"Context-aware dynamics model for generalization in model-based reinforcement learning,","venue":null,"work_id":"9995283a-b9c9-48cf-b3df-ac8f0660f1ea","year":2020},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.551512Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:6e22f88449124b110906588cbfc43cb64335cc0ddfae66a4f41525e9b2bebe7a","observation_id":"5c26b27b-7f56-4fe7-9daf-3d9f61085b25","resolution":{"observed_at":"2026-08-07T10:47:01.996397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.984649Z","title":"Rma: Rapid motor adaptation for legged robots,","venue":null,"work_id":"e0b817de-e95c-43b8-a0f3-8fdd642b99f9","year":2021},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.554292Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:b09feddb8c33218a8cf37684031cd2fb58e15c9523e377882a41fcfa1a253605","observation_id":"704fd244-6e72-4cc5-9bbc-811e8581194d","resolution":{"observed_at":"2026-08-07T10:47:01.987339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.975673Z","title":"Efficient off- policy meta-reinforcement learning via probabilistic context variables,","venue":null,"work_id":"950c1e38-1549-4846-b3ea-220623083f96","year":2019},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.557248Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:ab5c3a42152d6c13d3d3864a96b5cf36e6bf48e1b480bd4d2d8e0d5dfc961058","observation_id":"2e7692b4-b66f-4d38-ad29-4fd0d40a6fa9","resolution":{"observed_at":"2026-08-07T10:47:01.978888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08348","last_updated":"2020-02-27T19:40:21Z","snapshot_observed_at":"2026-08-08T08:15:46.182136Z","submitted_at":"2019-10-18T11:44:59Z","title":"VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08348","snapshot_observed_at":"2026-08-07T10:47:01.560107Z","title":"Varibad: A very good method for bayes-adaptive deep RL via meta-learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.560107Z"},"links":{"cited_paper":"/paper/1910.08348","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:28a2f74ccab55176e2bcee729c27a0a6abaf1c6350717801d9b9c401a695a295","observation_id":"91a1adaa-d2c2-4a48-b4ef-bfba33e0b3a5","resolution":{"observed_at":"2026-08-07T10:47:01.560107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.966614Z","title":"Evolutionary principles in self-referential learning, or on learning how to learn: the meta-meta-... hook. Institut f ¨ur Informatik, Technische Universit¨at M ¨unchen,","venue":null,"work_id":"5d9b6f6a-c66d-46fd-a4b5-1e64c970b4e3","year":1987},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.563343Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:639627e9c827646b5e567943fee115ea2faa6f53cb21928fd042b453e61ccfba","observation_id":"28b96007-477d-4698-a0bc-152454c66423","resolution":{"observed_at":"2026-08-07T10:47:01.969713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.958014Z","title":"Promp: Proximal meta-policy search,","venue":null,"work_id":"1fff53cf-262a-4ea2-8c03-0334070920fa","year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.566277Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:39e17f3be584d5e43e3905aef4d086fcfd234779b98a22c08f7dde6c92259e72","observation_id":"88da9622-0ca1-4818-b65e-30d0e15987b2","resolution":{"observed_at":"2026-08-07T10:47:01.960918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.948558Z","title":"A theoretical understanding of gradient bias in meta-reinforcement learning,","venue":null,"work_id":"00346c7b-b59b-4f29-b238-481d23c3db8b","year":2022},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.568950Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:145a5f11aa228861e25741e2cb8c99e69a4c809cc48e6013861febb30301fa40","observation_id":"9c44c5a4-9f49-4613-892c-08a1db29b399","resolution":{"observed_at":"2026-08-07T10:47:01.951749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.938713Z","title":"A simple neural attentive meta-learner","venue":null,"work_id":"32f2a47b-d1f6-46e5-be06-6726807ffb6b","year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.571680Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:79f3bf8b45c470a9b6be64fcc00f0f77be7410910c7430126ff10979264519bd","observation_id":"6ce7beec-184b-449d-9bef-83699efef3f9","resolution":{"observed_at":"2026-08-07T10:47:01.942015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.929866Z","title":"One-shot imitation learning","venue":null,"work_id":"b78ab0c6-1349-40d9-b6e7-523b7ab6da48","year":2017},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.574375Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:9f696fdb9c012245f96a37c2649166b603abce42e11b0f77ce0edef18152a41f","observation_id":"b6cad3d8-3323-4f17-afc6-1b086d224f85","resolution":{"observed_at":"2026-08-07T10:47:01.932749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.920091Z","title":"Meta- reinforcement learning of structured exploration strategies,","venue":null,"work_id":"b8cc8695-d805-48af-af59-6d8d42783217","year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.577198Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:f75abdba61c89c01403e3d7075da1fd3f3b326d7334c8f199e940338c64e3f32","observation_id":"2802b03c-ccce-4a1e-b56d-86c105be5953","resolution":{"observed_at":"2026-08-07T10:47:01.923420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09835","last_updated":"2017-09-28T15:59:41Z","snapshot_observed_at":"2026-07-06T05:53:24.061473Z","submitted_at":"2017-07-31T13:08:11Z","title":"Meta-SGD: Learning to Learn Quickly for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09835","snapshot_observed_at":"2026-08-07T10:47:01.579854Z","title":"Meta-sgd: Learning to learn quickly for few-shot learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.579854Z"},"links":{"cited_paper":"/paper/1707.09835","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:3d52a3bcfea179ef4a1e251ad8888fb4ed3304da86f47d872ba41c5b1c2d48b6","observation_id":"7ce6fef0-727b-49a7-9001-d4648ec4c009","resolution":{"observed_at":"2026-08-07T10:47:01.579854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.910863Z","title":"Multimodal model-agnostic meta-learning via task-aware modulation,","venue":null,"work_id":"9bf5e8d5-d9c3-4b81-b9f8-f26329cdfb4c","year":2019},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.582717Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:21b77deba41691443ab2205c4dfcb6df78bdd80f00a37580dc287193c042de20","observation_id":"121840d4-045c-4537-9d48-23cec949ff22","resolution":{"observed_at":"2026-08-07T10:47:01.913975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01613","last_updated":"2018-07-04T14:36:15Z","snapshot_observed_at":"2026-07-06T06:48:23.889615Z","submitted_at":"2018-07-04T14:36:15Z","title":"Conditional Neural Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01613","snapshot_observed_at":"2026-08-07T10:47:01.585537Z","title":"Conditional neural processes,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.585537Z"},"links":{"cited_paper":"/paper/1807.01613","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:4c05cfb3044424d35f944bb4a6352a32ae78e13aeb920d48a9a287ce0fa38bfc","observation_id":"3628f5e7-cf2b-46a8-aad9-7d8f8ec3c8b0","resolution":{"observed_at":"2026-08-07T10:47:01.585537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.901391Z","title":"Focal: Efficient fully-offline meta- reinforcement learning via distance metric learning and behavior reg- ularization,","venue":null,"work_id":"50b0a477-cadc-4f04-9c22-e63e09600c83","year":2020},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.588740Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:dff896fbc1f931dea21cffcc2a53b5bf8ec35c56f27ab564d53a2c540293239c","observation_id":"01ac44aa-508d-4434-947d-ae5f48197303","resolution":{"observed_at":"2026-08-07T10:47:01.904569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.591285Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.591285Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:faec67c899697d7282574072fbd390591983d90f7a4199c5b0f3637dc7bcb18a","observation_id":"c9830779-a760-4dfc-8761-51149b6cdef3","resolution":{"observed_at":"2026-08-07T10:47:01.591285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.885859Z","title":"Spatial multi-attention conditional neural processes,","venue":null,"work_id":"4db932e4-2fa4-4c0f-8ea5-d56fbe9a12f3","year":2024},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.594066Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:a7e750e9654e9e1beb942ee71589ac14e12ca5b3ceb404bbf6d7a358f50713b3","observation_id":"7c6221cf-026e-4270-89c5-19bba81c03f1","resolution":{"observed_at":"2026-08-07T10:47:01.889261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.876954Z","title":"Autoregressive conditional neural processes,","venue":null,"work_id":"28b2fcc1-a176-4ed3-8904-2943f9705ef4","year":2023},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.596680Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:e28e991418f5a7cb69efb277ec71f6ba1fcfef8723bc808b26210424e7b4b157","observation_id":"fe9b722f-2a66-4445-9430-216a215f6443","resolution":{"observed_at":"2026-08-07T10:47:01.880144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.867738Z","title":"Attentive neural processes,","venue":null,"work_id":"127ec103-9170-432b-9129-b4d8ca74cd13","year":2019},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.599322Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:a4fb239451bf0047751106425e94315ab4434de209bdd81d131a8d2bd9075247","observation_id":"3bba4b37-ce22-49f3-af35-14b02122e323","resolution":{"observed_at":"2026-08-07T10:47:01.870370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.859179Z","title":"Contrastive conditional neural processes,","venue":null,"work_id":"6f7bf793-bc63-4fc5-9883-f912d06f9e05","year":2022},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.601918Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:5518ec1bce1ff8299c4758ab8b322e1b96d049b48132c0cefb7dd05cadaecf9e","observation_id":"188f9c31-3c96-4e79-8ea1-2540990b5eae","resolution":{"observed_at":"2026-08-07T10:47:01.862100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.850470Z","title":"Conditional neural movement primitives","venue":null,"work_id":"d97fd1fd-132b-4db0-aabe-30ca81015bff","year":2019},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.604588Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:c589af81d9c2dad9a290a3ae6768b994826d91188efcabca10211943a0facc2b","observation_id":"6130c372-3647-4dc8-a38b-87b6f7aa3524","resolution":{"observed_at":"2026-08-07T10:47:01.853431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.841501Z","title":"Imitation and mirror systems in robots through deep modality blending networks,","venue":null,"work_id":"aaec5eac-8cd1-493e-b85c-6e947de2bfa1","year":2022},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.607280Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:a6bc73da22e2040cf463fa2ba25f8888fcf55b0a9e8ce33cf9f04d92664e9e55","observation_id":"d1d17069-040d-45ca-a310-8ef944d674e8","resolution":{"observed_at":"2026-08-07T10:47:01.844494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.14934","last_updated":"2021-12-21T20:20:02Z","snapshot_observed_at":"2026-08-03T13:48:36.585285Z","submitted_at":"2021-11-29T20:20:29Z","title":"Generative Adversarial Networks with Conditional Neural Movement Primitives for An Interactive Generative Drawing Tool","version":2},"cited_work":{"arxiv_id":"2111.14934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.14934","snapshot_observed_at":"2026-08-07T10:47:01.685051Z","title":"Generative Adversarial Networks with Conditional Neural Movement Primitives for An Interactive Generative Drawing Tool","venue":"cs.GR","work_id":"71845313-3278-415e-8238-29346c424cae","year":2021},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.610170Z"},"links":{"cited_paper":"/paper/2111.14934","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:e0d124de8859aa592325c36697b6ead7b04f4f3abe7f7bceec0ca1c0f26748e6","observation_id":"f47ddd6d-f794-466e-907b-8115a1263a74","resolution":{"observed_at":"2026-08-07T10:47:01.690039Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.832531Z","title":null,"venue":null,"work_id":"03d23019-d8c1-4c82-b299-8cd60f690a62","year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.613020Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:2805be999bb52b8750ac957107fca350d09188990e30f101848eeb9e708f0d95","observation_id":"5cf3238b-0754-4bc4-b69c-025046a6ddba","resolution":{"observed_at":"2026-08-07T10:47:01.835515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-07T10:47:01.615754Z","title":"High- dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.615754Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:5f5fbd6d2b706a4e94152816581a430ca865f16ab2f9cfdb02daf8897b59374c","observation_id":"aebc4b54-bc2b-4ad8-a666-ef3220662cbf","resolution":{"observed_at":"2026-08-07T10:47:01.615754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.823555Z","title":"Generalization in transfer learning: robust control of robot locomotion,","venue":null,"work_id":"31b24ebb-f1c3-422d-a5f8-1023c3bada8b","year":2022},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.618473Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:bd11c7768ec315b59c93ddc36a0bdfb2c4d94ba08d32c08a92b24dd6cffa521a","observation_id":"66cba75d-c799-43aa-815a-4be2150f1a0e","resolution":{"observed_at":"2026-08-07T10:47:01.826375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.814812Z","title":"Adam: Amethod for stochastic optimiza- tion,","venue":null,"work_id":"b8fe1968-3133-4561-a094-0bfc697a3595","year":2014},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.621180Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:3eaffc0042ca2c7fe6844238bd71f2206fd6bb9cba34fabafe24d8598f0c9cf0","observation_id":"162bad7c-49e0-447c-b2c6-3ceb39ff31d7","resolution":{"observed_at":"2026-08-07T10:47:01.817800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.805601Z","title":"Deep reinforce- ment learning in a handful of trials using probabilistic dynamics models,","venue":null,"work_id":"9724e122-b92d-4a13-bf88-da97b1f64731","year":2018},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.623680Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:538280db995b033bf0f100e58f02694a71833f7c5179507b121d70772c6ef506","observation_id":"e83a7dff-dc30-4465-8c6b-5eaa2cc07937","resolution":{"observed_at":"2026-08-07T10:47:01.808744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.796394Z","title":"Mujoco: A physics engine for model- based control,","venue":null,"work_id":"97118c19-fb8f-4775-9e59-7956937807b3","year":2012},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.626258Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:5d02f5d5d73a1f60a799df0452813a12579e70af3aa7e5f6f4c3a564f0a7165e","observation_id":"d570f6bd-1ca5-426a-b588-c755eee4f62e","resolution":{"observed_at":"2026-08-07T10:47:01.799343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-07T10:47:01.629002Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.629002Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:5903bc3b32c5e219c6fd39480a5bfa625df1e1657d5ac1519cad365f53996bc9","observation_id":"bd8beb11-f5ea-43b3-8b5f-bf0bc20042ed","resolution":{"observed_at":"2026-08-07T10:47:01.629002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.788006Z","title":"CaDM Code Repository ,","venue":null,"work_id":"a3774d96-e09a-4dd2-b143-18b053d2f39a","year":2020},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.631956Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:a4b8ee633e18d7092dc6f479a022d8e1e3b6d35d756a384dcce0a703e225fc01","observation_id":"20de5e37-65ac-4952-ba35-caab4c1d4f0a","resolution":{"observed_at":"2026-08-07T10:47:01.790741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.634639Z","title":"Model predictive control: Theory and practice—a survey,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.634639Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:d7f309db15b1c30e2151396fdc37fa3921e3765efa1cc221dad49490563920f4","observation_id":"a66394db-1e9e-4e3f-a1a6-64b40ff26d27","resolution":{"observed_at":"2026-08-07T10:47:01.634639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:47:01.773149Z","title":"The cross- entropy method for optimization,","venue":null,"work_id":"f712cd62-ed9d-43b1-b639-f5c93f809c1f","year":2013},"citing_paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:01.637523Z"},"links":{"citing_paper":"/paper/2506.04399"},"observation_digest":"sha256:373cafdefd402f32dc61edce06358ce78847349788d0de37bd959ba702f6e519","observation_id":"19ea6751-df84-412b-989f-49b47ee2e463","resolution":{"observed_at":"2026-08-07T10:47:01.776181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04399","last_updated":"2025-06-04T19:27:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T21:41:29.155410Z","submitted_at":"2025-06-04T19:27:47Z","title":"Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2506.04399."}