{"as_of":"2026-08-13T05:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1355e38069d1b2bb8fd7702cbfab107bd5ac7c0c5cf47ea722b520571f75646b","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:35:45.216969Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14117/citation-record","integrity":"/paper/2411.14117/integrity","json":"/paper/2411.14117/citation-record.json","paper":"/paper/2411.14117"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:46.011090Z","title":null,"venue":null,"work_id":"f766ce36-3358-448d-bc7b-738b37bde2c4","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.978107Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:faba8e0615d4d9f7f409581c2a90cce39cc549554b60266139b3660f5c164618","observation_id":"8c03c2f1-3955-4a42-bb79-2017de7fbb0e","resolution":{"observed_at":"2026-08-12T15:35:46.015738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02057","last_updated":"2019-07-03T17:53:02Z","snapshot_observed_at":"2026-08-12T19:51:32.307910Z","submitted_at":"2019-07-03T17:53:02Z","title":"Benchmarking Model-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02057","snapshot_observed_at":"2026-08-12T15:35:44.982960Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.982960Z"},"links":{"cited_paper":"/paper/1907.02057","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:fa64836a4960c34c7320b3019acea0f6e89c04e0aec01ddbcc4bd82acbcb283a","observation_id":"269ac6e4-6165-43f1-aeb8-afd36f297efe","resolution":{"observed_at":"2026-08-12T15:35:44.982960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.996734Z","title":null,"venue":null,"work_id":"377dc149-d5b0-4e4e-825e-83e1046a99ea","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.987738Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:2bfb1192bd9f995003e7d4ad180454a6bcb0111edb85ab6e0fc091940870dbbe","observation_id":"f3aef3f4-6a10-4691-89b6-3d9cdf795567","resolution":{"observed_at":"2026-08-12T15:35:46.001132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T15:35:44.992299Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.992299Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b2906e250134ccab2cb68f57b58df9c654a8479894b64b11a16e0a24119ee8db","observation_id":"3ab944f9-6c9e-460a-a8c4-d0f3b13af426","resolution":{"observed_at":"2026-08-12T15:35:44.992299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.982622Z","title":null,"venue":null,"work_id":"8cd8aadf-91ef-4e32-8a6e-d9a1d138b865","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.996868Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:d7eb648913c961ed0ab8708c9f88ee6a8f85275ae86a33c11f711608658b0f02","observation_id":"6fb764a1-469d-4907-a2f4-d29679e71365","resolution":{"observed_at":"2026-08-12T15:35:45.986964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.001120Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.001120Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:c3ed608605171c4a575c0684de00eb9692f76ff2f43c7589f759059fc3ba4282","observation_id":"e131744a-38b5-4932-8178-37e7e972ae9e","resolution":{"observed_at":"2026-08-12T15:35:45.001120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-12T15:35:45.005915Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.005915Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a374af70933f6500d01add826aae128e8e286dc37f03567f7d64641a323b1783","observation_id":"bafc96b3-882d-48d0-be22-3ff938456992","resolution":{"observed_at":"2026-08-12T15:35:45.005915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.010427Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.010427Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:69b55153700d8299f2abb73e35d5f1edbee456281b704f712f4d3552196b2767","observation_id":"f043b2a2-a197-4e44-890a-2a7bb122a263","resolution":{"observed_at":"2026-08-12T15:35:45.010427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-12T15:35:45.014552Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.014552Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:d8dd8f2c6353a2f19c84af583d1f09c1826c172ccf0c47e1d7dbd1bf67c4bf39","observation_id":"93f0eda1-99d7-42e3-9b63-7af122204aea","resolution":{"observed_at":"2026-08-12T15:35:45.014552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.950156Z","title":null,"venue":null,"work_id":"98f95d07-b43a-4a0e-bd12-4d6119272a07","year":2004},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.018974Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f942a8f6ae81f084763640799cd2ed60343a407c7b4ad02a26631adac7aa4157","observation_id":"731561b1-41cb-4c8d-a126-05d6acc60d60","resolution":{"observed_at":"2026-08-12T15:35:45.954784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.936053Z","title":"Nagabandi, G","venue":null,"work_id":"15826990-2c7c-4262-8250-87173c8e2fe1","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.023032Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:74558ba170d6650a2bb1912df125287cfda4ef6c6b82478c4e6cd4740e8243d7","observation_id":"96be4f45-61f8-40b3-a26b-410dbfc1f1d0","resolution":{"observed_at":"2026-08-12T15:35:45.940579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-08-13T05:40:28.055216Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-12T15:35:45.027499Z","title":"Burda, H","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.027499Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:31ea6cc8ee97c4feff028ee4009aa904cb8ec89e43c8e68e047a6a911ccdfbdb","observation_id":"3adf0fcf-377e-4daf-90b1-24af6a87ef40","resolution":{"observed_at":"2026-08-12T15:35:45.027499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.031956Z","title":"Pathak, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.031956Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f94816e5a42fcbb8254168baf0c86b30ea91d494116be6c060921a67d9cb795e","observation_id":"899e97a0-3a40-4929-aae6-86dbe05be88b","resolution":{"observed_at":"2026-08-12T15:35:45.031956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.912938Z","title":"Ecoffet, J","venue":null,"work_id":"8c24f1bc-d57b-4c06-9b1f-b4937aa2dc2b","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.036048Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:abb6c312e19d9d648b03f8f217a7feaf8b517b5f73dbb5a0be8b0a6bcd53b1b1","observation_id":"d65da31d-fe8e-4f11-b5fe-84737a3f3c1f","resolution":{"observed_at":"2026-08-12T15:35:45.917471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07607","last_updated":"2021-03-19T01:44:03Z","snapshot_observed_at":"2026-08-03T18:49:34.905088Z","submitted_at":"2021-03-13T03:26:33Z","title":"Solving Compositional Reinforcement Learning Problems via Task Reduction","version":2},"cited_work":{"arxiv_id":"2103.07607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.07607","snapshot_observed_at":"2026-08-12T15:35:45.428347Z","title":"Solving Compositional Reinforcement Learning Problems via Task Reduction","venue":"cs.LG","work_id":"1fbe8172-c4bc-4322-936c-2f050cd49a15","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.040132Z"},"links":{"cited_paper":"/paper/2103.07607","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:44fb826b191c82236e4addd350dbae00e93a063f8aa5326dc173d4f3a3d403e0","observation_id":"c338e191-d828-4787-af7d-8d646381f06a","resolution":{"observed_at":"2026-08-12T15:35:45.434144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.899103Z","title":null,"venue":null,"work_id":"1a672c97-f285-4330-8653-6cd3963ff504","year":1960},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.044494Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:03cc23fecfe013b34930cae7634d920b6b0eb3931f4660caf20ff948f64f3221","observation_id":"4f2e967f-cbd3-4eb3-8a76-bc4fc5ac8653","resolution":{"observed_at":"2026-08-12T15:35:45.903546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.885558Z","title":null,"venue":null,"work_id":"ca57ad45-c98e-4dd0-afcd-824d053aedf9","year":1997},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.048629Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:60ce4e7228d2a593f6a564daa50734fde791d61be08a754ce369421ca996035b","observation_id":"8ca60b06-7182-43ac-bd3d-b992b624e733","resolution":{"observed_at":"2026-08-12T15:35:45.889779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.871640Z","title":"Bengio, O","venue":null,"work_id":"845e1ceb-e559-4187-b752-0e42eb710fdb","year":2005},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.052629Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:0c2f561703fc8be86eee176c2dec5ce13249801c1c1289694b04787da380723c","observation_id":"ae311b89-b37f-4630-b7e5-cde6f3c8f616","resolution":{"observed_at":"2026-08-12T15:35:45.875883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.856955Z","title":null,"venue":null,"work_id":"f32949e3-6589-4934-9af5-e595906f82e5","year":1995},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.056924Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:14f930d81254d9adda95c5cc0565b656a0db029516cc1a11087ccdb1e438aab2","observation_id":"c89dde70-772d-49fb-9743-eba132b8e259","resolution":{"observed_at":"2026-08-12T15:35:45.861780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.842289Z","title":"Arora, P","venue":null,"work_id":"5f7f4112-30ba-45e1-9e70-ec3196708822","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.061223Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:535fbcefcdaf42b73627a6b9fa21149eb37b53a8983e72a6909997b159572a6c","observation_id":"2cc4c5cf-a95b-4905-bba8-5b637c7f88a3","resolution":{"observed_at":"2026-08-12T15:35:45.846476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-12T15:35:45.065264Z","title":"Levine, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.065264Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:c42d1f8bbcb4baf119fb5d01e1b53530209cd30c90504be9441c8e264ef6ceaf","observation_id":"c4831cbe-9330-4f15-9d4f-daa58c02f845","resolution":{"observed_at":"2026-08-12T15:35:45.065264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-12T15:35:45.069587Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.069587Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:c33c0e2fa6276c27e4449b7a181561690eeccd773b17dc32a21c038f75140b7f","observation_id":"812b6d2e-788e-4a73-9deb-d202bd578e94","resolution":{"observed_at":"2026-08-12T15:35:45.069587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03379","last_updated":"2024-05-06T11:33:12Z","snapshot_observed_at":"2026-08-13T00:14:04.831565Z","submitted_at":"2024-05-06T11:33:12Z","title":"Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03379","snapshot_observed_at":"2026-08-12T15:35:45.074234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.074234Z"},"links":{"cited_paper":"/paper/2405.03379","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a2d9c3bf558fe7d8eaea3ec212faca8af8e92eeac6e6c32f30fa9d50fdd007cf","observation_id":"f9041b35-fe36-4577-a0a7-77816c98da68","resolution":{"observed_at":"2026-08-12T15:35:45.074234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.828654Z","title":"Bellemare, S","venue":null,"work_id":"523733cf-8611-4897-bc5c-c49b1e1fa68a","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.078620Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:81b151439cb3116b16434d4bb8645d5570529b8baa38d01968030b3247c0e036","observation_id":"818814a3-9b32-4c71-be15-00875c91e26b","resolution":{"observed_at":"2026-08-12T15:35:45.832892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.814952Z","title":"Dorigo, M","venue":null,"work_id":"793c9e69-be19-4eb9-909f-948c7ec7dd22","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.082705Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:e69f2a254c92a1cf9bcf530406add14533946d09cecf27c44683691dfb223e2d","observation_id":"81f6577c-2e32-4fa2-a14f-763a745c7f9e","resolution":{"observed_at":"2026-08-12T15:35:45.819245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.801157Z","title":null,"venue":null,"work_id":"5b719be0-12c9-4174-9189-89e573f5f3b8","year":1999},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.086908Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:72f16cce6b5c6fe76711416fc2741c88f37d221b040807b6e79bbb8856a382b8","observation_id":"d0c38087-da04-458a-82ca-29ec07182890","resolution":{"observed_at":"2026-08-12T15:35:45.805769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.05397","last_updated":"2016-11-16T18:21:29Z","snapshot_observed_at":"2026-08-08T00:00:13.424932Z","submitted_at":"2016-11-16T18:21:29Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.05397","snapshot_observed_at":"2026-08-12T15:35:45.091302Z","title":"Jaderberg, V","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.091302Z"},"links":{"cited_paper":"/paper/1611.05397","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:674282b430f3b2f2a261aa636bb4365f7c7e32b552d275df2dd0679ded663350","observation_id":"4b334c15-c2de-4cde-96cf-d0ed9e6ca2d1","resolution":{"observed_at":"2026-08-12T15:35:45.091302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15191","last_updated":"2021-10-28T15:07:01Z","snapshot_observed_at":"2026-08-10T13:21:23.930310Z","submitted_at":"2021-10-28T15:07:01Z","title":"URLB: Unsupervised Reinforcement Learning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15191","snapshot_observed_at":"2026-08-12T15:35:45.095797Z","title":"Laskin, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.095797Z"},"links":{"cited_paper":"/paper/2110.15191","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:588245b8d9d3310478890d12e50dd9612e6d958318822e22919163da3a93b382","observation_id":"73f7cebe-834c-40db-8fea-5ad3d08731cc","resolution":{"observed_at":"2026-08-12T15:35:45.095797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.787156Z","title":"Hazan, S","venue":null,"work_id":"2d52e3b0-ddf4-4066-bf6e-56d26be6a00f","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.099963Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:64946c0f6063327907e267d17d8463105b3cb7dc816758303879780c5cc790e2","observation_id":"3cea27d8-29d7-44a2-9e76-9c735d988da8","resolution":{"observed_at":"2026-08-12T15:35:45.791530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.103881Z","title":"Andrychowicz, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.103881Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:780f0f06d059eecf08b93601994e0d2fe6a78fc96afac8c361a3ecef9d47e953","observation_id":"1e96a738-59cd-45e2-8bc9-c4cae87786cf","resolution":{"observed_at":"2026-08-12T15:35:45.103881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.764548Z","title":"Nachum, S","venue":null,"work_id":"d3925b37-4323-4963-b360-de9ce9b33991","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.108026Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:acfef97f983510455089f26aa37159b915d30b542cbed3475c668e57e4129fc8","observation_id":"8e3e9767-5167-4fc3-9e19-162572bb7a52","resolution":{"observed_at":"2026-08-12T15:35:45.768796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.112044Z","title":"Lakshminarayanan, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.112044Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:2b95bfa3efb1aa34a88c784bfdb89687ac403d977cba6c930297306de3d9d0d6","observation_id":"5e77f476-0863-4ac3-8e15-84e7f838c3e0","resolution":{"observed_at":"2026-08-12T15:35:45.112044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.741981Z","title":"Dimakopoulou, B","venue":null,"work_id":"db8908d8-c2a1-4ee6-a46f-4ec2d6e19754","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.116983Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:8eeb1d255f8e7bcb7179ae5953452114b2c2f0914cc7f188aac143341854b747","observation_id":"227a36f7-dd76-47be-9473-b94f42c97fd7","resolution":{"observed_at":"2026-08-12T15:35:45.746359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48456/tr-209","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.306066Z","title":null,"venue":null,"work_id":"a66786f6-ecf3-4e75-972d-104706dec7c6","year":1990},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.121210Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:4b18b81c2de1cde6e109b75e9f820843726edbdb37a77fcf261141daf51ef581","observation_id":"b3a435ea-c3ae-4a2b-a07c-62c944574662","resolution":{"observed_at":"2026-08-12T15:35:45.310568Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.727982Z","title":null,"venue":null,"work_id":"d780cc53-cb02-4cd3-a1af-aa8c7afb12a1","year":1995},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.125464Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:1d5ba9f265b86d865a1823519e061c489b609883fcacc90d6accbe5c04391211","observation_id":"ff2d13f0-35f3-408e-8ba4-981e937334ee","resolution":{"observed_at":"2026-08-12T15:35:45.732079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1742-6596/1706/","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.292221Z","title":"Bahamid, A","venue":null,"work_id":"5dc23e11-16b2-4c27-8d50-9cce3cc78b96","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.129834Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:89fee31e7690260ea913e8e28f28955e76160709459658dd2b49a521659b9e6c","observation_id":"126591c7-f003-406e-a959-1cecb20cf072","resolution":{"observed_at":"2026-08-12T15:35:45.296578Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.713924Z","title":"Kuindersma, R","venue":null,"work_id":"42d70961-449d-4079-b688-cbefb7e314a4","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.134001Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:9bce8b3ad469a7739680c5b5e2ec75b5f53a92c8c2d64f162f252d7a6bc1ae3f","observation_id":"61a37186-a39c-4291-b0f9-c0437ea88270","resolution":{"observed_at":"2026-08-12T15:35:45.718381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.11103","last_updated":"2019-06-19T17:40:58Z","snapshot_observed_at":"2026-07-06T07:23:52.401834Z","submitted_at":"2018-12-26T10:07:13Z","title":"Learning to Walk via Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.11103","snapshot_observed_at":"2026-08-12T15:35:45.137994Z","title":"Haarnoja, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.137994Z"},"links":{"cited_paper":"/paper/1812.11103","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:dd4aa648245278208ab34903c9552af7ce5c074edc5a6ec78f83336a8159e057","observation_id":"d48c30cf-93be-4c67-9b7f-8c95c882bd28","resolution":{"observed_at":"2026-08-12T15:35:45.137994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.700243Z","title":null,"venue":null,"work_id":"568e0e0e-801f-48af-b018-c1647c73f6cb","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.142190Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f5cb3a86c98f5e7d005cbae39d5ed8ab9d7046a795bb7d3f2f554b219c7ad038","observation_id":"fa0e5d3a-bf8e-40b1-befb-787cb2f5abb9","resolution":{"observed_at":"2026-08-12T15:35:45.704811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.685810Z","title":null,"venue":null,"work_id":"0fc639f1-3f20-4ded-9746-efdcdc18d58d","year":1977},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.146009Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:1d1bf4d1b1d3eee6db0b5e341c082fc21b17096c03c767679344a75f976629eb","observation_id":"cfe11ae1-9ca8-4d5b-9555-e0f04a428668","resolution":{"observed_at":"2026-08-12T15:35:45.690506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.670627Z","title":"Frenkel, B","venue":null,"work_id":"1a87b4a0-d6c9-41ce-8c34-1feb63fe8b84","year":1996},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.149903Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a0f0701ed51fb1f7f3ab7f92fb95ab762266d7c969dbbadd9f67647a47608cae","observation_id":"32d9f9f5-45d2-4254-a2e2-59ff5548f673","resolution":{"observed_at":"2026-08-12T15:35:45.675332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/9780470141649.ch12","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.277612Z","title":null,"venue":null,"work_id":"f9db2dad-f51e-4977-8537-0c47514c4313","year":2007},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.153846Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a0636d982be2659dc21180ce3e0732420eaac54f4735462560c20c605624cd10","observation_id":"9c7da0f9-0fae-4a53-9827-b2d697117396","resolution":{"observed_at":"2026-08-12T15:35:45.282276Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/08927020500035937","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.263105Z","title":null,"venue":null,"work_id":"7b589e56-95ae-4909-b766-56751662d20f","year":2005},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.157841Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:6e932d8dd913d1009ba52e6a815e7358c668cc58ee3d1c2649c6c0727785299f","observation_id":"001300a0-ef10-462f-9fe6-376e038fcda8","resolution":{"observed_at":"2026-08-12T15:35:45.267563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1063/1.475474","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.247910Z","title":null,"venue":null,"work_id":"d03d017e-27ad-4ce6-9fbd-fd1febae193a","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.162527Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:715c41cfc0641b2d3807c9f358ac1251dcabd35166cf837095c5aa0c14886c45","observation_id":"3eea8772-fede-4fd3-92ef-5c79bb6b89e3","resolution":{"observed_at":"2026-08-12T15:35:45.253645Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.656608Z","title":null,"venue":null,"work_id":"ae10374b-e84f-4de1-b6ce-03ca08767818","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.166713Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:9f4f868e510201a63cfea5992f9b016034bc857fc7e2dea76ca1ba15d1eb7f3d","observation_id":"4cd611dd-c0f8-4de6-a071-fcf49242d54a","resolution":{"observed_at":"2026-08-12T15:35:45.660996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.642932Z","title":"Ahmed, N","venue":null,"work_id":"b1e0c0d6-507f-4f70-840d-3a9cc170086c","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.170795Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:0a44778454b1dc82b3b0513feedd99b7810c776a9577abe8b0161a4bc630848f","observation_id":"8976d82d-876c-463d-b1a5-9ebb31dc8929","resolution":{"observed_at":"2026-08-12T15:35:45.647250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.628991Z","title":null,"venue":null,"work_id":"82e6bc97-68a3-4cf2-9774-d11aec0f1ac8","year":2009},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.174928Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:005bd8e58bbddf2a109465009fc80a840e2c0f9675b96ac7f91eb7b03876e61e","observation_id":"76a9b212-5da9-488b-b66d-2a58f19a891b","resolution":{"observed_at":"2026-08-12T15:35:45.633417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.614374Z","title":"Agarwal, N","venue":null,"work_id":"8855a153-731e-4cf6-b054-b9828cd50db0","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.179016Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:23ae31cf276af4f6e749b1c0999f2de02f54b5c4ac5dbe256a059c1eca8347d6","observation_id":"39b8f27f-8535-4e4e-bb3a-83c3411630fb","resolution":{"observed_at":"2026-08-12T15:35:45.618821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.183426Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.183426Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a6a38ee73b8b82b625495fbf9b334f171f1fbfbd5dd6ec0019b50bf8ab55ffbd","observation_id":"a8050567-252e-4442-8398-b30f69c3d6d6","resolution":{"observed_at":"2026-08-12T15:35:45.183426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.590583Z","title":"Ekroot, T","venue":null,"work_id":"7f0fd45c-0dd4-4bf3-885c-fb0e16e4b5b5","year":1993},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.187605Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:641c1a1f3b8a72fff6e8a36a263e173616880e453d46047ac4f88ea23de6a0a6","observation_id":"b657c16e-51ce-4f24-99ad-d3be952b023a","resolution":{"observed_at":"2026-08-12T15:35:45.595447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07798","last_updated":"2017-05-22T15:06:25Z","snapshot_observed_at":"2026-07-06T05:43:40.624942Z","submitted_at":"2017-05-22T15:06:25Z","title":"A unified view of entropy-regularized Markov decision processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07798","snapshot_observed_at":"2026-08-12T15:35:45.191801Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.191801Z"},"links":{"cited_paper":"/paper/1705.07798","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:dba65e65823df132478d1b17bebe6469b207dad4433842f80a8340bcf7c83812","observation_id":"1c53672a-5b5a-43b3-81a5-d47f8c058c7a","resolution":{"observed_at":"2026-08-12T15:35:45.191801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.576599Z","title":"LeCun, L","venue":null,"work_id":"e333edd6-0bd6-479b-b2c9-0e57d4d09731","year":2002},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.196361Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:d1ca98d179191d49161c537df2519d863946bd3eb0f2b770523fe88db0d81a86","observation_id":"fb8596ec-8ad5-43d1-88fd-16f4909adf4e","resolution":{"observed_at":"2026-08-12T15:35:45.580784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.200395Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.200395Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:49c49c889677d50d5e1e8b7f7ef431d1a0983acaec01a9322a8685264f659fe3","observation_id":"932635eb-6c1c-4ca7-99f1-7c760bcc91af","resolution":{"observed_at":"2026-08-12T15:35:45.200395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.553737Z","title":"Bellman, A markovian decision process, Journal of mathematics and mechanics (1957) 679–684","venue":null,"work_id":"0e9393c9-f4a4-48ad-bd63-7521d83c7f3c","year":1957},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.204568Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b085a20d0fb22afa025158b4dc9f0f2b14cd4e77c7bf789d03786bee7c3755b1","observation_id":"355b5e81-9b96-402a-8e79-43489a7a9955","resolution":{"observed_at":"2026-08-12T15:35:45.558026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.539963Z","title":null,"venue":null,"work_id":"6adb8819-8774-42b8-a3c1-231ccf7ebe17","year":1992},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.208874Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:661390b2222451ff250a66fc2a1e67d1df6170d5add3ddf6024c847c27d3135b","observation_id":"28262085-fc33-49fe-ae16-b4e8482591d2","resolution":{"observed_at":"2026-08-12T15:35:45.544251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.525583Z","title":"Amari, Natural gradient works efficiently in learning, Neural com- putation 10 (2) (1998) 251–276","venue":null,"work_id":"78594b68-130d-4915-883c-9a24a329fdd1","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.212885Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:8fb8a42d186b08664ea1635bcc841251f0d6047effda0912d77f27ee2f7934b7","observation_id":"a0c2d909-d0da-4548-8d1e-c4120eba3cca","resolution":{"observed_at":"2026-08-12T15:35:45.530692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.511456Z","title":"∞X i=1 γi−1r(si, ai) s0=s,a0=a # , (A.4) which is termed in RL as","venue":null,"work_id":"4ef0f02e-bdce-439c-9dbb-04da4afd2356","year":2011},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.216969Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:ddc4bc2f629f06e661585512e1b7872720ab62ee4939a6a393f975a9ef35b8c3","observation_id":"d668816b-529a-4907-85ba-4712fa1615a1","resolution":{"observed_at":"2026-08-12T15:35:45.515925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T18:16:54.811430Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":5,"verified_fuzzy":18},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2411.14117."}