Pith. sign in

Paper Citation Record · LEDGER

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance

As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.06615.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.06615 v1

Coverage vector

measured 35 of 35 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:06:27.128981Z

measured 35 of 35 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

35 of 35 outbound references displayed

  • verified exact1
  • verified fuzzy29
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6956b067-8341-46e0-bcbd-64795b02225e · outbound

This paper cites Dynamic programming.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Dynamic programming

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.120493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.120493Z digest=sha256:82d3e880dfef405d05f4ad885006fe59897810750b9040cec90b26b8ba6d0d5f

Observation af101913-8a09-4c41-8e5b-c7de8da6b9f2 · outbound

This paper cites OpenAI Gym.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance OpenAI Gym

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.142902Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.142902Z digest=sha256:e7213c31c59b60ac12e2f4170a950144c36d448bcadb5c3c969281da9363b1d0

Observation 34431820-cad1-4701-beac-8212532aa7fc · outbound

This paper cites Multitask learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multitask learning

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.750463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.236390Z digest=sha256:397386e9dfe96b692d756e862f19430d1e92b942ffb9f12c3486b781bedab33d

Observation 0c35eeb8-bef0-40c6-9f1b-7770423608ce · outbound

This paper cites Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.734718Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.320478Z digest=sha256:44908929c811c51810d1d3789e3de4f895c35d4efd175e7e912193acd1b1b119

Observation d248c66f-4a2b-44e9-91d2-24c7eca148c3 · outbound

This paper cites Multi-task reinforcement learning with task representation method.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with task representation method

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.716411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.413057Z digest=sha256:091dd77665ab6e0a89ff340cb28431ebc07a9a398f121e07adbc815ddece7346

Observation 9de1f464-3e53-4755-8767-6d82f0270712 · outbound

This paper cites Soft Actor-Critic for Discrete Action Settings.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Soft Actor-Critic for Discrete Action Settings

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.517932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.517932Z digest=sha256:5770543eaadc54d441f422a693a0123d4cd3b4311068806ac3fe24c8a65289cf

Observation ead5de88-ef60-4ba9-b730-12769cb6e820 · outbound

This paper cites Divide- and-conquer reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Divide- and-conquer reinforcement learning

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.696517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.614414Z digest=sha256:20a4939bdde9bfbdceaef979e2a81b5f9e25c0ccda4a79f66786818cef1f0519

Observation 6ef8dc4f-3342-4c2c-86c4-449f807a9ccb · outbound

This paper cites Reinforcement learning with deep energy-based policies.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Reinforcement learning with deep energy-based policies

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.678620Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.746446Z digest=sha256:b938197bf6c4e16b9cd7b1f2fefa23ae758a327b0a9f7884dd8b378564873c30

Observation 16bb38e4-780d-4e03-91d3-dec7f354261c · outbound

This paper cites Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.655915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.791807Z digest=sha256:4dca3f0d16f9f459e821112260ca2e2f6f735f054bd08efd568e56f32f9aed33

Observation 0ebc75cf-1afd-4094-845d-af7ef6f61713 · outbound

This paper cites Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.640033Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:26.925117Z digest=sha256:8b292df0680cf77d027951e6d277a7ff43b2271bfffd480e370c63983b4c9330

Observation 4eb6ac94-69b8-4c8a-abea-48aed0d715bf · outbound

This paper cites Benchmark environments for multitask learning in continuous domains.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Benchmark environments for multitask learning in continuous domains

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.623634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.001434Z digest=sha256:bc066fbafcc87104cb1cc1102573d56a35fe7a185e27a77df41283174893d002

Observation a8939339-cf84-4fdc-9900-350b4174c8ef · outbound

This paper cites End-to-end training of deep visuomotor policies.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance End-to-end training of deep visuomotor policies

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:27.019997Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:27.019997Z digest=sha256:565928a3491a439e9d6b4d423d57734ca1f0012e95688d002c5de03657fd97a4

Observation 2176921b-bc88-4841-b2a8-0ba171809721 · outbound

This paper cites Lillicrap, Jonathan J.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Lillicrap, Jonathan J

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.590920Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.025033Z digest=sha256:64040714db7e9889fd0ca9d656fac012590336e7d9bc2ab5beee4da4047f1afa

Observation 87174cbe-8b2a-4034-bce1-3a1152b3dbc6 · outbound

This paper cites Conflict-averse gradient descent for multi-task learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Conflict-averse gradient descent for multi-task learning

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.573810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.029335Z digest=sha256:20f491347481c98f6b429828b757690fa4e729e4120504fa1c66101053844eec

Observation 2b49c235-0949-4445-82fb-b8b63b001962 · outbound

This paper cites Q- functionals for value-based continuous control.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Q- functionals for value-based continuous control

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.553417Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.034309Z digest=sha256:d55db3bb61c548708b11e675e739a2a25eb7fe65eb18ba97b1cd1e84fa6f5f84

Observation 1db05804-1920-4860-8fee-fadb7139911b · outbound

This paper cites Rusu, Joel Veness, Marc G.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Rusu, Joel Veness, Marc G

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.537789Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.038650Z digest=sha256:649827087a63ddd8bb4129dcbadc1dd3fadf34d015b23d9ee220d51c7323db47

Observation 4f258522-cbea-488b-970d-d9e46d6f86fa · outbound

This paper cites Overcoming exploration in reinforcement learning with demonstrations.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Overcoming exploration in reinforcement learning with demonstrations

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.516705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.042996Z digest=sha256:1b899041d7e5d1b63613162e10b4b1a73c30a65cf74ed784f842409c9cfc8e97

Observation 163539aa-9b26-4d44-94bf-750e50195f4e · outbound

This paper cites Markov Decision Processes: Discrete Stochastic Dynamic Programming.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Markov Decision Processes: Discrete Stochastic Dynamic Programming

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.494440Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.047261Z digest=sha256:fa934685f89aaae6c46095864b8c92a2b19c1393cb90d57c4540a4e2d42b1b1e

Observation 2194e526-57fb-41da-a89e-54786c8fc73d · outbound

This paper cites An Overview of Multi-Task Learning in Deep Neural Networks.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance An Overview of Multi-Task Learning in Deep Neural Networks

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:27.051585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:27.051585Z digest=sha256:f0b7300741d2cbc8f21dc2c93d574474dec5a65b6c5c5f9a847cdd6b601e1ab1

Observation 4bef9725-1cdc-4db8-b924-a907e05a1350 · outbound

This paper cites Hierarchical and interpretable skill acqui- sition in multi-task reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Hierarchical and interpretable skill acqui- sition in multi-task reinforcement learning

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.478520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.056121Z digest=sha256:0cd6c580117feedd4735cefef5de7ad420edc9a0973a8f22437d53765825754f

Observation f460c02b-9ff7-401b-b39c-8a451cc4b64f · outbound

This paper cites Multi-task reinforcement learning with context- based representations.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with context- based representations

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.462446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.060861Z digest=sha256:431c0f94664811df7e7a4fb228afcf202d270a71b3826414b46d35af91e97ed2

Observation 8f79f070-122f-407e-b8fc-4b0d5f47fbe5 · outbound

This paper cites PaCo: Parameter- compositional multi-task reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance PaCo: Parameter- compositional multi-task reinforcement learning

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.447306Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.065190Z digest=sha256:aab64d52d378ebef809338434a57d284684692ded300cf1e9ac522cd0dc98a8c

Observation 2b9f67cb-074c-445a-83ca-e899be6f3b62 · outbound

This paper cites Czarnecki, John Quan, James Kirkpatrick, Raia Hadsell, Nicolas Heess, and Razvan Pascanu.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Czarnecki, John Quan, James Kirkpatrick, Raia Hadsell, Nicolas Heess, and Razvan Pascanu

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.432196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.069827Z digest=sha256:98ae8af7c19259416a168c1295fd3f7a646e1b8e72f10f4e633c57217c03e642

Observation 158b1812-c2ad-4633-84a0-8b8e28132152 · outbound

This paper cites MuJoCo: A physics engine for model-based control.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance MuJoCo: A physics engine for model-based control

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.417318Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.074908Z digest=sha256:97ba6fa91c98971094600ba622c5e72008fcb673afe6ea249a59b81d38a3bbeb

Observation efcaf77a-b41a-4b39-b64b-899e88b3409e · outbound

This paper cites A survey of multi-task deep reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance A survey of multi-task deep reinforcement learning

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.399752Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.080098Z digest=sha256:1fa74b5c6b91a424d7b88c17b14abd1fb2b5b16171f76c698f5cbbf1d4437908

Observation 2f491275-5314-4ac8-ae9a-aca732c37924 · outbound

This paper cites Disentan- gling transfer in continual reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Disentan- gling transfer in continual reinforcement learning

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.384113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.085271Z digest=sha256:46d4e88a28f65b24ec117d3d53ba23d98ed72644bf9aed038e8aa5b6ae7ad41b

Observation 8f63fe28-5d59-4ced-b086-b51e99ab9290 · outbound

This paper cites Multi-task reinforcement learning with soft modularization.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with soft modularization

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.367994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.089372Z digest=sha256:a93cbefca66d53ab7566d54c87b425b2d52edb8274ff90a59f485b77dfb256e3

Observation e64095ba-b40e-49bf-82fa-fdc5b6a898cc · outbound

This paper cites Mastering complex control in MOBA games with deep reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Mastering complex control in MOBA games with deep reinforcement learning

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.350804Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.094458Z digest=sha256:98d32d1a1a29213a5d264b0f3d712de3b9e1d97526b7b207f7275f944f4491ce

Observation 42273352-30d9-4d66-b59b-9720cee13b2d · outbound

This paper cites Conservative data sharing for multi-task offline reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Conservative data sharing for multi-task offline reinforcement learning

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.333739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.099348Z digest=sha256:03c53fbd2590cdb163be78cf36a6cad529e7e714b38ec935768374ad88dd9b8d

Observation 6980ee7d-36ad-44b6-8cc9-56000f31aaa3 · outbound

This paper cites Gradient surgery for multi-task learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Gradient surgery for multi-task learning

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.316401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.104218Z digest=sha256:71906f313d4a87bf044886216a96e291ee7858061abc9807ca033736fd516a1c

Observation f910f7ae-4f18-40d3-a21a-d8be669fb90d · outbound

This paper cites Meta-World: A benchmark and evaluation for multi-task and meta reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Meta-World: A benchmark and evaluation for multi-task and meta reinforcement learning

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.299987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.108928Z digest=sha256:b07b0fd0c40944718810ad9639e0b5148bbdb36f13323103f8b90a63e28274e0

Observation ac343e8c-760f-49a8-ba43-6f5424df160a · outbound

This paper cites QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-08-06T19:06:27.177284Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.113427Z digest=sha256:11ca8ab4196c4975758de7059b1614549b6f097b4db4a892a51d728625080875

Observation 471e7da7-456e-48e7-941e-bb1777e50947 · outbound

This paper cites CUP: Critic-guided policy reuse.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance CUP: Critic-guided policy reuse

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.282117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.118550Z digest=sha256:958385419e0766c2464f2bb8d71e907de4aad1b8aa4a46e6991b31f205bdb5bb

Observation 25376279-8414-45bf-8121-e2fe020ec629 · outbound

This paper cites t+K−1X t′=t γt′−t (Ri(st′, at′) +αiH(πi(·|st′))) # + γKEst+K∼Pi h ˆQ˜g i (st+K, i) i = Eat′ ∼πi,st′+1∼Pi.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance t+K−1X t′=t γt′−t (Ri(st′, at′) +αiH(πi(·|st′))) # + γKEst+K∼Pi h ˆQ˜g i (st+K, i) i = Eat′ ∼πi,st′+1∼Pi

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.265399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.123453Z digest=sha256:0bb8eb27f6c7a9e52c300569c35e0a38b53e2a0339ec32eee17d9a6161c0b458

Observation ef72a0e4-770a-45bb-ab68-b30d2601b72d · outbound

This paper cites Under the initial episode length setting of 150 timesteps, 42 tasks achieve a success rate exceeding 90%.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Under the initial episode length setting of 150 timesteps, 42 tasks achieve a success rate exceeding 90%

Reference 150

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.250052Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T19:06:27.128981Z digest=sha256:4695d55db5df2ae80e0360d236c39efb5967b7443402a12e2ad9555229b28ab1

Pith citing papers

No inbound Pith citation observations are available.