Pith. sign in

Paper Citation Record · LEDGER

Sharing Knowledge in Multi-Task Deep Reinforcement Learning

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2401.09561.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2401.09561 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 5 of 5 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 5 of 5 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T15:01:37.151431Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T12:43:17.104343Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9fa734c7-c9bd-4406-9caf-68df19480dff · inbound

R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO cites this paper.

R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T15:01:37.151431Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:01:37.151431Z digest=sha256:67752ed53cb372381d30351e97b16e7bb13a38575dc5c41bd7f396a4e28e1130

Observation 6bdd67e9-d369-45f6-b848-1100e2971cc9 · inbound

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer cites this paper.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.837762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.837762Z digest=sha256:3eb5eff61d07cdd1a16d6d4ed6db8fef3c09fbb8c1901d78d763eebf079c0bf2

Observation 8ba952df-173c-40fe-b674-9c1bd1cd6a21 · inbound

Simple Optimizers for Convex Aligned Multi-Objective Optimization cites this paper.

Simple Optimizers for Convex Aligned Multi-Objective Optimization Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T05:05:47.717567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T05:05:47.717567Z digest=sha256:7d03cb7866d11c871b4016da2a9dd19a51330e9116d7eeda88623431129c8317

Observation 6a040d2d-aeeb-425d-9402-f8041e325a75 · inbound

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent cites this paper.

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 31

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T20:46:35.727996Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-15T20:46:15.275441Z digest=sha256:5847a0109dcad92416486b970d65203672dadc75fe8381d7d42b18025b4ec1ae

Observation 3749d4d8-7da5-4bd8-a68a-3d081de3661b · inbound

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization cites this paper.

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 100

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:43:17.107008Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-05-20T12:39:50.004269Z digest=sha256:ae6d5eb01af4cfea3b239a81f4a05858e75da666aa000d8f17c571cc47768637