Pith. sign in

Paper Citation Record · LEDGER

Sharing Knowledge in Multi-Task Deep Reinforcement Learning

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2401.09561.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2401.09561 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 5 of 5 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 5 of 5 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T15:01:37.151431Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T12:43:17.104343Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9fa734c7-c9bd-4406-9caf-68df19480dff · inbound

R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO cites this paper.

R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T15:01:37.151431Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:01:37.151431Z digest=sha256:6ed1a20baa1a46c7f13522edffb5bf59e50a2d571bc1bf2ff6b40a837bf0a1dc

Observation 6bdd67e9-d369-45f6-b848-1100e2971cc9 · inbound

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer cites this paper.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.837762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.837762Z digest=sha256:ccb993f4f4b1365c7c61623d339f3161e0ffc0a02e7d2f2c72fb88052ae2554c

Observation 8ba952df-173c-40fe-b674-9c1bd1cd6a21 · inbound

Simple Optimizers for Convex Aligned Multi-Objective Optimization cites this paper.

Simple Optimizers for Convex Aligned Multi-Objective Optimization Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T05:05:47.717567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T05:05:47.717567Z digest=sha256:d2c795edc637acf921fb45645137b1b0b10e812144a1e596d721e24b0bd1241a

Observation 6a040d2d-aeeb-425d-9402-f8041e325a75 · inbound

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent cites this paper.

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 31

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T20:46:35.727996Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-15T20:46:15.275441Z digest=sha256:dace24ac087dd58d2afcf8e7ea7835b6f104eb26c10dd0fa39f5c74252e4649a

Observation 3749d4d8-7da5-4bd8-a68a-3d081de3661b · inbound

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization cites this paper.

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 100

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:43:17.107008Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-20T12:39:50.004269Z digest=sha256:bc53d397b42c950ced09dae059e46ef901da1feb9e1ba942c6b56ce532346be1