Pith. sign in

Paper Citation Record · LEDGER

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

As of 14 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 3 inbound Pith citation observations for arXiv:2505.24378.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.24378 v1

Coverage vector

measured 24 of 24 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:35:14.607554Z

measured 27 of 27 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T01:04:34.849053Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T12:43:17.310649Z

Reference resolution

24 of 24 outbound references displayed

  • verified exact1
  • verified fuzzy6
  • unresolved17
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 04fddee2-4a6e-4900-a0c7-10930673d72c · outbound

This paper cites Just pick a sign: Opti- 9 Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer mizing deep multitask models with gradient sign dropout.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Just pick a sign: Opti- 9 Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer mizing deep multitask models with gradient sign dropout

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:17.124607Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:12.769846Z digest=sha256:1ddde2f37af6da534a05769a422a0eb49c6169d6e90d7fafe1779512c62291b9

Observation 2d48a9a4-588f-484f-9032-5d700a9cc86c · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:15.823019Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.327115Z digest=sha256:7f478919defe8407a20d02c4b1fc0737525698016e14778a8054ec07da5b0dc7

Observation b3438e62-21a4-4ab9-93b5-7b3f01391e1b · outbound

This paper cites • Ant-dir (Rothfuss et al., 2018): We also use 40 tasks in this domain, each with a goal direction uniformly sampled in a two-dimensional plane.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer • Ant-dir (Rothfuss et al., 2018): We also use 40 tasks in this domain, each with a goal direction uniformly sampled in a two-dimensional plane

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:15.642171Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.420269Z digest=sha256:49ea80ccffe4b3ff53c0a9b8ac267d034a64c15275f26cf4f08fc282299b1990

Observation c1fd07ea-0051-4ac4-97ee-5d344ac90e01 · outbound

This paper cites HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:35:14.975476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:13.143440Z digest=sha256:c93344ee4a649778e0b89b3e233a360cf63a95c6592548fa9b67e7a8c1a58af8

Observation 491630cc-e785-4f44-8c35-d7c214675a63 · outbound

This paper cites MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.229953Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.229953Z digest=sha256:e63666010680a191e52fa3ecacd148f4d3840d1cc6b6bb6b68dd012ab9a20776

Observation adabe198-b1d7-4dc5-a23c-cd13232e3708 · outbound

This paper cites Scaling Laws for Neural Language Models.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Scaling Laws for Neural Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.315263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.315263Z digest=sha256:434ed5812a44a81b19213945ae6f8e809919375b64eaed06fb60becc5742f51f

Observation c59a1b14-129c-4f4c-bb18-50ade672fde3 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.487253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.487253Z digest=sha256:5ab2b3181add5f42ee484dcc22f065cace6534a18fa2f1fffd1eb0a9552c1e08

Observation aec23ad6-b798-4e70-80b2-758c11dcea5c · outbound

This paper cites Mixtures of Experts Unlock Parameter Scaling for Deep RL.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Mixtures of Experts Unlock Parameter Scaling for Deep RL

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.564548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.564548Z digest=sha256:6d953def11d2afef8340b8ad7a9348d9f975b0482b36025cb7625f6ed3f53bba

Observation 3678ca9a-82e2-4d80-a191-7c26c438dba8 · outbound

This paper cites A Generalist Agent.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer A Generalist Agent

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.654964Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.654964Z digest=sha256:15f8371de9f0de51f8ce5be99744a641d6dbe1e633473c59742de217e07cc9aa

Observation d7265020-c221-4cef-9738-fccb202a0634 · outbound

This paper cites ProMP: Proximal Meta-Policy Search.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer ProMP: Proximal Meta-Policy Search

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.765993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.765993Z digest=sha256:c607705dac62f313b699a28d09b15136fcbad4ff5520183049d691cc021824fd

Observation 3a1ca864-cf3d-4ad8-bfeb-1bb65cd6e5d3 · outbound

This paper cites Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.860623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.860623Z digest=sha256:6dab562d5dbb5b771bcf78541eaa82511835c369ba15cb8d6ae7c4011ba5522d

Observation 2b36b0e9-bb24-401d-8b6f-dc40103a9cc9 · outbound

This paper cites DeepMind Control Suite.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer DeepMind Control Suite

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.961550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.961550Z digest=sha256:4a4c2f9d4633faf50e702a9123cc4101708e969919a2fcd00750c336330f51b7

Observation 55313269-fe9c-48c5-8669-0975a8de8021 · outbound

This paper cites Mujoco: A physics engine for model-based control.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Mujoco: A physics engine for model-based control

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.556325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.039171Z digest=sha256:585bbeb1326958f2f0d01577222a7a881e5c92b5ccc1b9d64969a827a65b0b5f

Observation 1df36ed0-c404-4177-9bce-7ad80c6ed786 · outbound

This paper cites Gradient surgery for multi-task learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Gradient surgery for multi-task learning

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.313783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.179604Z digest=sha256:2db5aaf95220d2426bdb13f5b2b90fadf2ca35281d3e0d6377c7d209c1abe2fa

Observation a4ff5cff-50a1-4265-bd6c-9be30a2a879b · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:16.105061Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.241860Z digest=sha256:0bb719e4ca1c1d722e4daea64f987067d65f187d3a370a5611130368d5d2e343

Observation a6de40cf-6d40-4ef9-9fa8-58304b696205 · outbound

This paper cites Specifically, MTDT concatenates an embedding z and a state s as the input tokens, where z is the encoding of task ID.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Specifically, MTDT concatenates an embedding z and a state s as the input tokens, where z is the encoding of task ID

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:15.434093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.541414Z digest=sha256:f08276bd0ce3b91be01dba54ab4573bc9a1b8545725d540f720e130ab687d9bd

Observation ac75b570-90ea-4498-9817-371139bcd9eb · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:15.187832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:14.607554Z digest=sha256:9d1fa0905bc645229495078be89554d77a0830aa58602751708e4837a07caa36

Observation 8f98689c-31fd-415b-9586-303d31cb0c54 · outbound

This paper cites Vaswani, A.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Vaswani, A

Reference 2012

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:14.117474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:14.117474Z digest=sha256:42e0ba22b155eccd49df0b17b20940c1d3236a65b87fc3e484078ea5a623b288

Observation 3cd48894-bd5d-48fa-b2b2-8ae8f1ba6026 · outbound

This paper cites TD-MPC2: Scalable, Robust World Models for Continuous Control.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer TD-MPC2: Scalable, Robust World Models for Continuous Control

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.006265Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.006265Z digest=sha256:ddf24c516bcac05cdcbe192330e359b0bc51fa5729b0ac7fe0d7fc8b8421ffd2

Observation 6bdd67e9-d369-45f6-b848-1100e2971cc9 · outbound

This paper cites Sharing Knowledge in Multi-Task Deep Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.837762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.837762Z digest=sha256:37f2e9fbef0e137b4b262ef517851b341059f01832801fc7cde592ce71e0a282

Observation f9ba0b2f-03ca-4529-87c1-5b0b862d5916 · outbound

This paper cites D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.695169Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.695169Z digest=sha256:6f96ebd60b9691adb218459cc5d9d8d8b4eb4a63d7120401fb351b997cbae75c

Observation 338a3872-7299-4d8d-b0c0-3af546ca05ae · outbound

This paper cites GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.393018Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.393018Z digest=sha256:1b5b4965d9f383d5ce88cd6534092d4a34707b35ebdc23ffb7d7d01607e1a710

Observation 998767c1-e8e4-42ac-935d-36bbe357f3fd · outbound

This paper cites Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.079539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.079539Z digest=sha256:830f2c881155a35a10294a5d925b2559bb0f919fa9a59cd3c898f64bc88faf65

Observation 213688c6-2ada-451b-8f1b-8a205f367258 · outbound

This paper cites Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.842676Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-07T12:35:12.916188Z digest=sha256:1c8cfef34f73549e4de6c5c542615a240b53ac16dbf6ece7db0904a7e9601759

Pith citing papers

Observation a56c7209-6758-468a-b56e-c7469ec6d877 · inbound

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization cites this paper.

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 98

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:43:17.312593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=arxiv_source observed=2026-05-20T12:39:50.004269Z digest=sha256:67cdda2574c03dfb5f76110ff221073e9f44e7c69655ff3988109e019c2fb326

Observation 5e178e4c-d9c0-4f81-a733-df7c239a43f4 · inbound

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI cites this paper.

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 121

Resolution
unresolved
no resolver link, observed 2026-07-11T19:16:57.396710Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:16:57.396710Z digest=sha256:76ce9cc64c7cbfdac56f9e79d0551d5d90743b1b540a2723ff2db165ce0fb413

Observation 30b098a4-16bc-4552-8798-af175af70b62 · inbound

OPERA: Offline Policy-guided Expert Routing and Adaptation for Universal Biomedical Image Analysis cites this paper.

OPERA: Offline Policy-guided Expert Routing and Adaptation for Universal Biomedical Image Analysis Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T01:04:34.849053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T01:04:34.849053Z digest=sha256:8d9024d0dec9cdcb5204115bff7b5f1fb91132e78695e956c9413e4976fd6e8c