Pith. sign in

Paper Citation Record · LEDGER

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

As of 9 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 3 inbound Pith citation observations for arXiv:2505.24378.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.24378 v1

Coverage vector

measured 24 of 24 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:35:14.607554Z

measured 27 of 27 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T01:04:34.849053Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T12:43:17.310649Z

Reference resolution

24 of 24 outbound references displayed

  • verified exact1
  • verified fuzzy6
  • unresolved17
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 04fddee2-4a6e-4900-a0c7-10930673d72c · outbound

This paper cites Just pick a sign: Opti- 9 Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer mizing deep multitask models with gradient sign dropout.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Just pick a sign: Opti- 9 Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer mizing deep multitask models with gradient sign dropout

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:17.124607Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:12.769846Z digest=sha256:7c606a83c86c0f876400541c6b21e6ea11bdf6ab18537ff139c70ce41f33294a

Observation 2d48a9a4-588f-484f-9032-5d700a9cc86c · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:15.823019Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.327115Z digest=sha256:c5429f5028646bc9492f9b3f714ea74eaa6e29d798a3d1ca9a19bf6967de76f8

Observation b3438e62-21a4-4ab9-93b5-7b3f01391e1b · outbound

This paper cites • Ant-dir (Rothfuss et al., 2018): We also use 40 tasks in this domain, each with a goal direction uniformly sampled in a two-dimensional plane.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer • Ant-dir (Rothfuss et al., 2018): We also use 40 tasks in this domain, each with a goal direction uniformly sampled in a two-dimensional plane

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:15.642171Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.420269Z digest=sha256:8a5b0bd6b699805cdb118bb9bf7eaeab0e0beb2c7d39ad92ec78addfd6f3a40b

Observation c1fd07ea-0051-4ac4-97ee-5d344ac90e01 · outbound

This paper cites HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:35:14.975476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:13.143440Z digest=sha256:55e340947ebbd4fd8542161a580df9e9d3d2352d7b2c62f9af3389300e2448df

Observation 491630cc-e785-4f44-8c35-d7c214675a63 · outbound

This paper cites MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.229953Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.229953Z digest=sha256:e1304e1f75a526692ac485a8d73c6e020d7b1aa3460f931bbc08abc3e8e76e6e

Observation adabe198-b1d7-4dc5-a23c-cd13232e3708 · outbound

This paper cites Scaling Laws for Neural Language Models.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Scaling Laws for Neural Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.315263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.315263Z digest=sha256:f1989f36d461c86e7d7ae45fbdc1c080a2d180ba4698465088fb8f49c5670f1c

Observation c59a1b14-129c-4f4c-bb18-50ade672fde3 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.487253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.487253Z digest=sha256:4046b0c520180185d1e80bca8f36bb9bdb328c29b9d9a304e721fc07202cd70c

Observation aec23ad6-b798-4e70-80b2-758c11dcea5c · outbound

This paper cites Mixtures of Experts Unlock Parameter Scaling for Deep RL.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Mixtures of Experts Unlock Parameter Scaling for Deep RL

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.564548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.564548Z digest=sha256:2bcb470673003821cb11327e04465d8cc7f995687a18a6a790a9aab119355bee

Observation 3678ca9a-82e2-4d80-a191-7c26c438dba8 · outbound

This paper cites A Generalist Agent.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer A Generalist Agent

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.654964Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.654964Z digest=sha256:328d678cfffcb52c9c6941fe4c548885da5bff5cba20f48db8b4ff0e2a5cb8b4

Observation d7265020-c221-4cef-9738-fccb202a0634 · outbound

This paper cites ProMP: Proximal Meta-Policy Search.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer ProMP: Proximal Meta-Policy Search

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.765993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.765993Z digest=sha256:ce7a3b04b3413a05d2dc5a0f667d6c2ee5ac6a3c0c95006351a5a8ef3e1cb530

Observation 3a1ca864-cf3d-4ad8-bfeb-1bb65cd6e5d3 · outbound

This paper cites Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.860623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.860623Z digest=sha256:1900a8f6a03b3711533b3b208af26ebe251f8e7bb776a224ef099db5d2f09d1f

Observation 2b36b0e9-bb24-401d-8b6f-dc40103a9cc9 · outbound

This paper cites DeepMind Control Suite.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer DeepMind Control Suite

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.961550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.961550Z digest=sha256:1e3ea520c519f92a5270f80c2613d24c213c6dec1dd65ec3696b848e6f2c9c58

Observation 55313269-fe9c-48c5-8669-0975a8de8021 · outbound

This paper cites Mujoco: A physics engine for model-based control.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Mujoco: A physics engine for model-based control

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.556325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.039171Z digest=sha256:8aa0b23b053effc9ce59944147e369404160c52036bcb9089f3354d1653b12b5

Observation 1df36ed0-c404-4177-9bce-7ad80c6ed786 · outbound

This paper cites Gradient surgery for multi-task learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Gradient surgery for multi-task learning

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.313783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.179604Z digest=sha256:db2151df6c1ac000bd3760aa66df32cd01488409d321dd5f7b39746ebd3dfd78

Observation a4ff5cff-50a1-4265-bd6c-9be30a2a879b · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:16.105061Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.241860Z digest=sha256:0b5fd7b046000afdf12ada8999f102d2189d02578a55b155c20343add7bbe73e

Observation a6de40cf-6d40-4ef9-9fa8-58304b696205 · outbound

This paper cites Specifically, MTDT concatenates an embedding z and a state s as the input tokens, where z is the encoding of task ID.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Specifically, MTDT concatenates an embedding z and a state s as the input tokens, where z is the encoding of task ID

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:15.434093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.541414Z digest=sha256:57e19e459fa5777bc585f7566e4b4d498716c15d65ccffe5ea5522a3e44294f4

Observation ac75b570-90ea-4498-9817-371139bcd9eb · outbound

This paper cites an unresolved cited work.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:35:15.187832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:14.607554Z digest=sha256:a481536d5d4c9c04228f76e4e54c1a6eb0e61e50b87d36f56911c4190fde876c

Observation 8f98689c-31fd-415b-9586-303d31cb0c54 · outbound

This paper cites Vaswani, A.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Vaswani, A

Reference 2012

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:14.117474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:14.117474Z digest=sha256:2a4d6bfbae8781223f716c78d6876587cba0b5f93957640832995f44d1dd778d

Observation 3cd48894-bd5d-48fa-b2b2-8ae8f1ba6026 · outbound

This paper cites TD-MPC2: Scalable, Robust World Models for Continuous Control.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer TD-MPC2: Scalable, Robust World Models for Continuous Control

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.006265Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.006265Z digest=sha256:647976648747de14fcf022aa9aac547181fbf0627253beca1373b64641a1653f

Observation 6bdd67e9-d369-45f6-b848-1100e2971cc9 · outbound

This paper cites Sharing Knowledge in Multi-Task Deep Reinforcement Learning.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Sharing Knowledge in Multi-Task Deep Reinforcement Learning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.837762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.837762Z digest=sha256:ccb993f4f4b1365c7c61623d339f3161e0ffc0a02e7d2f2c72fb88052ae2554c

Observation f9ba0b2f-03ca-4529-87c1-5b0b862d5916 · outbound

This paper cites D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:12.695169Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:12.695169Z digest=sha256:ab99f0c1e5b7bf6afe989167dfe60dbe72602bc15db9618e0b4f07cb11320734

Observation 338a3872-7299-4d8d-b0c0-3af546ca05ae · outbound

This paper cites GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.393018Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.393018Z digest=sha256:ad97808d4885eb5eac6b3127d3ab2337d0366df2a3aae3ef5706c6ac8a91200b

Observation 998767c1-e8e4-42ac-935d-36bbe357f3fd · outbound

This paper cites Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:13.079539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:35:13.079539Z digest=sha256:127d3035af54842730109aa458eeb962f21bdc12cd44aa8c7b7083d45ddf1482

Observation 213688c6-2ada-451b-8f1b-8a205f367258 · outbound

This paper cites Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin.

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:35:16.842676Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T12:35:12.916188Z digest=sha256:dc16d379a59498582149893bddeecfcce2406a23373512fff691724ab91bafc0

Pith citing papers

Observation a56c7209-6758-468a-b56e-c7469ec6d877 · inbound

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization cites this paper.

DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 98

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:43:17.312593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-20T12:39:50.004269Z digest=sha256:901606a85cfc926e5add2c46276d7dbb993a736275c0a344c9f34191d4cd9d6a

Observation 5e178e4c-d9c0-4f81-a733-df7c239a43f4 · inbound

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI cites this paper.

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 121

Resolution
unresolved
no resolver link, observed 2026-07-11T19:16:57.396710Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:16:57.396710Z digest=sha256:aadbaeceb0807fde2341cb0dd8061ef834bc1b0afc63ac1bd0912c04d93584c7

Observation 30b098a4-16bc-4552-8798-af175af70b62 · inbound

OPERA: Offline Policy-guided Expert Routing and Adaptation for Universal Biomedical Image Analysis cites this paper.

OPERA: Offline Policy-guided Expert Routing and Adaptation for Universal Biomedical Image Analysis Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T01:04:34.849053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T01:04:34.849053Z digest=sha256:a28ad4e39b8ce383f70e7f1575a4dc475e040e4c35afb10370fe7e66486e7172