Pith. sign in

Paper Citation Record · LEDGER

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance

As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.06615.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.06615 v1

Coverage vector

measured 35 of 35 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:06:27.128981Z

measured 35 of 35 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

35 of 35 outbound references displayed

  • verified exact1
  • verified fuzzy29
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6956b067-8341-46e0-bcbd-64795b02225e · outbound

This paper cites Dynamic programming.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Dynamic programming

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.120493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.120493Z digest=sha256:82d3e880dfef405d05f4ad885006fe59897810750b9040cec90b26b8ba6d0d5f

Observation af101913-8a09-4c41-8e5b-c7de8da6b9f2 · outbound

This paper cites OpenAI Gym.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance OpenAI Gym

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.142902Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.142902Z digest=sha256:e7213c31c59b60ac12e2f4170a950144c36d448bcadb5c3c969281da9363b1d0

Observation 34431820-cad1-4701-beac-8212532aa7fc · outbound

This paper cites Multitask learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multitask learning

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.750463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.236390Z digest=sha256:a684102aeb85ed6d98a2d867c6d5bca0904931bee9642080f7195b4f8cbe3cb4

Observation 0c35eeb8-bef0-40c6-9f1b-7770423608ce · outbound

This paper cites Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Gradnorm: Gradient normalization for adaptive loss balancing in deep multitask networks

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.734718Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.320478Z digest=sha256:7685f08dfaed72df32a2090c56386bfa5a8683a06966f829a874bf91707735d8

Observation d248c66f-4a2b-44e9-91d2-24c7eca148c3 · outbound

This paper cites Multi-task reinforcement learning with task representation method.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with task representation method

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.716411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.413057Z digest=sha256:1758d0594c07ff26a82d81d11023d405d718b08fb9b6663d64444b4be0a55d93

Observation 9de1f464-3e53-4755-8767-6d82f0270712 · outbound

This paper cites Soft Actor-Critic for Discrete Action Settings.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Soft Actor-Critic for Discrete Action Settings

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:26.517932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:26.517932Z digest=sha256:5770543eaadc54d441f422a693a0123d4cd3b4311068806ac3fe24c8a65289cf

Observation ead5de88-ef60-4ba9-b730-12769cb6e820 · outbound

This paper cites Divide- and-conquer reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Divide- and-conquer reinforcement learning

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.696517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.614414Z digest=sha256:1516282708e62cf863ec9698f82078d7fa85ebcd318b78771cde5decdea4cc15

Observation 6ef8dc4f-3342-4c2c-86c4-449f807a9ccb · outbound

This paper cites Reinforcement learning with deep energy-based policies.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Reinforcement learning with deep energy-based policies

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.678620Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.746446Z digest=sha256:a05bebab248bfdc35ec379ed4719ce5815b2ba0e94da199bc13f8f9e8eadeb6a

Observation 16bb38e4-780d-4e03-91d3-dec7f354261c · outbound

This paper cites Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.655915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.791807Z digest=sha256:97829752f6e823acf0d232f4a11d978312bd4d9b98b2fb98e932e2980cbbdf1a

Observation 0ebc75cf-1afd-4094-845d-af7ef6f61713 · outbound

This paper cites Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Not all tasks are equally difficult: Multi-task deep reinforcement learning with dynamic depth routing

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.640033Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:26.925117Z digest=sha256:9cf3fc98a22f3429dd3905abd09881964609589bc5dfaa775a06faaff3c15237

Observation 4eb6ac94-69b8-4c8a-abea-48aed0d715bf · outbound

This paper cites Benchmark environments for multitask learning in continuous domains.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Benchmark environments for multitask learning in continuous domains

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.623634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.001434Z digest=sha256:ea2336fa6d22721ca4f814f8a97f0fac8a265d6507adcd0942d295f52c2c2c7f

Observation a8939339-cf84-4fdc-9900-350b4174c8ef · outbound

This paper cites End-to-end training of deep visuomotor policies.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance End-to-end training of deep visuomotor policies

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:27.019997Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:27.019997Z digest=sha256:565928a3491a439e9d6b4d423d57734ca1f0012e95688d002c5de03657fd97a4

Observation 2176921b-bc88-4841-b2a8-0ba171809721 · outbound

This paper cites Lillicrap, Jonathan J.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Lillicrap, Jonathan J

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.590920Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.025033Z digest=sha256:9a79f124188d0c6bcb309ed08671e5d0a7ed44328aec61aca7d01c4fe10979e9

Observation 87174cbe-8b2a-4034-bce1-3a1152b3dbc6 · outbound

This paper cites Conflict-averse gradient descent for multi-task learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Conflict-averse gradient descent for multi-task learning

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.573810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.029335Z digest=sha256:33a2d318060a01031135e901fec680734ac4d83156083d5afe6fd52c14a1a978

Observation 2b49c235-0949-4445-82fb-b8b63b001962 · outbound

This paper cites Q- functionals for value-based continuous control.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Q- functionals for value-based continuous control

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.553417Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.034309Z digest=sha256:b73e15821c5f2e63a680463dd066f77f1fce694a7ab6fd2b1ceace74a52598f2

Observation 1db05804-1920-4860-8fee-fadb7139911b · outbound

This paper cites Rusu, Joel Veness, Marc G.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Rusu, Joel Veness, Marc G

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.537789Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.038650Z digest=sha256:c1d8e6936d9a36b7b15134f5af2d95de5edc99e4d7b3e09d1589dd32811f1c68

Observation 4f258522-cbea-488b-970d-d9e46d6f86fa · outbound

This paper cites Overcoming exploration in reinforcement learning with demonstrations.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Overcoming exploration in reinforcement learning with demonstrations

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.516705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.042996Z digest=sha256:30d04101c824462a2e4532577639bd2422a831ee13991716137997094e17b9bc

Observation 163539aa-9b26-4d44-94bf-750e50195f4e · outbound

This paper cites Markov Decision Processes: Discrete Stochastic Dynamic Programming.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Markov Decision Processes: Discrete Stochastic Dynamic Programming

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.494440Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.047261Z digest=sha256:a878bf3cc68341b06d24bbedd854c7b44515939033483379c67f392278f34994

Observation 2194e526-57fb-41da-a89e-54786c8fc73d · outbound

This paper cites An Overview of Multi-Task Learning in Deep Neural Networks.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance An Overview of Multi-Task Learning in Deep Neural Networks

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T19:06:27.051585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:06:27.051585Z digest=sha256:f0b7300741d2cbc8f21dc2c93d574474dec5a65b6c5c5f9a847cdd6b601e1ab1

Observation 4bef9725-1cdc-4db8-b924-a907e05a1350 · outbound

This paper cites Hierarchical and interpretable skill acqui- sition in multi-task reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Hierarchical and interpretable skill acqui- sition in multi-task reinforcement learning

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.478520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.056121Z digest=sha256:f7548b27b8139f50bb5578ef0c5ba7ad37cb19ed804dfcfdbd4607c4cf9964d5

Observation f460c02b-9ff7-401b-b39c-8a451cc4b64f · outbound

This paper cites Multi-task reinforcement learning with context- based representations.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with context- based representations

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.462446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.060861Z digest=sha256:dd90416c4a959feda3ecc4df609621e0d9f82717d20e01f39267dccb6834c953

Observation 8f79f070-122f-407e-b8fc-4b0d5f47fbe5 · outbound

This paper cites PaCo: Parameter- compositional multi-task reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance PaCo: Parameter- compositional multi-task reinforcement learning

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.447306Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.065190Z digest=sha256:2814de9a12dc9d8e2dfba3bf72e21c49da54ff6154fa0c6ce452f90c4788fc36

Observation 2b9f67cb-074c-445a-83ca-e899be6f3b62 · outbound

This paper cites Czarnecki, John Quan, James Kirkpatrick, Raia Hadsell, Nicolas Heess, and Razvan Pascanu.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Czarnecki, John Quan, James Kirkpatrick, Raia Hadsell, Nicolas Heess, and Razvan Pascanu

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.432196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.069827Z digest=sha256:1e1eec1fb2a6f037aed084f1cd2ee704e3d8f3302d8aba61acc98da1b18a88f7

Observation 158b1812-c2ad-4633-84a0-8b8e28132152 · outbound

This paper cites MuJoCo: A physics engine for model-based control.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance MuJoCo: A physics engine for model-based control

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.417318Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.074908Z digest=sha256:c304fe4b67af36ee37b539aeda3c4a6ee546c8a527d158494bd586ccbf1b56bc

Observation efcaf77a-b41a-4b39-b64b-899e88b3409e · outbound

This paper cites A survey of multi-task deep reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance A survey of multi-task deep reinforcement learning

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.399752Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.080098Z digest=sha256:2109bfb320bc58ef15b0f268dc7921ba2de2527ca9a355456af45e7399ca85f3

Observation 2f491275-5314-4ac8-ae9a-aca732c37924 · outbound

This paper cites Disentan- gling transfer in continual reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Disentan- gling transfer in continual reinforcement learning

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.384113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.085271Z digest=sha256:e663a2207ba85f127bb1216004e4f976ed21c1333bc9f26f164d41f892b20229

Observation 8f63fe28-5d59-4ced-b086-b51e99ab9290 · outbound

This paper cites Multi-task reinforcement learning with soft modularization.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Multi-task reinforcement learning with soft modularization

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.367994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.089372Z digest=sha256:99e89fba94df35b40da2e1063fa91071d2eb111945ef7d4d2552ee6c2c204c8f

Observation e64095ba-b40e-49bf-82fa-fdc5b6a898cc · outbound

This paper cites Mastering complex control in MOBA games with deep reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Mastering complex control in MOBA games with deep reinforcement learning

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.350804Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.094458Z digest=sha256:a36cdf200775cf8182907f500af935b4a9558e94a51e0b87ab0b8e7207ae4286

Observation 42273352-30d9-4d66-b59b-9720cee13b2d · outbound

This paper cites Conservative data sharing for multi-task offline reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Conservative data sharing for multi-task offline reinforcement learning

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.333739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.099348Z digest=sha256:74e8853bb05e0687de0de7f05b6bd71f1d3674d182ea3564fb692884190603f4

Observation 6980ee7d-36ad-44b6-8cc9-56000f31aaa3 · outbound

This paper cites Gradient surgery for multi-task learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Gradient surgery for multi-task learning

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.316401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.104218Z digest=sha256:9758af361125ae8811a1f5e4d751b5c0935fa4b5fe174c31479c9daebf4af3e6

Observation f910f7ae-4f18-40d3-a21a-d8be669fb90d · outbound

This paper cites Meta-World: A benchmark and evaluation for multi-task and meta reinforcement learning.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Meta-World: A benchmark and evaluation for multi-task and meta reinforcement learning

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.299987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.108928Z digest=sha256:cccf995fd454cebe4e3d9369d75ae9373e552fb6646762b8f001ddfc32705e65

Observation ac343e8c-760f-49a8-ba43-6f5424df160a · outbound

This paper cites QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance QMP: Q-switch Mixture of Policies for Multi-Task Behavior Sharing

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-08-06T19:06:27.177284Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.113427Z digest=sha256:cbd0979a1d0365f8cf7fbc43277ba9774cea5ef39681069a32e2f281dd42bb47

Observation 471e7da7-456e-48e7-941e-bb1777e50947 · outbound

This paper cites CUP: Critic-guided policy reuse.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance CUP: Critic-guided policy reuse

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.282117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.118550Z digest=sha256:4dad4faf01519ad7f06593ffa20a287affab68262e908167c3a89e9de33269cf

Observation 25376279-8414-45bf-8121-e2fe020ec629 · outbound

This paper cites t+K−1X t′=t γt′−t (Ri(st′, at′) +αiH(πi(·|st′))) # + γKEst+K∼Pi h ˆQ˜g i (st+K, i) i = Eat′ ∼πi,st′+1∼Pi.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance t+K−1X t′=t γt′−t (Ri(st′, at′) +αiH(πi(·|st′))) # + γKEst+K∼Pi h ˆQ˜g i (st+K, i) i = Eat′ ∼πi,st′+1∼Pi

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.265399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.123453Z digest=sha256:e067df6ed7d4c90d7aa4eb616f13d3e32b84a37d10e3722f64e7f5efc25e7873

Observation ef72a0e4-770a-45bb-ab68-b30d2601b72d · outbound

This paper cites Under the initial episode length setting of 150 timesteps, 42 tasks achieve a success rate exceeding 90%.

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance Under the initial episode length setting of 150 timesteps, 42 tasks achieve a success rate exceeding 90%

Reference 150

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T19:06:27.250052Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T19:06:27.128981Z digest=sha256:4ccb42d7479eedcab5069211addf80792cd1af1e9ca581b5dba91dd5fffaa203

Pith citing papers

No inbound Pith citation observations are available.