Pith. sign in

Paper Citation Record · LEDGER

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning

As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18537 v1

Coverage vector

measured 52 of 52 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:32.169248Z

measured 52 of 52 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

52 of 52 outbound references displayed

  • verified exact2
  • verified fuzzy13
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76 · outbound

This paper cites Foerster, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Foerster, G

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.311324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.311324Z digest=sha256:8a924c4f96de01ced45c20fdda22fb3d1caa00d5340dc29b90a8da9880242fda

Observation 670b9cf7-041f-435a-b87d-4fd94af0e41f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.550524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.366523Z digest=sha256:ef53ec8c3f55fe85abdf7e485edcd0474fbfb777fe5d6cc8d242e2bfdea0786f

Observation 892c0908-7457-4ed2-b477-2495d8df3d51 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.421622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.450660Z digest=sha256:447c9ca36b648b2db77f0fe8864d9c8f34a33612faa173939f03553cd666999a

Observation 7086a3b2-c44a-4683-8ea7-b2911993b7b4 · outbound

This paper cites Rashid, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Rashid, M

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:38.230715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.521090Z digest=sha256:42fce9897e484d0afcfb5099ebcde857b1d26c1de48d8a9ae9befcbfb6b1fdef

Observation 7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.098300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.562989Z digest=sha256:84d9e538a6337f59fae0f1b2e78f0c49751d806b1acb7f74d9069308f72fbafe

Observation 51b1d0c6-6538-43a4-8d92-cdacd102bf9b · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.949118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.624855Z digest=sha256:a70b690748053dae64e693ce3e7c5b8a6f2f32ee35782055c9354c31ad04f574

Observation bcc92c2c-ac51-40c4-8e86-91aebc4546b2 · outbound

This paper cites Sunehag, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Sunehag, G

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.772354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.696489Z digest=sha256:6eb96d255c1a342039b70c861b5199ef367221aa17eb13124bc13e378d481875

Observation f03313aa-1f87-42ec-b468-756ec9790148 · outbound

This paper cites Hernandez-Leal, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Hernandez-Leal, B

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.555190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.769153Z digest=sha256:04652af550134fbe54d3dddc6002e0d56882286298d515210898ee72a58a7155

Observation 62c69c87-b74b-41cc-a208-ef9d7c55579c · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.803514Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.803514Z digest=sha256:91482baacf073e3fa80437fc9624c7ba7d08cfe3546ce213e95cb3931ffcb10c

Observation 7702dffd-a447-4a1c-94a4-2ee8706b91c6 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.354835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.817421Z digest=sha256:350e53de0c98fef9e70c95c45197f6e124608db22d80514ceed287004eb36277

Observation 4ddf7ce3-a302-4ad3-8304-5d4aeb044141 · outbound

This paper cites Egorov, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Egorov, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.196178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:28.890898Z digest=sha256:272d2a3bd103fbd1f1621214ce9bd0a6c19ae03feb62e8a537a00e39ebef4cf2

Observation 78fe9301-a32b-410b-85db-9b54424ff29b · outbound

This paper cites Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.702325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.004887Z digest=sha256:2c6e43530e6c48e94b945e52c683ed88f186bdf80a227d69416657a52cd59e49

Observation ec09dc8c-c50d-436b-a0a7-b1398fb45a70 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.937261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.078472Z digest=sha256:7a4c04a553f40cc84e1f863dba490970e25c87842fdbd4d2f6fae4c3bcced1a1

Observation f34b69ad-927f-4bdb-8911-999c70ec660c · outbound

This paper cites Zhang, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Zhang, G

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.767503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.184049Z digest=sha256:98c4b3df6e26c55ce2d0a465639b2b74c94dd93a21b848d96367cfea0359dd8e

Observation aa327fd1-8690-4a44-9268-1fe9e3f21bfb · outbound

This paper cites Mastering Atari with Discrete World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Atari with Discrete World Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.283214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.283214Z digest=sha256:38539087135cebddaaa2ea755d49965e8cb53f3f06e7a6b38566e23a328ddc41

Observation 8405a811-c03a-4b27-9035-0d95d19af726 · outbound

This paper cites Mastering Diverse Domains through World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Diverse Domains through World Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.344519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.344519Z digest=sha256:defb2bef26dfef063f80f30508821218b42d7c225c51c2d31d52d9c70bd9e338

Observation 8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801 · outbound

This paper cites Robine, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Robine, M

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.506890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.406224Z digest=sha256:8bd46c9c3a800963713031d3c809a8549c15a6fcc310cb9bf8ce0b78fb4bae44

Observation 47055219-0b33-4145-acdf-f327c2c81e86 · outbound

This paper cites Vaswani, N.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Vaswani, N

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.285500Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.536183Z digest=sha256:50bc0a588152f6473ef3d6990409d70487b657f2fa661f9bc5618a473d1b8119

Observation 753ab512-5a5a-4986-8682-de0db114877a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.000493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.685619Z digest=sha256:7f288de59d938c2d0f03829005c4dc8ed2a5862f841458758b556304ed2af29a

Observation 45d3a010-12e4-4047-8c27-7c6228b5ec26 · outbound

This paper cites A Survey of World Models for Autonomous Driving.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning A Survey of World Models for Autonomous Driving

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.802749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.802749Z digest=sha256:9c6638737579c87b47ab4bd27e963e0d8a1c70780658f98f062978f994093cb5

Observation 5d65e8b3-7495-439c-876c-ee9891189759 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.604750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:29.923185Z digest=sha256:e42dd30442e875266ebc717b4d92a8693bee3bc7ad5f368f30c52c3d4fe31a93

Observation 7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.439578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.015588Z digest=sha256:2649662cc42d954fea9def19cbbbef15b092133023421bef3849197de01b206b

Observation e0305426-09ee-41c8-ba35-497340364e5d · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.267342Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.117925Z digest=sha256:a38b5be10f4639cf7c57c9df91527d08737f35485c0428371285001cdd73f716

Observation d56e01c4-570c-437f-a3be-409fa6f8e06f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.065567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.187134Z digest=sha256:40a67a3d2ab76a142325c1607673a12a1c6c36aaf6660e0cfbe58f3f986b79bb

Observation 63d6670e-ecd6-4555-97bf-536d9f267df8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.884792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.226022Z digest=sha256:e61ddbae2f5798ec9d0f8be2a95a75a36a2b712b194930105164d5a26e90cd95

Observation 69867348-7969-4bbc-95f1-24cb4116f468 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.305724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.305724Z digest=sha256:bd328aec31c65823306f3a9a28f0a7f5e595d8b09531a413478e95681a872702

Observation 9e14a86e-bb17-4ae6-9f95-b0650677a5e3 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.687038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.326286Z digest=sha256:ac75f3b69cd130cc338258b0105c5b2373a50c68316991bc906b2489350d8055

Observation 29ef450f-0f10-48ee-967a-420008cda3ec · outbound

This paper cites Kaiser, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Kaiser, M

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.431278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.387216Z digest=sha256:5a86c717cbb33c71958822f7b7717438057a77aaf9c0c93bd9e17889bab65823

Observation a85dcc65-b8d3-42e7-9cb1-57d9d49a8948 · outbound

This paper cites Dream to Control: Learning Behaviors by Latent Imagination.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Dream to Control: Learning Behaviors by Latent Imagination

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.455023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.455023Z digest=sha256:1a56570518ee52bf1a2100e71a0e0116475ccaed1f88ef056b86255a267f53ff

Observation d6887050-c496-42b9-b1cb-97dab50519cc · outbound

This paper cites Micheli, E.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Micheli, E

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.293068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.660794Z digest=sha256:0013a6cc483af2dd18eeb48b828e7f13257249ccd438789c488cd6c27517d245

Observation 83cba1cd-5af4-40a8-a889-c6fa7942aa32 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.083836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.717149Z digest=sha256:1e608d16dbbba7fc54d547d445e2a0032a140cb74fda195c62d50e6e478f0b51

Observation cdcf0096-8500-4471-be57-a2a7f69f86ba · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.812755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.812755Z digest=sha256:549c4ff4cd50766ec6df5506b8781adb6e16f09013142e85967db4c5b4607f03

Observation 3c067b8d-2b56-494a-847b-ebb110e9221a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.925377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:30.944783Z digest=sha256:544dba690443b63b63d77962247841a1113123b80509a196d1380d97520164b3

Observation b5843f77-6448-457d-bbb3-e64d2aaf2308 · outbound

This paper cites Schrittwieser, I.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Schrittwieser, I

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.028162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.028162Z digest=sha256:9e487dc11993686f83a7b2a8660398a22bd921c9fb42193688e655d231326c3c

Observation 9d48df79-19b7-48b7-ad84-6515c0db7b00 · outbound

This paper cites Jaegle, F.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Jaegle, F

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.804133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.081223Z digest=sha256:40d8d486f76a3dc1bf4fd6dcf6afce8ad8adf2dad270b68ab3802b5f8ef47ff0

Observation 00f35743-d668-45c1-b0f3-afe9be41a040 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.164693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.164693Z digest=sha256:77f66728280ffc7fceb48587c8d50b48a7161e6d3bfd926cfd526360dd651b14

Observation f6c7e6c7-a0e5-42fc-8024-a970b62bd7da · outbound

This paper cites Policy Consolidation for Continual Reinforcement Learning.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Policy Consolidation for Continual Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.219011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.219011Z digest=sha256:11cc08e22a8a25704c54b888a70f443a4d14377148eb5edb90099d89251825ed

Observation 82f832ce-301b-4726-a849-9592a7234465 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.640682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.255948Z digest=sha256:0deb76d53089c5cc8822ee9f33afbadb4521661f7fadbb15741d40f70498f7e5

Observation a37fddcc-757e-4d52-a820-677a86314d8d · outbound

This paper cites Auto-Encoding Variational Bayes.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Auto-Encoding Variational Bayes

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.310103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.310103Z digest=sha256:3fe470ef3053f2c8fefe682c7bdfc02e492056d135ac786a38471610593bf523

Observation 5be1d56b-27d8-41ef-a37e-6c2a4112c066 · outbound

This paper cites van den Oord, O.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning van den Oord, O

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.526786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.367005Z digest=sha256:1a0963151ef00e491894560240f3a5d32d79f2793cd53175448cfc638cfaadcd

Observation 97aea435-9078-4de1-8748-a7caad63346d · outbound

This paper cites DeepMind Lab.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning DeepMind Lab

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.423861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.423861Z digest=sha256:94cf27c90de34a53b20d25b4146b13dcc943420c5f10e582f357baf658367db9

Observation 09bed2c9-ca32-47ab-ae08-7ff29f7001c8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.416713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.486552Z digest=sha256:b976d9760f5092f5392bfc80e608c29fd53f8b8937858b8c71ed0095fd07604e

Observation 09d6e2b7-d554-411d-9174-89e35ab71755 · outbound

This paper cites Categorical Reparameterization with Gumbel-Softmax.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Categorical Reparameterization with Gumbel-Softmax

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.535334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.535334Z digest=sha256:dae6add9f5770ff0560f74290abfea22d33f349a355edba3faab84c0250f3926

Observation 592c5658-206b-4f0f-9b53-e57bd0aa7a3d · outbound

This paper cites LeCun, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning LeCun, B

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.619481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.619481Z digest=sha256:9e93e38a206750eda09be6608fd1e9bd00d8177e2e2c7989039b06cfcba25b6d

Observation 7430370c-5a14-4f31-84b9-d241af7e2256 · outbound

This paper cites Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.697779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.697779Z digest=sha256:da3845b1d7f578df181856f1e4a175c5e26228585451cf53dd98fcbf1f7dbabd

Observation 20a7be27-0e4f-4fa7-a9ba-3e49864a3458 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.283106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.790288Z digest=sha256:3c9e5ca232d8504a8e95db9a09e1e6a194aa2b2c919a56ba7597634edc0d1dad

Observation d37b0c5b-51df-4556-9e2d-bf6fb873780c · outbound

This paper cites Samvelyan, T.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Samvelyan, T

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.129379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.851998Z digest=sha256:80c25033a25b936a97ce12363157d5198c657ae04d21968666dc97055900905f

Observation 642f466d-0bc1-470e-aa98-edaad5891daa · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.007884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:31.969512Z digest=sha256:b14cccbd10c4cb7be61c13eb707433455e370c72df7511058c15b09bf6aee3f4

Observation ccb30152-bd25-4b84-b799-820587482dd7 · outbound

This paper cites Melting Pot 2.0.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Melting Pot 2.0

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.017785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.017785Z digest=sha256:7f9c780ab43bdd612d2853c5498da0427c1d488be02dd65ed4d5aed391c8b6b7

Observation 75e6f2ae-b847-4c12-9093-6f0199de36f7 · outbound

This paper cites Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.068608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.068608Z digest=sha256:973884b941305f2c08ff3c84ff6cfcc77e091fffc150e7b10fe9cc624cb3bfdc

Observation 6b60707d-1f0a-403e-8d8c-30a975cfb7ad · outbound

This paper cites An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.326732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:32.100038Z digest=sha256:b647c65caeb4acb3ef30698fb34528fe52e7398cb1c7c8cd5b2fa3f10fa276e7

Observation 3fd8aaa9-eb35-4385-bc22-6b4d0790554c · outbound

This paper cites Formanek, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Formanek, A

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:32.887100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T23:20:32.169248Z digest=sha256:f02cfe0f8b9396dd8b58af9be3f39bf5f1b1e68db6a6335362811ded1409336c

Pith citing papers

No inbound Pith citation observations are available.