Pith. sign in

Paper Citation Record · LEDGER

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning

As of 10 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18537 v1

Coverage vector

measured 52 of 52 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:32.169248Z

measured 52 of 52 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

52 of 52 outbound references displayed

  • verified exact2
  • verified fuzzy13
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76 · outbound

This paper cites Foerster, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Foerster, G

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.311324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.311324Z digest=sha256:effd79a62443dc1254c209f4de7f94a53a10b9385102b5ef295a2e0825c7b4a9

Observation 670b9cf7-041f-435a-b87d-4fd94af0e41f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.550524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.366523Z digest=sha256:92a77462c50bba518c981c3ad47ef0ed190bcb3d3eca73bd36f91262f0f92773

Observation 892c0908-7457-4ed2-b477-2495d8df3d51 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.421622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.450660Z digest=sha256:3d9d7816b96406a46fda2aad917ab9338166296ab61d82fce75b4977f795bb91

Observation 7086a3b2-c44a-4683-8ea7-b2911993b7b4 · outbound

This paper cites Rashid, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Rashid, M

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:38.230715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.521090Z digest=sha256:ba3249668c0464f388691415bdd9ffabc5e3bcc57dcade981b7ee21062b29862

Observation 7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.098300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.562989Z digest=sha256:79a93a548217a2dd7b26acacb78da7266a2382f9b6c3241a110398c7fd74e94e

Observation 51b1d0c6-6538-43a4-8d92-cdacd102bf9b · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.949118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.624855Z digest=sha256:f594b87bc1c27103fd004d1818cb489cb19776f03323e1ea5ae1e0f98f9814f3

Observation bcc92c2c-ac51-40c4-8e86-91aebc4546b2 · outbound

This paper cites Sunehag, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Sunehag, G

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.772354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.696489Z digest=sha256:e60dc2d0a783fe35214a0044008f0643e695a8d7c19e8d7d7cd3f8ee1b5fd747

Observation f03313aa-1f87-42ec-b468-756ec9790148 · outbound

This paper cites Hernandez-Leal, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Hernandez-Leal, B

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.555190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.769153Z digest=sha256:da01b749e144a929aaf466e6442133302280795eea522300fe92eea0cc50a4d6

Observation 62c69c87-b74b-41cc-a208-ef9d7c55579c · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.803514Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.803514Z digest=sha256:6010dd5a906e1b17cbbe9123b8c289575521c1bed7651f36759862df8558d406

Observation 7702dffd-a447-4a1c-94a4-2ee8706b91c6 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.354835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.817421Z digest=sha256:f3ffdb73bb130a97658b4e6d739184d252664e89312818f03d7f5f00f59fa81e

Observation 4ddf7ce3-a302-4ad3-8304-5d4aeb044141 · outbound

This paper cites Egorov, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Egorov, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.196178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:28.890898Z digest=sha256:b1c91d9f486fc9e90de2bbac444498593ba991cf25dce2b41d227c30d360267b

Observation 78fe9301-a32b-410b-85db-9b54424ff29b · outbound

This paper cites Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.702325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.004887Z digest=sha256:3b859bc6254c382c0d1df5ee0a315849d374be77c7221825e3c8752f7809d84b

Observation ec09dc8c-c50d-436b-a0a7-b1398fb45a70 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.937261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.078472Z digest=sha256:4eb4c0ece40e243f9c1f477cdccdcf098c845eba7b3d51c67232688ea7d84cc4

Observation f34b69ad-927f-4bdb-8911-999c70ec660c · outbound

This paper cites Zhang, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Zhang, G

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.767503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.184049Z digest=sha256:d8a4343c665336044ca656e175aae682e7c4d331b0f26d640c5d2d6534b6099d

Observation aa327fd1-8690-4a44-9268-1fe9e3f21bfb · outbound

This paper cites Mastering Atari with Discrete World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Atari with Discrete World Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.283214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.283214Z digest=sha256:46744b0614960d4b3807f1badd0e4ca0dff6cf697d17f01f9504d88f259998c5

Observation 8405a811-c03a-4b27-9035-0d95d19af726 · outbound

This paper cites Mastering Diverse Domains through World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Diverse Domains through World Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.344519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.344519Z digest=sha256:1dad65509837f138d2cf480d338823de9e851982c768eadafac6984d5d548c1a

Observation 8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801 · outbound

This paper cites Robine, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Robine, M

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.506890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.406224Z digest=sha256:33b19e2c0681f374fd404efe495d39185857fbf275efe08a04edb876871da8f9

Observation 47055219-0b33-4145-acdf-f327c2c81e86 · outbound

This paper cites Vaswani, N.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Vaswani, N

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.285500Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.536183Z digest=sha256:63789f90655ad6296a5e42d280772b1f2b99268627adf3e7b501ceea2dfa93a0

Observation 753ab512-5a5a-4986-8682-de0db114877a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.000493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.685619Z digest=sha256:f13e275683df248845a0ce54ca0aa9872e3c8160c79d2b0d8ee8c888ad7835a9

Observation 45d3a010-12e4-4047-8c27-7c6228b5ec26 · outbound

This paper cites A Survey of World Models for Autonomous Driving.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning A Survey of World Models for Autonomous Driving

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.802749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.802749Z digest=sha256:8922fdea41908588ae550bbeba3584f162d0352c7fc98da2e9fd4608305188ff

Observation 5d65e8b3-7495-439c-876c-ee9891189759 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.604750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:29.923185Z digest=sha256:8bc83d5a9311fdb90a405f479e0ab690f34b7b18bf787fb666e17aeed7b0dc77

Observation 7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.439578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.015588Z digest=sha256:075c4b20a50d77e38e580fd9c9ece59062996faf4eeb67b57a344305c57d0175

Observation e0305426-09ee-41c8-ba35-497340364e5d · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.267342Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.117925Z digest=sha256:0a0d9d3f5d26a66981001db92df4d95f34a15dce4c645f634a1e02c53f3a0278

Observation d56e01c4-570c-437f-a3be-409fa6f8e06f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.065567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.187134Z digest=sha256:9f43709fd1b262bc2c21d2579663d1e29ab384ae49811092efd511812b7494b8

Observation 63d6670e-ecd6-4555-97bf-536d9f267df8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.884792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.226022Z digest=sha256:f55d6d6680c40a8422e4f9a54fcc7103c933ddaa0362a945dc42d9ebace59545

Observation 69867348-7969-4bbc-95f1-24cb4116f468 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.305724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.305724Z digest=sha256:ddab7d0213b5c1b24d8bcc3616536bf8860b99f5f77f00dd3946adaa3fff81a8

Observation 9e14a86e-bb17-4ae6-9f95-b0650677a5e3 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.687038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.326286Z digest=sha256:c4ef61fcabfa39b475ed48cdbb06d17ffd50d6e35c341f130d62faeed5f2cb4d

Observation 29ef450f-0f10-48ee-967a-420008cda3ec · outbound

This paper cites Kaiser, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Kaiser, M

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.431278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.387216Z digest=sha256:6e56b4519bc92d36973f0c7f8012e5bcbbf4f725196fb7e00b2489dfaf1fc521

Observation a85dcc65-b8d3-42e7-9cb1-57d9d49a8948 · outbound

This paper cites Dream to Control: Learning Behaviors by Latent Imagination.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Dream to Control: Learning Behaviors by Latent Imagination

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.455023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.455023Z digest=sha256:bdb0390fa498853deb9c366dd7b374094d31bf8d48041259d054c53f84b5e08c

Observation d6887050-c496-42b9-b1cb-97dab50519cc · outbound

This paper cites Micheli, E.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Micheli, E

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.293068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.660794Z digest=sha256:9c9758bad19301ea2ff6af3252a3b7558472a0fab8698b683ddf8fb51d945f6f

Observation 83cba1cd-5af4-40a8-a889-c6fa7942aa32 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.083836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.717149Z digest=sha256:c822630b1ed90bde36f4cced7fcdde6ee98e7058a9741de163d6f72ee4854281

Observation cdcf0096-8500-4471-be57-a2a7f69f86ba · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.812755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.812755Z digest=sha256:7b901f16d42f30447aa392e3f887e3b3698bf80f2bb16d4343b1db988c3c960a

Observation 3c067b8d-2b56-494a-847b-ebb110e9221a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.925377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:30.944783Z digest=sha256:b068234dd298b3667566165a1c42c7a6958eb61cb200bfdb516ee1d226672885

Observation b5843f77-6448-457d-bbb3-e64d2aaf2308 · outbound

This paper cites Schrittwieser, I.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Schrittwieser, I

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.028162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.028162Z digest=sha256:0f20d602e48ab63b494f89a282af5f8a1d3fed197fe0e9db632bcc2b283e48eb

Observation 9d48df79-19b7-48b7-ad84-6515c0db7b00 · outbound

This paper cites Jaegle, F.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Jaegle, F

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.804133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.081223Z digest=sha256:d898040cecf210007cbeeee03c2131eb8a03ce2842d5eca15326dc1b87669af1

Observation 00f35743-d668-45c1-b0f3-afe9be41a040 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.164693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.164693Z digest=sha256:977c65e521d480b36f38e4c12736c170a0f8e785cff77d439a9c663543420227

Observation f6c7e6c7-a0e5-42fc-8024-a970b62bd7da · outbound

This paper cites Policy Consolidation for Continual Reinforcement Learning.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Policy Consolidation for Continual Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.219011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.219011Z digest=sha256:6da6df4fe7a98f3d3fef06d820e8e91b16792e8dea5bec292cb3b67956950244

Observation 82f832ce-301b-4726-a849-9592a7234465 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.640682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.255948Z digest=sha256:f3cf7af5e5bde9e2b36b203eca7b6911ea9f5839867127bfb8d7e7d61aa8a78e

Observation a37fddcc-757e-4d52-a820-677a86314d8d · outbound

This paper cites Auto-Encoding Variational Bayes.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Auto-Encoding Variational Bayes

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.310103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.310103Z digest=sha256:725045524abdd42b30917a529ca29d641422e56f426d613835ebbdf812a1366d

Observation 5be1d56b-27d8-41ef-a37e-6c2a4112c066 · outbound

This paper cites van den Oord, O.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning van den Oord, O

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.526786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.367005Z digest=sha256:867ade3852be33753d14e9a75fea91c8235a350af7409e14fca498013c79d76d

Observation 97aea435-9078-4de1-8748-a7caad63346d · outbound

This paper cites DeepMind Lab.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning DeepMind Lab

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.423861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.423861Z digest=sha256:1e8ee944feda7503d7ef76c20b0339f2504497db08d400a147ba22d58322e9c4

Observation 09bed2c9-ca32-47ab-ae08-7ff29f7001c8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.416713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.486552Z digest=sha256:f4f8025b4e8e8588636fcf925c117e1861b585c1d83c93db516b209720c1fae9

Observation 09d6e2b7-d554-411d-9174-89e35ab71755 · outbound

This paper cites Categorical Reparameterization with Gumbel-Softmax.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Categorical Reparameterization with Gumbel-Softmax

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.535334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.535334Z digest=sha256:e1f0e7ab23ce11b44cf062487743ea4e61776420d68eb8f50c4858c5314a1064

Observation 592c5658-206b-4f0f-9b53-e57bd0aa7a3d · outbound

This paper cites LeCun, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning LeCun, B

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.619481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.619481Z digest=sha256:b8a988c54934f1742c1c7c31a28fb607532d248f15a9291ecc38be3c269f138f

Observation 7430370c-5a14-4f31-84b9-d241af7e2256 · outbound

This paper cites Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.697779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.697779Z digest=sha256:78665fe8ff43ae0518749908ee58496fc9d63d48cb0b3187a22c6e7cfd57e069

Observation 20a7be27-0e4f-4fa7-a9ba-3e49864a3458 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.283106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.790288Z digest=sha256:e01e3ddf1d8865f5f7c5d9a56bda76d08d31c25549f7ac3b053a1422819c2b84

Observation d37b0c5b-51df-4556-9e2d-bf6fb873780c · outbound

This paper cites Samvelyan, T.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Samvelyan, T

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.129379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.851998Z digest=sha256:d97c55e8bc7778c1e7ebb8ad5ca8249044e276f567d9447d4cbc9e1d11e95d06

Observation 642f466d-0bc1-470e-aa98-edaad5891daa · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.007884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:31.969512Z digest=sha256:9eabf65e6a05e9fdaccf097fbc8cce7d22ad3dbc6e3bda625a3cb538cf46ac0f

Observation ccb30152-bd25-4b84-b799-820587482dd7 · outbound

This paper cites Melting Pot 2.0.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Melting Pot 2.0

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.017785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.017785Z digest=sha256:db1b77a9f9f9addf49bc83e66fb5e3c57d59ef27420bc79e66bfd7a58d481f7b

Observation 75e6f2ae-b847-4c12-9093-6f0199de36f7 · outbound

This paper cites Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.068608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.068608Z digest=sha256:c7f6e41a66f9c37f40175d76e47879bfafe2e222924e5f35bf4898f9b0ac4eb6

Observation 6b60707d-1f0a-403e-8d8c-30a975cfb7ad · outbound

This paper cites An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.326732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:32.100038Z digest=sha256:3dbe0ffc0ffbaf02a833b170c778af4760b68f7f0a97378a7dfc998d032e3066

Observation 3fd8aaa9-eb35-4385-bc22-6b4d0790554c · outbound

This paper cites Formanek, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Formanek, A

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:32.887100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T23:20:32.169248Z digest=sha256:6af797644aa63e67c7b7605e24b3d3345c77862c068e7d708c5682ad9d8242e8

Pith citing papers

No inbound Pith citation observations are available.