{"as_of":"2026-08-09T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b85096a99a64231663456c138844ef053c0427597bbc0f91264324071e7dd7c9","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:20:32.169248Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18537/citation-record","integrity":"/paper/2506.18537/integrity","json":"/paper/2506.18537/citation-record.json","paper":"/paper/2506.18537"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:28.311324Z","title":"Foerster, G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.311324Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:effd79a62443dc1254c209f4de7f94a53a10b9385102b5ef295a2e0825c7b4a9","observation_id":"5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76","resolution":{"observed_at":"2026-08-06T23:20:28.311324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.477073Z","title":null,"venue":null,"work_id":"71aaf202-9b63-4a3f-8e02-732d57db9156","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.366523Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:650296679c1331fa2f102b0b45729477c3894f942b8f6cd3f7de56da96f4858f","observation_id":"670b9cf7-041f-435a-b87d-4fd94af0e41f","resolution":{"observed_at":"2026-08-06T23:20:38.550524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.356609Z","title":null,"venue":null,"work_id":"27b7ef04-c046-4f22-a8a5-852a417dcbd2","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.450660Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:aace511023c2657efcb441d2d1a9259494d442b177402f2e3611a0ee1ceb9dc4","observation_id":"892c0908-7457-4ed2-b477-2495d8df3d51","resolution":{"observed_at":"2026-08-06T23:20:38.421622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.187578Z","title":"Rashid, M","venue":null,"work_id":"b0e5a671-b910-4054-997e-d01e004d6ce4","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.521090Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:24a182a5025bcc3728f25601cbcb885021ac8456ba7628405f91ddc7fbd1d951","observation_id":"7086a3b2-c44a-4683-8ea7-b2911993b7b4","resolution":{"observed_at":"2026-08-06T23:20:38.230715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.034044Z","title":null,"venue":null,"work_id":"407c359d-14bf-43ee-b56b-46c677acf4bb","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.562989Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:fbed3afaa151033d7120b8dcbfe6d854de25c4794e993df99bed6153af30a3aa","observation_id":"7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141","resolution":{"observed_at":"2026-08-06T23:20:38.098300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.872290Z","title":null,"venue":null,"work_id":"eb267a01-64d3-4387-a2ff-90ae4c7c747d","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.624855Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:8c71f54b67b3ea1c7d2d20be1d3b09246cc857d8125eb4e0436a105b89f16ff6","observation_id":"51b1d0c6-6538-43a4-8d92-cdacd102bf9b","resolution":{"observed_at":"2026-08-06T23:20:37.949118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.690579Z","title":"Sunehag, G","venue":null,"work_id":"e052b22b-01b0-4e81-908f-6fc3546e86fb","year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.696489Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c9eb6588cb2e9f00d00083137a56478ebfe3c85f767b7d55c14e4f94a734e024","observation_id":"bcc92c2c-ac51-40c4-8e86-91aebc4546b2","resolution":{"observed_at":"2026-08-06T23:20:37.772354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.481577Z","title":"Hernandez-Leal, B","venue":null,"work_id":"264e7e4f-55f7-4a24-8f36-1768e14cf90b","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.769153Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:4bfed62883c5e1007447422fcc0624abefa58e12243ad2daafd642906a71cf9c","observation_id":"f03313aa-1f87-42ec-b468-756ec9790148","resolution":{"observed_at":"2026-08-06T23:20:37.555190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:28.803514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.803514Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:6010dd5a906e1b17cbbe9123b8c289575521c1bed7651f36759862df8558d406","observation_id":"62c69c87-b74b-41cc-a208-ef9d7c55579c","resolution":{"observed_at":"2026-08-06T23:20:28.803514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.309816Z","title":null,"venue":null,"work_id":"da23dbd7-c1c8-4883-b37c-0ce0b2481905","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.817421Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:f05dfb99ebd2843ea503d5752747bcd57d8285e879cdb175c955c87baa1616c6","observation_id":"7702dffd-a447-4a1c-94a4-2ee8706b91c6","resolution":{"observed_at":"2026-08-06T23:20:37.354835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.081625Z","title":"Egorov, A","venue":null,"work_id":"d65be87c-f781-4f5b-a838-8d003d13dfee","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.890898Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7087eff1bc91eb84760fb6f244d666f6b496b90fdc136ff1526e9b34e2f92dc2","observation_id":"4ddf7ce3-a302-4ad3-8304-5d4aeb044141","resolution":{"observed_at":"2026-08-06T23:20:37.196178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15836","last_updated":"2025-09-02T08:16:33Z","snapshot_observed_at":"2026-08-06T22:05:24.604541Z","submitted_at":"2024-06-22T12:40:03Z","title":"Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models","version":2},"cited_work":{"arxiv_id":"2406.15836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15836","snapshot_observed_at":"2026-08-06T23:20:32.660906Z","title":"Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models","venue":"cs.LG","work_id":"26dfc0c8-8422-441d-b43a-d2b1eaf9c515","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.004887Z"},"links":{"cited_paper":"/paper/2406.15836","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:ea6f745b154b7947706b255daed7814ffc09fd5132beef851b6da20b35007bb4","observation_id":"78fe9301-a32b-410b-85db-9b54424ff29b","resolution":{"observed_at":"2026-08-06T23:20:32.702325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.856912Z","title":null,"venue":null,"work_id":"ca0386fa-ab4c-401c-affd-5964b9ea0c56","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.078472Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:5bc5adcf7503ac13c213af0b0ac9bb7fd8f6ae8468ddcd47a65b762134df7711","observation_id":"ec09dc8c-c50d-436b-a0a7-b1398fb45a70","resolution":{"observed_at":"2026-08-06T23:20:36.937261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.623552Z","title":"Zhang, G","venue":null,"work_id":"f025a12a-18e8-4680-872f-3d7aad6b8aed","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.184049Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:2d9ba27efce5bd6676970c51d776dbcd2102fe5a9b7de2a2ffbbefc72ff8abfb","observation_id":"f34b69ad-927f-4bdb-8911-999c70ec660c","resolution":{"observed_at":"2026-08-06T23:20:36.767503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-06T23:20:29.283214Z","title":"Hafner, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.283214Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:46744b0614960d4b3807f1badd0e4ca0dff6cf697d17f01f9504d88f259998c5","observation_id":"aa327fd1-8690-4a44-9268-1fe9e3f21bfb","resolution":{"observed_at":"2026-08-06T23:20:29.283214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T23:20:29.344519Z","title":"Hafner, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.344519Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1dad65509837f138d2cf480d338823de9e851982c768eadafac6984d5d548c1a","observation_id":"8405a811-c03a-4b27-9035-0d95d19af726","resolution":{"observed_at":"2026-08-06T23:20:29.344519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.411915Z","title":"Robine, M","venue":null,"work_id":"2c819f60-4a7c-4da4-a375-8fa3a7ff0ae5","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.406224Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:3c9d0bb4030ce1e1358b8bb36c665b1231891c55c6dd4f77fb841edd91450057","observation_id":"8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801","resolution":{"observed_at":"2026-08-06T23:20:36.506890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.205313Z","title":"Vaswani, N","venue":null,"work_id":"c37792a4-7eea-42de-89f8-131bcf7bdac3","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.536183Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7514149cdaae092bf2d6a9dd402911cb1cb0fe41bff39cf16c6cc786272c8ca0","observation_id":"47055219-0b33-4145-acdf-f327c2c81e86","resolution":{"observed_at":"2026-08-06T23:20:36.285500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.830225Z","title":null,"venue":null,"work_id":"e81cbd04-2f9f-46ef-8666-90cbb719fdbd","year":2016},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.685619Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:9f3b5d46ec1afaad370c7fc0e46a2dc3fc1618dd27ce95a2714224ddbf7614bb","observation_id":"753ab512-5a5a-4986-8682-de0db114877a","resolution":{"observed_at":"2026-08-06T23:20:36.000493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-09T17:02:46.042118Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-06T23:20:29.802749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.802749Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:8922fdea41908588ae550bbeba3584f162d0352c7fc98da2e9fd4608305188ff","observation_id":"45d3a010-12e4-4047-8c27-7c6228b5ec26","resolution":{"observed_at":"2026-08-06T23:20:29.802749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.533006Z","title":null,"venue":null,"work_id":"16be6bc4-dc87-478f-81ae-1cdde9f0f64a","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.923185Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d10062627a53828df016597aa0cdbf8eed4ae501116ee9322e7b3594c04cd458","observation_id":"5d65e8b3-7495-439c-876c-ee9891189759","resolution":{"observed_at":"2026-08-06T23:20:35.604750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.380346Z","title":null,"venue":null,"work_id":"61fc7e99-cb1e-4953-9819-e391f652cc7f","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.015588Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1e530c1a310cda71be7531ff852ec8fde90988a175b89bcbd84a740576154b75","observation_id":"7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef","resolution":{"observed_at":"2026-08-06T23:20:35.439578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.158411Z","title":null,"venue":null,"work_id":"ea384ed3-d9a9-4f15-a09a-2da92d35c241","year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.117925Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:036119468e6daceb6f4a988cc905b00fceaa769e895baa2ec4e52f027f24a1ef","observation_id":"e0305426-09ee-41c8-ba35-497340364e5d","resolution":{"observed_at":"2026-08-06T23:20:35.267342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.974884Z","title":null,"venue":null,"work_id":"b800395d-71f4-49f0-b68a-bccf13d6b173","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.187134Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:4892d4281fc9515aaf3835fb2eb4fc2f29fc3be4a0cf22f72a891c9e5abb17c7","observation_id":"d56e01c4-570c-437f-a3be-409fa6f8e06f","resolution":{"observed_at":"2026-08-06T23:20:35.065567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.788599Z","title":null,"venue":null,"work_id":"b336f8f8-5d4a-4a77-b170-d64b2e1a4ca8","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.226022Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:99d689251f5f3b180417f551f68df6816922be2e5fbdbd3929882c14f70b4b38","observation_id":"63d6670e-ecd6-4555-97bf-536d9f267df8","resolution":{"observed_at":"2026-08-06T23:20:34.884792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:30.305724Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.305724Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:ddab7d0213b5c1b24d8bcc3616536bf8860b99f5f77f00dd3946adaa3fff81a8","observation_id":"69867348-7969-4bbc-95f1-24cb4116f468","resolution":{"observed_at":"2026-08-06T23:20:30.305724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.545074Z","title":null,"venue":null,"work_id":"f06774ef-7423-4ede-afe8-618f732ff955","year":1986},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.326286Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c3c1854dc209323378107407059102882b88e4452998536938f1ae66cc54c445","observation_id":"9e14a86e-bb17-4ae6-9f95-b0650677a5e3","resolution":{"observed_at":"2026-08-06T23:20:34.687038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.371560Z","title":"Kaiser, M","venue":null,"work_id":"c4b3d02d-df67-414b-a3a6-ba10851fee95","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.387216Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:98c7b450a1fa3e2624a30ea3bfd71a7f95a346970cb0d8a7fba34bb3cb95ad04","observation_id":"29ef450f-0f10-48ee-967a-420008cda3ec","resolution":{"observed_at":"2026-08-06T23:20:34.431278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-06T23:20:30.455023Z","title":"Hafner, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.455023Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:bdb0390fa498853deb9c366dd7b374094d31bf8d48041259d054c53f84b5e08c","observation_id":"a85dcc65-b8d3-42e7-9cb1-57d9d49a8948","resolution":{"observed_at":"2026-08-06T23:20:30.455023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.182870Z","title":"Micheli, E","venue":null,"work_id":"ea1ead68-9a77-4b13-a69a-8e1d6d3a0ad9","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.660794Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d273fa82f9d649ff4b7d6b5aa39f5458bd4e577973f8480f9a1ae81d1f4741a5","observation_id":"d6887050-c496-42b9-b1cb-97dab50519cc","resolution":{"observed_at":"2026-08-06T23:20:34.293068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.990615Z","title":null,"venue":null,"work_id":"e44a6eec-2c63-446d-9581-bc99738960d7","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.717149Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d99e0e401cc270e1cd8ee86a5bb694ebce96d5fbf39feb2699b3b76a3ba527b7","observation_id":"83cba1cd-5af4-40a8-a889-c6fa7942aa32","resolution":{"observed_at":"2026-08-06T23:20:34.083836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:30.812755Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.812755Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7b901f16d42f30447aa392e3f887e3b3698bf80f2bb16d4343b1db988c3c960a","observation_id":"cdcf0096-8500-4471-be57-a2a7f69f86ba","resolution":{"observed_at":"2026-08-06T23:20:30.812755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.873877Z","title":null,"venue":null,"work_id":"070fd1d2-e987-4c40-a6ef-2d825ca5cdf8","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.944783Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:b7f78d38414efb7223d2627f87bcdc8ba130bbf58904fef244ad4ce69d209cc6","observation_id":"3c067b8d-2b56-494a-847b-ebb110e9221a","resolution":{"observed_at":"2026-08-06T23:20:33.925377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:31.028162Z","title":"Schrittwieser, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.028162Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:0f20d602e48ab63b494f89a282af5f8a1d3fed197fe0e9db632bcc2b283e48eb","observation_id":"b5843f77-6448-457d-bbb3-e64d2aaf2308","resolution":{"observed_at":"2026-08-06T23:20:31.028162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.711919Z","title":"Jaegle, F","venue":null,"work_id":"8a99ec54-bfd0-46de-821f-6c3a72da274d","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.081223Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:9b592d7d83f04c50210c81f333c43b476f09415fde36cbbc52dc17715265ac35","observation_id":"9d48df79-19b7-48b7-ad84-6515c0db7b00","resolution":{"observed_at":"2026-08-06T23:20:33.804133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:20:31.164693Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.164693Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:977c65e521d480b36f38e4c12736c170a0f8e785cff77d439a9c663543420227","observation_id":"00f35743-d668-45c1-b0f3-afe9be41a040","resolution":{"observed_at":"2026-08-06T23:20:31.164693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00255","last_updated":"2019-06-17T12:45:41Z","snapshot_observed_at":"2026-08-03T16:46:39.547308Z","submitted_at":"2019-02-01T09:59:10Z","title":"Policy Consolidation for Continual Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00255","snapshot_observed_at":"2026-08-06T23:20:31.219011Z","title":"Kaplanis, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.219011Z"},"links":{"cited_paper":"/paper/1902.00255","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:6da6df4fe7a98f3d3fef06d820e8e91b16792e8dea5bec292cb3b67956950244","observation_id":"f6c7e6c7-a0e5-42fc-8024-a970b62bd7da","resolution":{"observed_at":"2026-08-06T23:20:31.219011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.588101Z","title":null,"venue":null,"work_id":"1b2c403b-796a-42e2-b38e-7f70087e916a","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.255948Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:f5b3b01f0e909918f888dc037efc173693078f0266ce9af9b91133f7bc8ac2d1","observation_id":"82f832ce-301b-4726-a849-9592a7234465","resolution":{"observed_at":"2026-08-06T23:20:33.640682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T23:20:31.310103Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.310103Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:725045524abdd42b30917a529ca29d641422e56f426d613835ebbdf812a1366d","observation_id":"a37fddcc-757e-4d52-a820-677a86314d8d","resolution":{"observed_at":"2026-08-06T23:20:31.310103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.486212Z","title":"van den Oord, O","venue":null,"work_id":"7f345ad7-fccf-4aa1-9c52-6dc423a0bef8","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.367005Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7893597be2173730fa984e71a1498b1392fb0081259bebc372af0db8c6745609","observation_id":"5be1d56b-27d8-41ef-a37e-6c2a4112c066","resolution":{"observed_at":"2026-08-06T23:20:33.526786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03801","last_updated":"2016-12-13T12:19:48Z","snapshot_observed_at":"2026-07-06T05:22:21.129782Z","submitted_at":"2016-12-12T17:32:49Z","title":"DeepMind Lab","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03801","snapshot_observed_at":"2026-08-06T23:20:31.423861Z","title":"Beattie, J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.423861Z"},"links":{"cited_paper":"/paper/1612.03801","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1e8ee944feda7503d7ef76c20b0339f2504497db08d400a147ba22d58322e9c4","observation_id":"97aea435-9078-4de1-8748-a7caad63346d","resolution":{"observed_at":"2026-08-06T23:20:31.423861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.367108Z","title":null,"venue":null,"work_id":"d0154d72-619b-4e6c-a9d9-d1972395767c","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.486552Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d89b1ff802374037ae8cb62b26c47a700f00692167b84ef10775b2b087263ef0","observation_id":"09bed2c9-ca32-47ab-ae08-7ff29f7001c8","resolution":{"observed_at":"2026-08-06T23:20:33.416713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-01T18:34:23.156273Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-06T23:20:31.535334Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.535334Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:e1f0e7ab23ce11b44cf062487743ea4e61776420d68eb8f50c4858c5314a1064","observation_id":"09d6e2b7-d554-411d-9174-89e35ab71755","resolution":{"observed_at":"2026-08-06T23:20:31.535334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:31.619481Z","title":"LeCun, B","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.619481Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:b8a988c54934f1742c1c7c31a28fb607532d248f15a9291ecc38be3c269f138f","observation_id":"592c5658-206b-4f0f-9b53-e57bd0aa7a3d","resolution":{"observed_at":"2026-08-06T23:20:31.619481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T23:20:31.697779Z","title":"Bengio, N","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.697779Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:78665fe8ff43ae0518749908ee58496fc9d63d48cb0b3187a22c6e7cfd57e069","observation_id":"7430370c-5a14-4f31-84b9-d241af7e2256","resolution":{"observed_at":"2026-08-06T23:20:31.697779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.215391Z","title":null,"venue":null,"work_id":"3cd0673b-e329-4397-9a10-a3fb20df3b72","year":1998},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.790288Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:39d4928a64999111ed60b64ac74e1e343349ba581ffb0c4a1a8b02557d446e67","observation_id":"20a7be27-0e4f-4fa7-a9ba-3e49864a3458","resolution":{"observed_at":"2026-08-06T23:20:33.283106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.086838Z","title":"Samvelyan, T","venue":null,"work_id":"c077f851-9293-4e45-9389-592368cbcf78","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.851998Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:5207a27ce82026e413aef6327efbdbd94406786c06f5f88ded64db4475d334f1","observation_id":"d37b0c5b-51df-4556-9e2d-bf6fb873780c","resolution":{"observed_at":"2026-08-06T23:20:33.129379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:32.968916Z","title":null,"venue":null,"work_id":"bfe00c64-cf5c-4873-b264-23d839b72a08","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.969512Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d95605c17b1c8a97518a66b1e6dd318fda513e39b2fe897f01bdc17773048fff","observation_id":"642f466d-0bc1-470e-aa98-edaad5891daa","resolution":{"observed_at":"2026-08-06T23:20:33.007884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-07-31T17:57:44.437235Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-08-06T23:20:32.017785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.017785Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:db1b77a9f9f9addf49bc83e66fb5e3c57d59ef27420bc79e66bfd7a58d481f7b","observation_id":"ccb30152-bd25-4b84-b799-820587482dd7","resolution":{"observed_at":"2026-08-06T23:20:32.017785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-06T23:20:32.068608Z","title":"Papoudakis, F","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.068608Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:bb09ffbc6a34a6c64df8442ad1ddbd0a9669f3c3220fa6127c8a74f162b0adc6","observation_id":"75e6f2ae-b847-4c12-9093-6f0199de36f7","resolution":{"observed_at":"2026-08-06T23:20:32.068608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04773","last_updated":"2025-07-03T18:43:16Z","snapshot_observed_at":"2026-08-08T21:28:59.079762Z","submitted_at":"2025-02-07T09:17:02Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","version":2},"cited_work":{"arxiv_id":"2502.04773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04773","snapshot_observed_at":"2026-08-06T23:20:32.296923Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","venue":"cs.LG","work_id":"fcbceb90-4d09-4b75-bee4-126b122e85c5","year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.100038Z"},"links":{"cited_paper":"/paper/2502.04773","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:37efbd04cf7f77e6634e8e8903c3511eccba4a93f0278ab641d2763ebde8b3e0","observation_id":"6b60707d-1f0a-403e-8d8c-30a975cfb7ad","resolution":{"observed_at":"2026-08-06T23:20:32.326732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:32.830199Z","title":"Formanek, A","venue":null,"work_id":"1e1d70e6-db8f-41c7-bf7f-1bd215c13745","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.169248Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1c3eed01f96028681a808bd3ba2821e1ca4fde6b5cef3fc6b7e0d5aebd2df21a","observation_id":"3fd8aaa9-eb35-4385-bc22-6b4d0790554c","resolution":{"observed_at":"2026-08-06T23:20:32.887100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T07:49:06.424059Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537."}