Pith. sign in

Paper Citation Record · LEDGER

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus

As of 9 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 2 inbound Pith citation observations for arXiv:2604.13472.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2604.13472 v2

Coverage vector

measured 72 of 72 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T16:21:02.619794Z

measured 74 of 74 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-01T16:42:03.341501Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

72 of 72 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved71
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 3f096986-f7ab-483a-8b87-97dc845136ff · outbound

This paper cites Multi-agent reinforcement learning for resources allocation optimization: a survey,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-agent reinforcement learning for resources allocation optimization: a survey,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:01.769117Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:01.769117Z digest=sha256:40d4998ea89d92bece09e456a0a1812b98f39f7aafed0298ba74d3110a5e07ed

Observation 0eae5d6b-db86-4266-9bb9-9c2d52d20378 · outbound

This paper cites A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:01.811472Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:01.811472Z digest=sha256:86198f1ae42b33229e69fe43a103f635f873a53580cb31467ee244c612744e74

Observation c2fafc46-a2fe-4689-bd39-271228bd48c6 · outbound

This paper cites Monotonic value function factorisation for deep multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Monotonic value function factorisation for deep multi-agent reinforcement learning,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:01.865496Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:01.865496Z digest=sha256:a7842a578d2df846b9988566b938241f70578079bce59ded8aa64541f256499a

Observation 6f2ffcd7-6f47-4cbd-ab7e-c1e1ed2d76ff · outbound

This paper cites Mean field multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Mean field multi-agent reinforcement learning,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:01.932681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:01.932681Z digest=sha256:dd9049c46744b2a5ba4e8904e9e96ca93a19b4f540f1887c21896e0071e02dac

Observation c95161ea-8219-4d5d-b000-5e0790e3918a · outbound

This paper cites Counterfactual multi-agent policy gradients,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Counterfactual multi-agent policy gradients,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:01.989048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:01.989048Z digest=sha256:62cf53e80c33c0ac19564f32cc3ca726e99abf339cdc1017b341aa3308dc8d9f

Observation c530e9fd-bd06-472a-8a94-1b9a3e9e1569 · outbound

This paper cites A review of cooperative multi-agent deep reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A review of cooperative multi-agent deep reinforcement learning,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.042044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.042044Z digest=sha256:00594740707daed287e743a68d43511c97df137646ce4f2bf3179d01a94d5947

Observation b3dab8c9-46c2-4002-b1a9-ff093767f184 · outbound

This paper cites Exponential topology-enabled scalable communication in multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Exponential topology-enabled scalable communication in multi-agent reinforcement learning,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.095138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.095138Z digest=sha256:0c761bcdbc3a789ab42618771f29b972b397b2e85658706e3b8b8180580f451f

Observation dd9558b8-a9aa-4285-8b40-dbc30a9981d7 · outbound

This paper cites Multi-agent reinforcement learning is a sequence modeling problem,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-agent reinforcement learning is a sequence modeling problem,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.179058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.179058Z digest=sha256:f96f9ccbbb858c533fa5bd3e09ac2312516ee738c02943cc360db740ff71a01f

Observation 8cdac679-90f3-475d-99bc-823d431b9cca · outbound

This paper cites Attention is all you need,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Attention is all you need,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.237103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.237103Z digest=sha256:d2791174f2212ec670bb32643726fb14afef7f514aedf9beda0993ddb935276f

Observation fe78d248-508f-4547-b5b7-0993f516a8fd · outbound

This paper cites Pmat: Optimizing action generation order in multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pmat: Optimizing action generation order in multi-agent reinforcement learning,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.295041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.295041Z digest=sha256:8a78a1f34c076c907cd42949b1fb8ecacdf9b9c7f2fb3e56c0983350a101ccf2

Observation 48899a0e-78e4-4e12-927c-014cf8dfdefd · outbound

This paper cites Aoad-mat: Transformer-based multi-agent deep reinforcement learning model considering agents’ order of action decisions,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Aoad-mat: Transformer-based multi-agent deep reinforcement learning model considering agents’ order of action decisions,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.351138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.351138Z digest=sha256:3a7a24e0cff1a3cf0b1a4015c008da0af73ebba695e74cf2475aa56839480baa

Observation 8028283e-e66f-4b9e-9598-d9626bd8b2bb · outbound

This paper cites Triple-bert: Do we really need marl for order dispatch on ride-sharing platforms?,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Triple-bert: Do we really need marl for order dispatch on ride-sharing platforms?,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.354954Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.354954Z digest=sha256:cedf28dd4ab36143a9e9d01a8f199e3428df3680b84af1ff5b4902517ff5ca85

Observation b121257c-fad5-4f54-a114-7094b974b50e · outbound

This paper cites Proximal Policy Optimization Algorithms.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Proximal Policy Optimization Algorithms

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.358933Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.358933Z digest=sha256:8a40eb169fa4125aaaf97999a3583dad88adf01c26ca95a30205beb3202e2a08

Observation 26e7f974-a514-4b04-a7c4-72d90f2049a5 · outbound

This paper cites The starcraft multi-agent challenge,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The starcraft multi-agent challenge,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.363224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.363224Z digest=sha256:b8f3ee4a7c1157bcf70b1bcba7811125af0e0219a70d6325c3df02c16cc58a93

Observation a3370656-0e27-4c4a-8513-0cbec2b39286 · outbound

This paper cites FACMAC: Factored Multi-Agent Centralised Policy Gradients.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus FACMAC: Factored Multi-Agent Centralised Policy Gradients

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.367590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.367590Z digest=sha256:a347d6eb5575d01bdc18fcd5b9e703ac4a3ea30a54fa6d1b9c6df21c1a056642

Observation 6e5439ed-d20f-425e-a942-723cff0a09a8 · outbound

This paper cites Google research football: A novel reinforcement learning environment,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Google research football: A novel reinforcement learning environment,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.372140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.372140Z digest=sha256:c9d19aa4552190be4be63283fff9972b56fd949f8a424f27ddaaadee59da831b

Observation 76707ac2-3a8f-4c4c-bde9-af29e2d36abb · outbound

This paper cites Markov games as a framework for multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Markov games as a framework for multi-agent reinforcement learning,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.376025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.376025Z digest=sha256:a0be35fe25386502c325b6878969bdb53ed84d60e4f8825b0bc443c03d56c2a4

Observation 4adf6899-05b3-46f1-8822-2688a325d873 · outbound

This paper cites High-Dimensional Continuous Control Using Generalized Advantage Estimation.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus High-Dimensional Continuous Control Using Generalized Advantage Estimation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.379885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.379885Z digest=sha256:c573c8f9900c50811626160747eb2901360516a0ec2a089e3a559a700e9712ea

Observation 34c0337c-6938-43ce-912e-406f507433e3 · outbound

This paper cites Trust region policy optimisa- tion in multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Trust region policy optimisa- tion in multi-agent reinforcement learning,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.384022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.384022Z digest=sha256:9b782ae0b87b29fb37e2fdc1ed03c9696bd30b84bd9098a848ddbc539e8da8d6

Observation 74e170eb-74f7-4fc6-b36b-560a26e51f61 · outbound

This paper cites Heterogeneous-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Heterogeneous-agent reinforcement learning,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.387737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.387737Z digest=sha256:686c29f887217ced3727d929cdf201d295c1bc82a62da0693f4eac13ef97588a

Observation b485e56e-dc0c-4853-89b1-1536ddc4a593 · outbound

This paper cites Maximum entropy heterogeneous-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Maximum entropy heterogeneous-agent reinforcement learning,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.392083Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.392083Z digest=sha256:f3deb5b5a117023ecfb74d166f8df5e7d3ed53279cac2be89a90ac775812a103

Observation 1950890f-8f93-48df-9edd-6b842f533033 · outbound

This paper cites Bert: Pre-training of deep bidirectional transformers for language understanding,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Bert: Pre-training of deep bidirectional transformers for language understanding,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.395765Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.395765Z digest=sha256:6748089b40d3bd88543f5bc540ece56b0163beb97b92d435f5de20f97713eef0

Observation 20cebcbb-d358-42ab-9fcc-b074f8c1fe4a · outbound

This paper cites Csi-bert2: A bert-inspired framework for efficient csi prediction and classification in wireless communication and sensing,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Csi-bert2: A bert-inspired framework for efficient csi prediction and classification in wireless communication and sensing,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.400049Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.400049Z digest=sha256:6a1fcc8af6ea58c1d9615001d62a5e5b167000d3092b6c606c985e0db3b1f864

Observation 12d7b636-5fcc-4969-9ed0-520bb6fe9902 · outbound

This paper cites Midibert-piano: Large-scale pre-training for symbolic music classification tasks,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Midibert-piano: Large-scale pre-training for symbolic music classification tasks,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.404188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.404188Z digest=sha256:b8dcfc6cc90f406ead4601dc7a5b892bf89de0c3ed10b7fcc8c16a80290c106b

Observation 76cab228-b24e-422c-8dba-59ee1002798f · outbound

This paper cites an unresolved cited work.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.408153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.408153Z digest=sha256:36ed922667a4bf6cf5a8461779fc8d186001a898142d87ed79975470b6646d83

Observation 2a1f538c-e18c-4705-9b4a-ac4211823aaa · outbound

This paper cites The analysis of permutations,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The analysis of permutations,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.412093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.412093Z digest=sha256:51d0cfd068d5902f315d2ac67926e5b927e4a29964b8b93f23ad206d427b0e93

Observation b23b8c9d-8cc3-43f8-91bb-4bb5db6e9c60 · outbound

This paper cites The surprising effectiveness of ppo in cooperative multi-agent games,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The surprising effectiveness of ppo in cooperative multi-agent games,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.416124Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.416124Z digest=sha256:eed5d8ed3f763b980051783950eaad5e7681fa9890fa9b4b52d56088b3d4f645

Observation f7e3f403-dfe6-4f9d-b1e0-7272e0f979dc · outbound

This paper cites A Survey of Progress on Cooperative Multi-agent Reinforcement Learning in Open Environment.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Survey of Progress on Cooperative Multi-agent Reinforcement Learning in Open Environment

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.420089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.420089Z digest=sha256:c075025276d30e2ee9025b83406b99c3b50ed708db9107b4407b43a6818fd856

Observation e926ffce-7d9a-4a68-bd1e-860268622628 · outbound

This paper cites Hysteretic q-learning: an algorithm for decentralized reinforcement learning in cooperative multi-agent teams,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Hysteretic q-learning: an algorithm for decentralized reinforcement learning in cooperative multi-agent teams,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.424864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.424864Z digest=sha256:48de1fb8bf042977c87b81de7938f7388f0d65f7593a25147a8f6ccc83948aea

Observation e59494ab-35d2-45a0-8f4c-e35b9c4cb829 · outbound

This paper cites Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.429019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.429019Z digest=sha256:26a99c672649ba108fd751e83ccd597cd1eac57e627d96f6a11b4ef7f4842511

Observation 1333c306-e205-405b-81c7-1bddab6cfe52 · outbound

This paper cites Shapley counterfactual credits for multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Shapley counterfactual credits for multi-agent reinforcement learning,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.433472Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.433472Z digest=sha256:40c409c122a477a5d3ec0883766886e922ee50e363d9e634a5f65c0f44eac061

Observation c7c76c0e-bd93-4b51-a981-8b98872f9f0b · outbound

This paper cites Value-decomposition networks for cooperative multi- agent learning based on team reward,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Value-decomposition networks for cooperative multi- agent learning based on team reward,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.437538Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.437538Z digest=sha256:896583130e646939f44a6503cc232d8e6e55b0fcbe3cdd671917dfa556b17cea

Observation bfd309f4-d53a-475e-a335-70ddbff9cfed · outbound

This paper cites Value-decomposition multi-agent actor-critics,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Value-decomposition multi-agent actor-critics,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.441687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.441687Z digest=sha256:fd1ee7d9b820603b1516c0d60a7139bd06f7d4c49c51c154dae9394a410a57bd

Observation 883e2051-5f2e-4a27-8498-ac80d50dd3ae · outbound

This paper cites Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.445742Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.445742Z digest=sha256:4d57b33a04d98f606a978591aaeafc5a00411c1a0015c431e90add7b0eb124cd

Observation 9bb1637e-f874-4870-9217-1c4529c5fa9e · outbound

This paper cites Hierarchical value decomposition for effective on-demand ride- pooling,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Hierarchical value decomposition for effective on-demand ride- pooling,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.450144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.450144Z digest=sha256:7a5c347ab74ab95d7e33ec84ab0fb3390abe1f4cdf3463d8483ff2bad5eb338d

Observation 579e79d9-4c37-427f-8178-976efc418e34 · outbound

This paper cites Efficient distributed reinforcement learning through agreement,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Efficient distributed reinforcement learning through agreement,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.454531Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.454531Z digest=sha256:39690baaaba5f08599bf32fd70621d02730ff03540e78ec16933f4660185d976

Observation 6f261ecc-156a-4a2b-b41d-60ca612a65ed · outbound

This paper cites Learning multiagent communication with backpropagation,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Learning multiagent communication with backpropagation,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.458864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.458864Z digest=sha256:af2537d22ead83411614c87dc9c1d631f1456fe550d146ef206eb97eb04e4aad

Observation f5360e51-5050-4121-8e04-38337102126e · outbound

This paper cites Tarmac: Targeted multi-agent communication,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Tarmac: Targeted multi-agent communication,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.463575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.463575Z digest=sha256:62e9c1860c3036f00fc72803cff5ab124dc58b706c6fa3149310a4066a0c0c5c

Observation 7bd9ca5e-d663-4ce4-b86a-d20541a5b0f0 · outbound

This paper cites Context-aware communication for multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Context-aware communication for multi-agent reinforcement learning,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.468585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.468585Z digest=sha256:8e78e0741028a516bd3332e49312dbb9ea38dd1d14f18bc3458956c0c56184b4

Observation 50e8e9e5-2437-4809-8805-c764522e966c · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus An image is worth 16x16 words: Transformers for image recognition at scale,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.472824Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.472824Z digest=sha256:fe317955dd8f61953b4c063b8fb80724edfa0a81f1a4d27c66036aaa4bca4714

Observation 05153e96-cb09-4119-a8d5-0ef6e360c6bb · outbound

This paper cites Automatic stage lighting control: Is it a rule- driven process or generative task?,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Automatic stage lighting control: Is it a rule- driven process or generative task?,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.477029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.477029Z digest=sha256:9e0a24aaf4fb80080f2c5df521a49d5585df004578af3b17fca9a85e1a134632

Observation 9c54297a-5978-4c0c-8423-4eb5d1c78d10 · outbound

This paper cites On transforming reinforcement learning with transformers: The development trajectory,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On transforming reinforcement learning with transformers: The development trajectory,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.481524Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.481524Z digest=sha256:c564c8937e5a50f33b4c59857669e56eb67dcbf93fec1e9392638a8270a2c4a5

Observation d4175225-f9ca-4fe3-a74f-cf928fd82b46 · outbound

This paper cites Deep recurrent q-learning for partially observable mdps.,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Deep recurrent q-learning for partially observable mdps.,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.486509Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.486509Z digest=sha256:a046f1d9fcc5b5d892542e2c81d40774cff5e536d2e76cecf9a6c5f665562e07

Observation fcb1783f-a570-4bb3-86fc-a9c8eae53b7c · outbound

This paper cites Stabilizing transformers for reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Stabilizing transformers for reinforcement learning,

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.490948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.490948Z digest=sha256:155d4ddf402c2cb31e0026309a5024e051b6f37e360ef2c667eea18881388470

Observation b4021c4b-bbd7-46b7-903b-0706f4efacf0 · outbound

This paper cites Transdreamer: Reinforcement learning with trans- former world models,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Transdreamer: Reinforcement learning with trans- former world models,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.496161Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.496161Z digest=sha256:1c96c266d67d249836eeb625f52624443f4e2f4521ae1ac9dda4f0ce212e5f13

Observation e837cc5e-77f0-4396-b413-eae2365afed3 · outbound

This paper cites Dream to control: Learning behaviors by latent imagination,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Dream to control: Learning behaviors by latent imagination,

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.500851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.500851Z digest=sha256:f8cac69ce737adcd8c8ecafca23e702dbb98bdd354729760ba384b34ac183798

Observation ead0410a-7615-4b65-864e-2c02992164e0 · outbound

This paper cites Offline reinforcement learning as one big sequence modeling problem,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Offline reinforcement learning as one big sequence modeling problem,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.505229Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.505229Z digest=sha256:cbce96154ef7da82f77c2d5ce0b8bf9fe138a77646d8331bc12c0a2e6a835f1b

Observation e2a97379-105f-4446-9ebc-be5aeffeafae · outbound

This paper cites Decision transformer: Reinforcement learning via sequence modeling,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Decision transformer: Reinforcement learning via sequence modeling,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.509785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.509785Z digest=sha256:ae71c503cace645669a17ae267af4383373ef9cc4a50942ecb34036893ccdffc

Observation bc209aff-b940-4eef-bcb0-ccec7f89d06a · outbound

This paper cites Online decision transformer,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Online decision transformer,

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.514251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.514251Z digest=sha256:8b552f9697af0cb523adfd39704642f0221005f0469b409e2cca9aa1e3e019e7

Observation cf6c4f10-8de8-40f7-a707-43b74033aaa8 · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.518579Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.518579Z digest=sha256:f0d264db7abb7f19a1cd4c8ed008991ec49bb8a850d4f77dd972ac2195fff80e

Observation 5b5132bd-1822-4b64-b006-0a9e3b778b07 · outbound

This paper cites A survey on transfer learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A survey on transfer learning,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.523011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.523011Z digest=sha256:2b373249c6a3078e7aceece5d99d22774849add256b397b45561709ffb0e2072

Observation 7e8013a8-78dc-46a8-85f5-b1fbab5ce287 · outbound

This paper cites Can Wikipedia Help Offline Reinforcement Learning?.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Can Wikipedia Help Offline Reinforcement Learning?

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.527948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.527948Z digest=sha256:d88dde69896168106741452e7e34637a26954597a6157cd7b0aaf1ffe79aa883

Observation 36b15cf2-806b-46a2-ba6c-fa4c27bdf4a8 · outbound

This paper cites Pre-trained language models for interactive decision-making,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pre-trained language models for interactive decision-making,

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.534132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.534132Z digest=sha256:a6f14d2ff2447c79fa6494491f518311135048dcc100bbd75a3b37b7f12948ce

Observation bbf041bd-b044-4d5f-bcaa-50f97ca770dd · outbound

This paper cites Masked autoencoding for scalable and generalizable decision making,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Masked autoencoding for scalable and generalizable decision making,

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.538636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.538636Z digest=sha256:f3df99e5c6c5e9384f88f3bef73d00961eefeccb588a0d99f4668ad0c2579e15

Observation 83da4276-20b4-4d9b-b98c-30df4d2ede4f · outbound

This paper cites Masked trajectory models for prediction, representation, and control,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Masked trajectory models for prediction, representation, and control,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.542890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.542890Z digest=sha256:3680dbeff77f36009bfe9f3f0d874bf0c5cb73980d630252e9c4506754c7fbe9

Observation 1674ddbf-7bd8-4ad7-ac2b-f891a358a5d4 · outbound

This paper cites Prompting decision transformer for few-shot policy generalization,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Prompting decision transformer for few-shot policy generalization,

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.547157Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.547157Z digest=sha256:eccc19b5447240a294bb4981adf87e2f8dbc6c1e0d4ad7a507cf06ac3be23ac1

Observation 8dfffbf5-2b6c-432c-903d-7ecc386a5bf1 · outbound

This paper cites Contextual Transformer for Offline Meta Reinforcement Learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Contextual Transformer for Offline Meta Reinforcement Learning

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.551334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.551334Z digest=sha256:9c54aa262a98b366d45a406aa666fd176e64d703a6d764bfe9cd7de84b5a5f4c

Observation 5ea913a1-2f6d-4873-8d80-73be79ff1d30 · outbound

This paper cites Multi-game decision transformers,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-game decision transformers,

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.555920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.555920Z digest=sha256:5599c76f00199a9f313800905e6ccecd7c65f27f2573d3cd7f6288421d1d2b34

Observation ee58f0d8-f2e5-49a4-9841-a920c61af595 · outbound

This paper cites A Generalist Agent.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Generalist Agent

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.560025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.560025Z digest=sha256:d6b4eb01c1b553fc28c3547e86991d79340670289ffc54094caca0e62d77264f

Observation b6855677-f7e7-485b-9261-4db8ef5dd9f1 · outbound

This paper cites Learning multi-agent communication from graph modeling perspective,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Learning multi-agent communication from graph modeling perspective,

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.564572Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.564572Z digest=sha256:773069cafcf583818899b5f7f6a63227e011f8e27039f0a0dff77e0959d879ea

Observation 9e898705-b5a2-403f-acb8-cbf984d7741d · outbound

This paper cites MaskMA: Towards zero-shot multi-agent decision making with mask-based collaborative learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus MaskMA: Towards zero-shot multi-agent decision making with mask-based collaborative learning,

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.569333Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.569333Z digest=sha256:bf323f04c75b3d91b76fc78241996969de39600f6afd59a2e0b9513e60bbb339

Observation da28a524-71eb-4227-bb91-b28c0c15c02f · outbound

This paper cites UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with Transformers.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with Transformers

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.573583Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.573583Z digest=sha256:4f8841c6abe517e21025e44fd3bd566d93c19f35508a4582427ee0a479a4d86a

Observation 9979c65b-e53a-4e04-bfee-45d9c2fbb720 · outbound

This paper cites Pytorch: An imperative style, high-performance deep learning library,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pytorch: An imperative style, high-performance deep learning library,

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.578153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.578153Z digest=sha256:afee7d3a69cbefd0ac29f6f989da02b8f8760ce28ef6c95f64cb40605f4e831f

Observation 555d393e-ac72-41a4-b49c-6503aa0f5fa6 · outbound

This paper cites On the theory of policy gradient methods: Optimality, approximation, and distribution shift,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On the theory of policy gradient methods: Optimality, approximation, and distribution shift,

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.582936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.582936Z digest=sha256:40ba75c93081ad56f688d1b5eead2514505b26a79a8f5d2c21a01a47acf80b33

Observation 1a2f7f55-1a62-4c3b-846c-ddd936e1c0a3 · outbound

This paper cites On the global convergence rates of softmax policy gradient methods,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On the global convergence rates of softmax policy gradient methods,

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.588123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.588123Z digest=sha256:3cb4124be61f61f734b7b6074c8eb639f9cc5a45a89c9b56faf4d87d49c8886e

Observation f338d6e9-25e1-468f-9c9c-d3e17f36e718 · outbound

This paper cites Convergence rates of bayesian network policy gradient for cooperative multi-agent reinforcement learning,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Convergence rates of bayesian network policy gradient for cooperative multi-agent reinforcement learning,

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.593291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.593291Z digest=sha256:a1d62ab9707a73f58e0fd319f5a59251056b036afcba97a7fabb66030b04cf9e

Observation 2e5e7145-a2bd-4f41-abcd-95c20cb3a1a6 · outbound

This paper cites A reinforcement learning algorithm for obtaining the nash equilib- rium of multi-player matrix games,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A reinforcement learning algorithm for obtaining the nash equilib- rium of multi-player matrix games,

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.597577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.597577Z digest=sha256:90e38f19c487f7e25531e79caeedfe757cb47799947a08ad0b136d5dfcf83dd7

Observation 1231b19a-812c-4029-aff3-929cc4b97905 · outbound

This paper cites an unresolved cited work.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Unresolved cited work

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.601888Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.601888Z digest=sha256:f59407e7ce74ea7b928f22271e874ecf32f6d47d37222db798303b860c27ac9b

Observation b18a5396-cda9-4e36-9152-d89a9f57580f · outbound

This paper cites A Generalized Alternating Method for Bilevel Learning under the Polyak-{\L}ojasiewicz Condition.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Generalized Alternating Method for Bilevel Learning under the Polyak-{\L}ojasiewicz Condition

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.606459Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.606459Z digest=sha256:a90703b3c2d2464f3edfcdf0c06e09f18dfaf26d29c7b64a59a06422b043b383

Observation ebafba30-f7e3-4883-b89e-458873507b50 · outbound

This paper cites Convergence proof for actor-critic methods applied to ppo and rudder,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Convergence proof for actor-critic methods applied to ppo and rudder,

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.611061Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.611061Z digest=sha256:d9ea615a8271684242fb77297731fc209a03f4784d893e4d7e5f732e2f43a6f7

Observation 0aa9669a-712c-4f8d-9397-f41031dc76e5 · outbound

This paper cites Ppo-clip attains global optimality: To- wards deeper understandings of clipping,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Ppo-clip attains global optimality: To- wards deeper understandings of clipping,

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-02T16:21:02.615304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.615304Z digest=sha256:d223008385ad93da625e9da0c45cac19177e825f14349132d25d7edbcfa89f55

Observation 4b728d8c-b150-403e-90e7-4c909fb11a52 · outbound

This paper cites Implicit learning dynamics in stackelberg games: Equilibria characterization, convergence analysis, and empirical study,.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Implicit learning dynamics in stackelberg games: Equilibria characterization, convergence analysis, and empirical study,

Reference 72

Resolution
malformed identifier
no resolver link, observed 2026-08-02T16:21:02.619794Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:21:02.619794Z digest=sha256:a7f10ae80cbc88aaac50774c061c54a8c86faa71cee2fb7db1ff839ef77690ee

Pith citing papers

Observation 88069d6a-9a26-46e2-9735-4ffaba853dc0 · inbound

Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning cites this paper.

Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-13T03:08:01.590659Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T03:08:01.590659Z digest=sha256:7c9f207075e2edfd26df7743307e9e28a4fd5ad482b8a1d16baa69cc37e13741

Observation e86fa2a0-4660-40d3-8c4f-a290712c33d6 · inbound

Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization cites this paper.

Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-01T16:42:03.341501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:42:03.341501Z digest=sha256:5a19742102f92f8eaa1b3fd688b74cfb8ca852aae924765cbcecc5c6efa5ee67