Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-02T22:04:28.337206Z
Paper Citation Record · LEDGER
As of 14 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2602.18291.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-02T22:04:28.337206Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-05-13T02:09:08.378144Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-05-13T02:17:07.063482Z
78 of 78 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 8aa0585d-5ab1-4f53-8af0-466412b8de62 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Reducing over- estimation bias in multi-agent domains using double centralized critics.Advances in Neural Information Processing Systems: Deep Reinforcement Learning Workshop, 2019
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0edcfc78-4495-4699-82d9-b2bec4ede4b5 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Is conditional generative modeling all you need for decision making? InThe Eleventh International Conference on Learning Representations, 2023
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d463945b-6886-47fa-a9b5-5b6c964e2a34 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Heterogeneous agent q-weighted policy optimization
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 09a54f33-e86c-405e-a452-c8e610f0edd2 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies A distributional perspective on reinforce- ment learning
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 07baafda-2862-491e-83a4-c8976017d7f5 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies The complexity of decentralized control of markov decision processes.Mathematics of operations research, 27(4):819–840, 2002
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5e76e748-7506-4273-8dbb-6bf2e7cfa2f3 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Crossq: Batch normalization in deep reinforcement learning for greater sample efficiency and simplicity
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fda59a7a-484e-4ba2-9acf-fe379e1fc0b1 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Video generation models as world simulators.OpenAI Blog, 2024
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 67c50d4b-b926-4457-a400-8f085394252d · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Dime: Diffusion-based maximum entropy reinforcement learn- ing
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4632eb1b-4764-4a87-be1c-d9fca1a47a7c · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Offline reinforcement learn- ing via high-fidelity generative behavior modeling
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 799e4683-82bc-47e2-b4e7-6b1fa48ebdf6 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Multi-agent systems for robotic autonomy with llms
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d61f4dbc-23d7-4bfc-baef-afb2bd27b1cf · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Novelty-guided data reuse for efficient and diversified multi-agent reinforcement learning
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1b96bde8-613c-410c-9406-c529ea269af3 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Continuous q-score matching: Diffusion guided reinforcement learning for continuous-time control
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 82761d8e-209e-4384-ab04-0a31f903b255 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion policy: Visuomotor policy learning via action diffusion
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b05aa95b-e6cf-4be0-823d-dde141e83ccf · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b3af9bd1-ab6a-4233-8f63-7eeb5f421f7d · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion-based reinforcement learning via q-weighted variational policy optimization
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 663ce302-8b4f-484e-9dd1-fb29515736c6 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Maximum entropy reinforcement learning with diffusion policy
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0bd1f0fe-d024-49bb-bdb5-0740687bac60 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion actor-critic: Formulating constrained policy iteration as diffusion noise regression for offline reinforcement learning
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0f49e7df-6b59-42e2-b179-a16c2dc9b560 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Counterfactual multi-agent policy gradients
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3bd49bc0-0bbe-473b-8f4a-7e2950fe5051 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies INS: Interaction-aware synthesis to enhance offline multi-agent reinforcement learning
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ac1dc2d7-cc3d-4f59-b3ff-3af4bf9df954 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Reinforcement learning with deep energy-based policies
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fbeb0abf-df4c-4d79-a5f3-8d74e0f4cf14 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2e9b247a-b8c4-4db6-b760-e86f77e3b138 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 85723d21-12ca-48d9-96ba-a0e76320a84b · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems, 33:6840–6851, 2020
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5bbb4517-1014-499d-8767-4994dfd49b5a · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Value diffusion reinforcement learning
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 43490b08-84e7-47af-adb1-e147b1267be1 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffuseloco: Real-time legged locomotion control with diffusion from offline datasets
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cb96d947-19fe-4f2c-899a-5e252f95472d · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffuseloco: Real-time legged locomotion control with diffusion from offline datasets
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation feb40cb8-1c11-4ec3-987f-487a6281f3f3 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Planning with diffusion for flexible behavior synthesis
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ab555b2-6de4-453c-9a13-d710bd142a22 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Agent- centric actor-critic for asynchronous multi-agent reinforcement learning
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8f0679dd-387c-4ce2-b8ca-edcb5a2077a6 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Efficient diffusion poli- cies for offline reinforcement learning.Advances in Neural Information Processing Systems, 36:67195–67212, 2023
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d90a251c-2c0b-4ef2-b90a-b2fd4f02f819 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Enhancing cooperative multi-agent reinforcement learning with state modelling and adversarial exploration
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ffae433b-0756-43ff-af77-81ac47cfdee5 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Gta: Generative trajectory aug- mentation with guidance for offline reinforcement learning.Advances in Neural Information Processing Systems, 37:56766–56801, 2024
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b0374e21-61ad-43a9-baa3-3cb0443f0e01 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Dof: A diffusion factorization framework for offline multi-agent decision making
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e3fed53a-03fc-4507-ac70-a62003398cae · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Race: improve multi-agent reinforcement learning with representation asymmetry and collaborative evolution
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 44cd21bf-5ce7-40c3-bccc-de5beccb5af5 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Revisiting cooperative off-policy multi-agent reinforcement learning
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ba7aa86f-93e3-421b-ae74-7263d2ce5661 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Beyond conservatism: Diffusion policies in offline multi-agent reinforcement learning, 2023
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c1a30748-be35-465d-8249-93e81cb93cb9 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Maximum entropy heterogeneous-agent reinforcement learning
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation da47b002-9793-4460-9c1a-be8802cfcd34 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Multi-agent actor-critic for mixed cooperative-competitive environments.Advances in neural information processing systems, 30, 2017
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation adcda0d4-dfeb-4616-99e1-f4f6b480de7c · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Contrastive energy prediction for exact energy-guided diffusion sampling in offline reinforcement learning
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation af3f3405-2da2-4785-a63c-7529943d029e · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps.Advances in neural information processing systems, 35:5775–5787, 2022
Reference 39
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 428fa515-8be7-42a9-b45d-3d8b48460055 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Synthetic experience replay
Reference 40
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 01b9b2a9-f57b-4b5a-b520-741750ccfe74 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Efficient online reinforcement learning for diffusion policy
Reference 41
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 32954f35-5902-4992-92b3-a1183ba4017a · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Coordinated multi-robot exploration under communication constraints using decentralized markov decision processes
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0db3259b-bd14-4f20-8970-3a20b242a678 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Springer, 2016
Reference 43
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ac5dc06c-64e2-4f20-80de-c15f7ca36f90 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Optimal and approximate q-value functions for decentralized pomdps.Journal of Artificial Intelligence Research, 32:289–353, 2008
Reference 44
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b0332c0e-26e0-49f1-bcfc-09de53732ba9 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Regularized softmax deep multi-agent q-learning.Advances in Neural Information Processing Systems, 34:1365–1377, 2021
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 006b0cce-ab73-406f-87c5-d3600ac8bc26 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Imitating human behaviour with diffusion models
Reference 46
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a49f2ac6-cd40-46ab-a13b-72fc3f204ef6 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Facmac: Factored multi-agent centralised policy gradients.Advances in Neural Information Processing Systems, 34:12208–12221, 2021
Reference 47
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b33d97f5-84e8-4b4f-bb7a-7b0cf6f1551c · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Learning a diffusion model policy from rewards via q-score matching
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c615cfca-10b0-424a-8515-20246f653564 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Offline multi- agent reinforcement learning via score decomposition, 2025
Reference 49
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8354513a-2915-49a5-87bc-5397a5c11fdc · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1dfe89fe-c934-43eb-815a-1ad402d9021c · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion policy policy op- timization
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 18573499-073d-4276-abcf-a5d0827711ba · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Cambridge University Press, 2019
Reference 52
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 09732023-1356-4ad4-b559-4124bd17bb6f · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Deep unsuper- vised learning using nonequilibrium thermodynamics
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a5d05d26-4c9a-4bd1-887c-d167ef1cca15 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fc62605d-a25b-4575-bd5a-48920336f2f8 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Generative modeling by estimating gradients of the data distribution.Advances in Neural Information Processing Systems, 32, 2019
Reference 55
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5eca49e0-f487-41b4-9a84-4b4e1ce2d1dc · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Score-based generative modeling through stochastic differential equations
Reference 56
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 22a449f3-5bee-405b-8a21-f0d3095deb35 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Value- decomposition networks for cooperative multi-agent learning based on team reward
Reference 57
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 69d0f040-3a44-49c5-a2f4-0e19ca4ccbc9 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Multiagent cooperation and competition with deep reinforcement learning.PloS one, 12(4):e0172395, 2017
Reference 58
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5e072159-5d89-4d28-be9f-8cfd2f07a4ba · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Multi-agent reinforcement learning: Independent vs
Reference 59
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 05cf5ec7-49c5-4160-af66-449e38478cc2 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Qplex: Duplex dueling multi-agent q-learning
Reference 60
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5ef2290f-b7b6-4e14-8ac3-b95d98e4fdd8 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion actor-critic with entropy regulator
Reference 61
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8c3d0d84-a22a-4091-b3c1-a46bdf9e3f08 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Enhanced dacer algorithm with high diffusion efficiency.arXiv preprint arXiv:2505.23426, 2025
Reference 62
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a42577d2-d03c-4c23-aa9d-686f5adf05fe · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Diffusion policies as an expressive policy class for offline reinforcement learning
Reference 63
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 22d90049-e7b9-483d-a551-58697a16d129 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Learning intractable multimodal policies with repa- rameterization and diversity regularization
Reference 64
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 75fbc84b-3ef7-40ad-969f-1f355fa74897 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Latent diffusion planning for imitation learning
Reference 65
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a573defa-0370-4ce4-832b-3a1ef0e00e5a · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Multi-agent reinforcement learning with communication-constrained priors
Reference 66
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f6ae37c0-7199-4409-a2f7-82b83cdbeeb0 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Policy Representation via Diffusion Probability Model for Reinforcement Learning
Reference 67
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7281ef6b-bfc0-4c19-9ccd-d63b7abe0f5c · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Fine-tuning diffusion policies with backpropagation through diffusion timesteps, 2025
Reference 68
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 38e11d57-8b9d-4527-b36b-13f48431defa · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies The surprising effectiveness of ppo in cooperative multi-agent games.Advances in neural in- formation processing systems, 35:24611–24624, 2022
Reference 69
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4aa68b3c-890f-4b5c-a5c1-255c4d0e910b · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Turbodiffusion: Accelerating video diffusion models by 100-200 times
Reference 70
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2eaa20ea-6bc4-4662-ae07-71531815e0d7 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Adding conditional control to text-to-image diffusion models
Reference 71
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9a75dd48-b868-470a-a3b0-232e0f0eb89b · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Scaling in-the-wild training for diffusion- based illumination harmonization and editing by imposing consistent light transport
Reference 72
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d35ad57d-25c7-4f7a-a625-0053afb43e14 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Revisiting multi-agent world modeling from a diffusion-inspired perspective
Reference 73
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2297dc93-9b69-466c-b7a0-ba738651c7c7 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Heterogeneous-agent reinforcement learning.Journal of Machine Learning Research, 25(32):1– 67, 2024
Reference 74
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9997169c-da64-4e85-9c82-6abccf050280 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Smarts: An open-source scalable multi- agent rl training school for autonomous driving
Reference 75
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 84cb4240-94d2-41e2-b980-4932a2befbdd · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Madiff: Offline multi-agent learning with diffusion models.Advances in Neural Information Processing Systems, 37:4177–4206, 2024
Reference 76
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b91f9b1-681f-45dd-9424-37451d130912 · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies Maximum entropy inverse reinforcement learning
Reference 77
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 47fc1995-c07a-403a-a969-22a9f6efe9ee · outbound
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies In spite of policy-centric ap- proaches, DIMA [73] uses diffusion models as environment dynamics to boost data efficiency
Reference 78
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation da7a6cb4-c6d0-4186-a5d2-0114d72cb8ec · inbound
Coordinated Diffusion: Generating Multi-Agent Behavior Without Multi-Agent Demonstrations Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.