Pith. sign in

Paper Citation Record · LEDGER

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition

As of 17 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2505.05968.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.05968 v3

Coverage vector

measured 63 of 63 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T22:59:50.876652Z

measured 63 of 63 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

63 of 63 outbound references displayed

  • verified exact5
  • verified fuzzy25
  • unresolved33
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 2557e51e-a8d3-413e-9784-23a30e8223bc · outbound

This paper cites Principal component analysis.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Principal component analysis

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:49.788752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:49.788752Z digest=sha256:1a3167c3450147118dcc5953a81b1834ad3faba83fc90bdf5562310e3d5a0d17

Observation 7653a9b4-f54d-4df9-9924-d38b20b46270 · outbound

This paper cites A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.546746Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:49.793128Z digest=sha256:6f3f48c80d118ce95107907cff2b11063465a4020ce9aa4fa5dd78c7d6e9dc7a

Observation a2f15c44-b325-4109-936d-b3c5440dbf8d · outbound

This paper cites Dota 2 with Large Scale Deep Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dota 2 with Large Scale Deep Reinforcement Learning

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:49.797810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:49.797810Z digest=sha256:e000f5ade5aca5646d865cb8cdce616499d514bd618d8320a1abd876b4ec06a3

Observation ea42da4e-c88c-42a7-b134-358f45640970 · outbound

This paper cites The complexity of decentralized control of markov decision processes.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The complexity of decentralized control of markov decision processes

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.659625Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:49.813816Z digest=sha256:af0a38650066bc91cd6154cc4d8d88b8eaa11dc7b4a1ebd0cbde72fb353ba542

Observation a5a7f5d3-7d74-45f9-b049-6328a4a2c595 · outbound

This paper cites ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.332261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:49.891890Z digest=sha256:37feb364ef7813379b888c2fdc4e9833850874d7a18de6f80b9af5b41bb63301

Observation 00393317-47cd-4435-957c-500b7422bc3b · outbound

This paper cites Powernet: Multi-agent deep reinforcement learning for scalable powergrid control.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Powernet: Multi-agent deep reinforcement learning for scalable powergrid control

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.642454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.037702Z digest=sha256:96b67803f63004d902dd2cf248888c1c8ed242ebe4a5f9302759cdeb94c8d017

Observation c03b083a-0ceb-4ed8-abef-b93a7077cd91 · outbound

This paper cites Score regularized policy optimization through diffusion behavior.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Score regularized policy optimization through diffusion behavior

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.626552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.042861Z digest=sha256:c0269b6e38068ebeefab0d2feb2d1fbfe45f62634ce08a318fb33a9568643d82

Observation 2a856e86-3d4e-458e-bb3b-16110f8b7eac · outbound

This paper cites Offline Reinforcement Learning via High-Fidelity Generative Behavior Modeling.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning via High-Fidelity Generative Behavior Modeling

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.050622Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.050622Z digest=sha256:95cd81cb5b86be7196d3257a956163fb4c5e82cb75e3e7de028204878313fb0b

Observation fb4cca48-bf70-41fa-8346-88bc0883e05e · outbound

This paper cites Consistency Models as a Rich and Efficient Policy Class for Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Consistency Models as a Rich and Efficient Policy Class for Reinforcement Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.090536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.090536Z digest=sha256:ab3bc0f999acac02d69a90449e0ff09a41171af57599103232044cd2c7409511

Observation 14dfefd4-2b6d-41fb-b68c-debe33a3db79 · outbound

This paper cites Putting Data at the Centre of Offline Multi-Agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Putting Data at the Centre of Offline Multi-Agent Reinforcement Learning

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.240888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.093769Z digest=sha256:b020f1323d9d24e3cb09c05fd0097aa3415209ee3e118398d05744d3dfb4ee7c

Observation f86591a4-e4da-4b67-a624-57c5b97389f2 · outbound

This paper cites Off-the-grid marl: Datasets and baselines for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Off-the-grid marl: Datasets and baselines for offline multi-agent reinforcement learning

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.608137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.098501Z digest=sha256:65a4f64342002c9080d463aaae5904c374a48d8a5a44fe1f23901d12a3e233e6

Observation 573b543a-2e51-4a1a-8a2c-b31233752b23 · outbound

This paper cites Dis- pelling the mirage of progress in offline marl through standardised baselines and evaluation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dis- pelling the mirage of progress in offline marl through standardised baselines and evaluation

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.592922Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.101602Z digest=sha256:4066e2b1558250a7b3eee5742e25d1519dd88b88bb1176c379d627eed022574a

Observation cb9f4b0b-1b31-471f-a05b-5bc1c5015d0f · outbound

This paper cites Henriques.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Henriques

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.575458Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.105265Z digest=sha256:160e2d30c6c8ff390e6c8fe7f6e9ab7982dcaef044ea8fe188186da7aaa220e2

Observation a520a7d7-d5da-49c3-ac04-faba70847c67 · outbound

This paper cites Rein- forcement learning-based consensus reaching in large-scale social networks.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Rein- forcement learning-based consensus reaching in large-scale social networks

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.557930Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.110579Z digest=sha256:292ecf5d191b54d990498d18855457a2b052c4deef22d4db91ab0dc197d772b9

Observation ac1f2933-4fef-426b-aa4c-07f5f4a472fe · outbound

This paper cites Dynamic programming for partially observable stochastic games.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dynamic programming for partially observable stochastic games

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.542768Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.115432Z digest=sha256:402dd49150e1251db73f6292aa6d169a66b893b55fa96a6ba5c322d9c1fc1d7f

Observation b5693bad-8ae4-4d43-abe8-f2837e5e62f2 · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.119474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.119474Z digest=sha256:7ed40bde6f6ac21497ff3a1cadba1c7f7ebaaefb7dd7e2cb02348116e7377020

Observation f3ac3c8b-7ac8-473a-88c7-fa6d9eaf7cfb · outbound

This paper cites Denoising diffusion probabilistic models.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Denoising diffusion probabilistic models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.123465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.123465Z digest=sha256:cede25e31c315e42531519a8b842ae7c2f0ed2bb0542641b42dcf7e54da28b83

Observation c025c414-851f-41b3-b217-08c388c2aa64 · outbound

This paper cites Actor-attention-critic for multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Actor-attention-critic for multi-agent reinforcement learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.127346Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.127346Z digest=sha256:3de3019cc66ae215149474af925d86a857526b0efa7106db5e635697a960882a

Observation 96e22250-89ad-46ca-9d6d-3c89db93c8c0 · outbound

This paper cites Offline Decentralized Multi-Agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Decentralized Multi-Agent Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.131941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.131941Z digest=sha256:cfe0301d4c71922248d2106ffd55edd3ae85512a6f24f5a9145a4721cf8fffa9

Observation 50f6e36f-f3ae-4b6c-9d0f-4af051ac523a · outbound

This paper cites Efficient diffusion policies for offline reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Efficient diffusion policies for offline reinforcement learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.136089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.136089Z digest=sha256:7dff4d6b560a2616753bdaa31591b0830cac3623fdfeed7a8ab54b2764aca8ab

Observation 357029c6-3312-4851-a72d-ffb045cd2a71 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning with Implicit Q-Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.140108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.140108Z digest=sha256:4a3772e5150b99ba1b30b1d056d59dd4ee847576aa9d68fdff1356c86707963c

Observation 6bcbc435-866e-4fa3-9c06-fa1f94c1ebe3 · outbound

This paper cites Trust region policy optimisation in multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Trust region policy optimisation in multi-agent reinforcement learning

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.492536Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.143886Z digest=sha256:a99773bc18db7c6b7ca8e49c6cba399015fe9170976111e3ae0c6cae3e72838b

Observation 6765777d-6c39-478e-99ad-79bab16f3ea3 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.147101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.147101Z digest=sha256:0338a2ac31c9b64f13c800254499b29f870cb08c22e92f8a919f0333acc67f77

Observation da8636cf-aef0-465d-9924-07ff3de1a78e · outbound

This paper cites Dof: A diffusion factorization framework for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dof: A diffusion factorization framework for offline multi-agent reinforcement learning

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.476695Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.215357Z digest=sha256:6b82d6e94b6c2c2a3650be7be9a55757c349a56fc45a590dc1a7b8035b61971f

Observation 5dc0bb25-9d7a-4249-9024-544558c00531 · outbound

This paper cites Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.264937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.264937Z digest=sha256:d62bc546c9132255d34ed7eb07c4bfa7d643d3e783d91eb2214a9d5fda8033a4

Observation 9e6c36f2-5d08-452d-a05b-c98dddedf5d5 · outbound

This paper cites A kernelized stein discrepancy for goodness-of-fit tests.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A kernelized stein discrepancy for goodness-of-fit tests

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.456662Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.319329Z digest=sha256:9fe7c03671091ea70cd3fc907181823fa63fb715d3e2f6844cf829750f399bf6

Observation b9ada247-d453-46bb-a675-4764fe349322 · outbound

This paper cites Offline multi-agent reinforcement learning via in-sample sequential policy optimization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi-agent reinforcement learning via in-sample sequential policy optimization

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.344670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.344670Z digest=sha256:07df07c0e3866ab2c1ad2a24f4092f10a1004efd741cafa9071b001bfe2ee303

Observation 37ba1b02-ed87-49c2-a356-318bc6324c64 · outbound

This paper cites Multi-agent actor-critic for mixed cooperative-competitive environments.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent actor-critic for mixed cooperative-competitive environments

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.396857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.396857Z digest=sha256:43514083f158b7ebc6c03bba5decc483ea3870f40ed07a84896b653d1eed5074

Observation 0615b0d0-235a-48a3-8ca1-0c61ebc4179b · outbound

This paper cites Efficient and scalable reinforcement learning for large-scale network control.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Efficient and scalable reinforcement learning for large-scale network control

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.416670Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.400129Z digest=sha256:f2bc6cd7c3882dc12584d31a29135cc36ea1953dd15658c2dd9780108599b3a7

Observation c03c630a-e96d-48ba-bd9a-5332322fe7d3 · outbound

This paper cites Learning to coordinate from offline datasets with uncoordinated behavior policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Learning to coordinate from offline datasets with uncoordinated behavior policies

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.402829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.402829Z digest=sha256:bdf55535f0126bf04f3f1de5effb2d2589ccdcc6d56c0c898fb18bd30c92d893

Observation c388c804-e5f4-456b-aaf6-2bd70cb16212 · outbound

This paper cites Dynamic economic emissions dispatch optimisation using multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dynamic economic emissions dispatch optimisation using multi-agent reinforcement learning

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.387774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.405985Z digest=sha256:a6b887e6607000a915cbd470853a30d832ff9843bf776510c44129d81bb56493

Observation 1da9306d-1e1b-4b3f-bee0-44382af1c89d · outbound

This paper cites Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.408829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.408829Z digest=sha256:dbfc6ba2352a045c9a02d6f214f824e3f06401475b5c8f2c9a65e3a81efd30db

Observation 71f12ca2-e6d5-4a04-8ff2-318d5312c190 · outbound

This paper cites AlberDICE: Addressing Out-Of-Distribution Joint Actions in Offline Multi-Agent RL via Alternating Stationary Distribution Correction Estimation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition AlberDICE: Addressing Out-Of-Distribution Joint Actions in Offline Multi-Agent RL via Alternating Stationary Distribution Correction Estimation

Reference 33

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.107831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.411820Z digest=sha256:3eb6479ca4bd88cb452c58b6d155fe3176b77da486344cfb16f52cc3cb7bcb3d

Observation d39dea81-78f9-4b71-bdc1-efafbffcc13c · outbound

This paper cites Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.414755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.414755Z digest=sha256:26ab64139a239fc07d6d44accfaf4ac5538cb61d980ae5dc07f092e3687280ab

Observation 1d194515-c6e7-4869-8a5d-7791e3210820 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.418518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.418518Z digest=sha256:29ed9b70de2a163de47b477fb8419790b95d8be8662f1ca82a30cfd456bc11d7

Observation 260eb825-7af6-4704-ac99-d38c03e6ac8c · outbound

This paper cites Plan better amid conservatism: Offline multi-agent reinforcement learning with actor rectification.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Plan better amid conservatism: Offline multi-agent reinforcement learning with actor rectification

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.421683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.421683Z digest=sha256:030b5289e38302a60bff294dd149c832db8a709f983f9afd45a9f0928b16eb51

Observation a85312c7-bba3-429e-9846-996f0f272feb · outbound

This paper cites Facmac: Factored multi-agent centralised policy gradients.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Facmac: Factored multi-agent centralised policy gradients

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.360156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.424577Z digest=sha256:cc71a89b703e2a72074442d8581709f026d65536dcf39dc96beb0d6be3835eb0

Observation c6bdc2e9-f4ee-4db5-b32a-9f7db8e1aede · outbound

This paper cites A survey on offline reinforcement learning: Taxonomy, review, and open problems.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A survey on offline reinforcement learning: Taxonomy, review, and open problems

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.427565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.427565Z digest=sha256:9c729a18f1f3696c69577141716fcfd766e1959b693a5fa4776e2b16cd9aeaaa

Observation 5978b74e-ac05-4102-a484-f603438d68fe · outbound

This paper cites Monotonic value function factorisation for deep multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Monotonic value function factorisation for deep multi-agent reinforcement learning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.431436Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.431436Z digest=sha256:fc65d588a5cd4e826ce2e3f3150bc75845206e22630216163d0254a98b0495a1

Observation 9180358f-4391-4bbb-a6ce-28c01ca85939 · outbound

This paper cites Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement Learning

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.042106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.436133Z digest=sha256:24b33615ddff2d0c8c5942b5f143360cc9019455d7c5d9756a2038c8f06774dd

Observation 440ee5e2-2047-4642-a67b-565297168f08 · outbound

This paper cites Deep unsuper- vised learning using nonequilibrium thermodynamics.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Deep unsuper- vised learning using nonequilibrium thermodynamics

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.439686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.439686Z digest=sha256:4169130e0a5dad32a562bfa3426d1d262a12c88d88500791a02e2c3446aca71a

Observation e2bca209-df4e-45d0-9489-0acdc0c0eeeb · outbound

This paper cites Generative modeling by estimating gradients of the data distribution.yang-song.net, May 2021.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Generative modeling by estimating gradients of the data distribution.yang-song.net, May 2021

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.298204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.443221Z digest=sha256:948883ba84167e4a4aa3b29e23e78432b2bdedd81610a1906d987d32cd02c650

Observation 424fe638-8309-4658-b87b-c02f3a47c5b9 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Score-Based Generative Modeling through Stochastic Differential Equations

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.446948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.446948Z digest=sha256:c50fe38e26c0e8a2fe5b030d60f5412b8759f7442ad6b31b2836ebae668cfef3

Observation aa912955-c13d-494d-bb8a-bfa64493113a · outbound

This paper cites Arena: A general evaluation platform and building toolkit for multi-agent intelligence.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Arena: A general evaluation platform and building toolkit for multi-agent intelligence

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.273929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.450090Z digest=sha256:43e681d9abb6818207ede65aa40a032b53c21c1dc07072f674d2e9e97b9a0772

Observation 2b10dfcf-8119-432a-bcc2-09d1048aa270 · outbound

This paper cites Corl: Research-oriented deep offline reinforcement learning library.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Corl: Research-oriented deep offline reinforcement learning library

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.246918Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.452899Z digest=sha256:5f61d7a86df48c97aa36c3127a7ce4991ca28c5ae0d69597eace1b9ce78bc34e

Observation 8994c3c3-e1a8-43f0-b9d4-115e116cd291 · outbound

This paper cites Learning from good trajectories in offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Learning from good trajectories in offline multi-agent reinforcement learning

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.035848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.456202Z digest=sha256:3c1cfb573498a0cd5e00204309f8b9b1e9e2fa9744a9336e8e4eda3aa9e03b7f

Observation 3e5bd0d7-6e9f-4856-98ad-9edccc9b9a6b · outbound

This paper cites Coordination Failure in Cooperative Offline MARL.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Coordination Failure in Cooperative Offline MARL

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.459632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.459632Z digest=sha256:3ed7fa53cf10a8857ba73d7c06a68e8c36d078ec3522c08254ff0e4bb881e079

Observation 5333fee4-92a2-4ebd-a56e-7aee2cdbc5c1 · outbound

This paper cites Offline multi- agent reinforcement learning with knowledge distillation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi- agent reinforcement learning with knowledge distillation

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.822838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.510720Z digest=sha256:c738420938ad0db0cfb27d224129dc5ee70b03f47bca4707241a0e2bb353b5f7

Observation 2cbc3ce4-6ade-432a-ad7b-68f8c16a4c44 · outbound

This paper cites Visualizing data using t-sne.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Visualizing data using t-sne

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.564316Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.564316Z digest=sha256:1a19fe59d61b9aa3b40c09a384afc21d7734844c26fec4f694509726a37eab30

Observation 3af2ea25-f153-45ff-976c-f7df1b6591f2 · outbound

This paper cites Offline multi-agent reinforce- ment learning with implicit global-to-local value regularization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi-agent reinforce- ment learning with implicit global-to-local value regularization

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.722059Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.633044Z digest=sha256:c8aa7af092f9bda1a59f7e9ed3553ebb9ddb4a1ac5d6faa2062617a928ef744b

Observation 0cf2474d-2b95-47c3-8f6f-317b9b3cd0e1 · outbound

This paper cites Order Matters: Agent-by-agent Policy Optimization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Order Matters: Agent-by-agent Policy Optimization

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.682482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.682482Z digest=sha256:39ac19f7977da2376c00f79a9a0b4bcda034e90cbec8cfb71ebf024913b2f433

Observation 190a48fe-a9cf-42f3-b51f-360084e11a24 · outbound

This paper cites Diffusion policies as an expressive policy class for offline reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Diffusion policies as an expressive policy class for offline reinforcement learning

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.687626Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.687626Z digest=sha256:c593228f0c7ff8ebb13651fd98aa6fe777c90f226a74d209c1ef41404e0d20fa

Observation c48582e8-3d0b-4cba-8152-6d636294c178 · outbound

This paper cites MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.692456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.692456Z digest=sha256:c43a13c11827aebf4d70c6eb7466c4f70a16d9d9d7274633a3d91e85c426c893

Observation aa076a28-958a-43c8-93a7-518dbd173854 · outbound

This paper cites Multi-agent reinforcement learning is a sequence modeling problem.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent reinforcement learning is a sequence modeling problem

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.696576Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.696576Z digest=sha256:fc53fe495dc72b65327b9502f6a312c5f8786b077930c541a3e3dfbb79bc9838

Observation 5a95ce8f-2087-49cd-8691-632001322ab2 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Behavior Regularized Offline Reinforcement Learning

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.700224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.700224Z digest=sha256:eb828fb24b53b6f391e82c425c5fa4806a62a63cc3ac9574f8e00165e8d6f471

Observation 96f34187-5050-49fd-8303-b587aa7aec38 · outbound

This paper cites Game-Theoretic Multiagent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Game-Theoretic Multiagent Reinforcement Learning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.704955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.704955Z digest=sha256:bd245af8cf2b3c11fbd9b6ef329e3b3fca74240ffaf35ec5c87d1403065fd756

Observation 12eadc7e-a6bc-4888-af22-58cfc68e34ca · outbound

This paper cites Believe what you see: Implicit constraint approach for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Believe what you see: Implicit constraint approach for offline multi-agent reinforcement learning

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.693472Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.765669Z digest=sha256:2935d2cc83d19576c7dce0c0d6f80c2e158481ac1ca548b8a300d969b4279d44

Observation 2d2f3544-5939-4d31-a95a-8cc75e2cd10d · outbound

This paper cites Multi-agent reinforcement learning: A selective overview of theories and algorithms.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent reinforcement learning: A selective overview of theories and algorithms

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.668106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.854535Z digest=sha256:5b4613c768bc3c91575729b825123c0f8902534311fac05b4719c303d2939c5d

Observation e331b35d-80f7-4c13-a4a5-76714090dad9 · outbound

This paper cites Fop: Factorizing optimal joint policy of maximum-entropy multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Fop: Factorizing optimal joint policy of maximum-entropy multi-agent reinforcement learning

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.628298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.858923Z digest=sha256:ac96f3a0cd903f6eb867dd531365ec3df5ecf3b6ee3db8d7621d5103d6a8168f

Observation e18fa33e-eba4-4f3c-b0e6-c78371fa46ec · outbound

This paper cites The AI Economist: Improving Equality and Productivity with AI-Driven Tax Policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The AI Economist: Improving Equality and Productivity with AI-Driven Tax Policies

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.862730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.862730Z digest=sha256:e5e711c42a7dc7f2cfd99fb0c687ec02cd826133229b297e876c842ad967c0f6

Observation de72b18a-441d-4e2c-bf6b-5805072b165b · outbound

This paper cites guide-then-select.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition guide-then-select

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.616027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.867827Z digest=sha256:5ad4b7107002a661864bccb966ac405dde7329d16e10fce08fca270df28ab969

Observation 561a1827-18f8-4ce6-a718-760e318fd1d7 · outbound

This paper cites an unresolved cited work.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Unresolved cited work

Reference 63

Resolution
unresolved
raw_fallback, observed 2026-08-15T22:59:51.559769Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.876652Z digest=sha256:04febbc48b54337a66a41de6f37b3aeeb0820e0386593a97afce41195feb090f

Observation e1c3942d-e424-488b-b4fc-a8ba2f9b7fb8 · outbound

This paper cites The key hyperparameters for OMSD are summarized in Table 3.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The key hyperparameters for OMSD are summarized in Table 3

Reference 512

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.601447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-15T22:59:50.872841Z digest=sha256:a196652bed89230023d8f324697bd77992c789b7e1928048c51d335a8f5beaf6

Pith citing papers

No inbound Pith citation observations are available.