Pith. sign in

Paper Citation Record · LEDGER

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition

As of 19 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2505.05968.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.05968 v3

Coverage vector

measured 63 of 63 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T22:59:50.876652Z

measured 63 of 63 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

63 of 63 outbound references displayed

  • verified exact5
  • verified fuzzy25
  • unresolved33
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 2557e51e-a8d3-413e-9784-23a30e8223bc · outbound

This paper cites Principal component analysis.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Principal component analysis

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:49.788752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:49.788752Z digest=sha256:fdc0193360dbac72a67f504246d1af0b33fccbaf2171b2086bd01962c98c12a0

Observation 7653a9b4-f54d-4df9-9924-d38b20b46270 · outbound

This paper cites A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.546746Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:49.793128Z digest=sha256:9e0b034aec03a80c4ec66aba5d54d28824bbcc38f2f49103b65f31cfc2b5db6f

Observation a2f15c44-b325-4109-936d-b3c5440dbf8d · outbound

This paper cites Dota 2 with Large Scale Deep Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dota 2 with Large Scale Deep Reinforcement Learning

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:49.797810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:49.797810Z digest=sha256:343bc85faf209e66e282e44a6de42bf2366307d832d9062496b130b2171e370b

Observation ea42da4e-c88c-42a7-b134-358f45640970 · outbound

This paper cites The complexity of decentralized control of markov decision processes.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The complexity of decentralized control of markov decision processes

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.659625Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:49.813816Z digest=sha256:bf31ba21d9d84f504c49233a5507f8b819cce475f18ef2c7b1192a06b38ae15c

Observation a5a7f5d3-7d74-45f9-b049-6328a4a2c595 · outbound

This paper cites ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.332261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:49.891890Z digest=sha256:7f2e0f26e937383120a9c35e29da508ae442c464dd03726b6fa86adfd6132a0f

Observation 00393317-47cd-4435-957c-500b7422bc3b · outbound

This paper cites Powernet: Multi-agent deep reinforcement learning for scalable powergrid control.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Powernet: Multi-agent deep reinforcement learning for scalable powergrid control

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.642454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.037702Z digest=sha256:41360b641b0b93a64d167104860e5c637205da0d8df0f3b05a56c73d4f295311

Observation c03b083a-0ceb-4ed8-abef-b93a7077cd91 · outbound

This paper cites Score regularized policy optimization through diffusion behavior.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Score regularized policy optimization through diffusion behavior

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.626552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.042861Z digest=sha256:a638a6f5f91f0fb11057304542beda48afec0d2a93ec47fae25a73e87f092bfc

Observation 2a856e86-3d4e-458e-bb3b-16110f8b7eac · outbound

This paper cites Offline Reinforcement Learning via High-Fidelity Generative Behavior Modeling.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning via High-Fidelity Generative Behavior Modeling

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.050622Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.050622Z digest=sha256:90e3f2ece3fa888ff92f22225b4dab3f9e31c27448e53bc58bf76da31a755904

Observation fb4cca48-bf70-41fa-8346-88bc0883e05e · outbound

This paper cites Consistency Models as a Rich and Efficient Policy Class for Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Consistency Models as a Rich and Efficient Policy Class for Reinforcement Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.090536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.090536Z digest=sha256:8572c74aa06359e0cb8431ea86e2ef923d8354b7eb435be9b410ce854dcb4716

Observation 14dfefd4-2b6d-41fb-b68c-debe33a3db79 · outbound

This paper cites Putting Data at the Centre of Offline Multi-Agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Putting Data at the Centre of Offline Multi-Agent Reinforcement Learning

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.240888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.093769Z digest=sha256:52258704d3ddfb178fdbfe0fde47fc4bb98896d354e175f83b4f8cc7d72b1547

Observation f86591a4-e4da-4b67-a624-57c5b97389f2 · outbound

This paper cites Off-the-grid marl: Datasets and baselines for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Off-the-grid marl: Datasets and baselines for offline multi-agent reinforcement learning

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.608137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.098501Z digest=sha256:dd55266c1f2a484ccbb932d0d59b99f2e2168db9f29230c6550effd231df0042

Observation 573b543a-2e51-4a1a-8a2c-b31233752b23 · outbound

This paper cites Dis- pelling the mirage of progress in offline marl through standardised baselines and evaluation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dis- pelling the mirage of progress in offline marl through standardised baselines and evaluation

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.592922Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.101602Z digest=sha256:66bbdd9dc1560f230537840df5bd164bbb8245420e14fa6f93b7343e25daca53

Observation cb9f4b0b-1b31-471f-a05b-5bc1c5015d0f · outbound

This paper cites Henriques.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Henriques

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.575458Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.105265Z digest=sha256:63fb4b10b584ae2ea78d225e179d03ae40bdd909ca5a6ada11f53dfeb3afcfc8

Observation a520a7d7-d5da-49c3-ac04-faba70847c67 · outbound

This paper cites Rein- forcement learning-based consensus reaching in large-scale social networks.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Rein- forcement learning-based consensus reaching in large-scale social networks

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.557930Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.110579Z digest=sha256:db97c81adf877e9ca9e3834d85968c6df2c03ae93be614ea1cfb5f6227877645

Observation ac1f2933-4fef-426b-aa4c-07f5f4a472fe · outbound

This paper cites Dynamic programming for partially observable stochastic games.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dynamic programming for partially observable stochastic games

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.542768Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.115432Z digest=sha256:f31c0483ce0729a7d5c54c1d92e86cdd5966877d6ef27a8a631e447cb02bcba4

Observation b5693bad-8ae4-4d43-abe8-f2837e5e62f2 · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.119474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.119474Z digest=sha256:5a44358794f8ca174875a4aaa2136ef5d0fd84666161a0ca96e1b0b82b48bb66

Observation f3ac3c8b-7ac8-473a-88c7-fa6d9eaf7cfb · outbound

This paper cites Denoising diffusion probabilistic models.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Denoising diffusion probabilistic models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.123465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.123465Z digest=sha256:941200785ff96d7d39472fb4b915260a43d6e02075e4e26cb7ffd535242d11dd

Observation c025c414-851f-41b3-b217-08c388c2aa64 · outbound

This paper cites Actor-attention-critic for multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Actor-attention-critic for multi-agent reinforcement learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.127346Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.127346Z digest=sha256:b6729fee5bde1898b3a408fe3dbe43687a9fd49efb864c1a200076bdfb78a7eb

Observation 96e22250-89ad-46ca-9d6d-3c89db93c8c0 · outbound

This paper cites Offline Decentralized Multi-Agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Decentralized Multi-Agent Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.131941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.131941Z digest=sha256:a767d565bbaffa1fdd6cac3ebc3fd2afc6e43b6a636975fef45412eb269dfdb3

Observation 50f6e36f-f3ae-4b6c-9d0f-4af051ac523a · outbound

This paper cites Efficient diffusion policies for offline reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Efficient diffusion policies for offline reinforcement learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.136089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.136089Z digest=sha256:8895161d98d5c9b5cac7ce52ca03ea8223f4d7fd8487dfcc352d0eec9d3419a8

Observation 357029c6-3312-4851-a72d-ffb045cd2a71 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning with Implicit Q-Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.140108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.140108Z digest=sha256:65b141d05665626d0ed0e87927c2ccf0f11369aed5fd6a812ee9309347fc96e3

Observation 6bcbc435-866e-4fa3-9c06-fa1f94c1ebe3 · outbound

This paper cites Trust region policy optimisation in multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Trust region policy optimisation in multi-agent reinforcement learning

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.492536Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.143886Z digest=sha256:7905ddcc4746348ac8f6354e78ce356d6e6595c3cb3f50bd8d447ab8b18a06ed

Observation 6765777d-6c39-478e-99ad-79bab16f3ea3 · outbound

This paper cites Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.147101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.147101Z digest=sha256:8fd08312c538c55e8966d57b765a455448ddbde9ad8672ab27c857d2b84cf320

Observation da8636cf-aef0-465d-9924-07ff3de1a78e · outbound

This paper cites Dof: A diffusion factorization framework for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dof: A diffusion factorization framework for offline multi-agent reinforcement learning

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.476695Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.215357Z digest=sha256:a9cc468596117ce77863c9a6d6af996064de868042308c528bf2dc26e4d6f588

Observation 5dc0bb25-9d7a-4249-9024-544558c00531 · outbound

This paper cites Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.264937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.264937Z digest=sha256:4bb6bd587aa0f50af4f306a13e6c9a091b57677d9f5a2d4d3764e01d3040b096

Observation 9e6c36f2-5d08-452d-a05b-c98dddedf5d5 · outbound

This paper cites A kernelized stein discrepancy for goodness-of-fit tests.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A kernelized stein discrepancy for goodness-of-fit tests

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.456662Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.319329Z digest=sha256:91b23910e266b45dce95bedadf700a2074f849ff3ffaa1d44efda17a0d5fb954

Observation b9ada247-d453-46bb-a675-4764fe349322 · outbound

This paper cites Offline multi-agent reinforcement learning via in-sample sequential policy optimization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi-agent reinforcement learning via in-sample sequential policy optimization

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.344670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.344670Z digest=sha256:69503c15014fa4fda456629060f7eae325ab3989cbaf48bf5b895e253c7078ad

Observation 37ba1b02-ed87-49c2-a356-318bc6324c64 · outbound

This paper cites Multi-agent actor-critic for mixed cooperative-competitive environments.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent actor-critic for mixed cooperative-competitive environments

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.396857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.396857Z digest=sha256:907f7ccd2a9b2a01fa07b7f56b3a3d2239203bea60eaa907ddff3d9b91741be4

Observation 0615b0d0-235a-48a3-8ca1-0c61ebc4179b · outbound

This paper cites Efficient and scalable reinforcement learning for large-scale network control.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Efficient and scalable reinforcement learning for large-scale network control

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.416670Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.400129Z digest=sha256:2e487adb1f8e0a580989f20d58b8428399dc986f2b5ae072b019de404e1adb52

Observation c03c630a-e96d-48ba-bd9a-5332322fe7d3 · outbound

This paper cites Learning to coordinate from offline datasets with uncoordinated behavior policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Learning to coordinate from offline datasets with uncoordinated behavior policies

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.402829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.402829Z digest=sha256:f530d95e76d71e555ecbd54a7211944e25670aa5ba9886bf917570bf8645dd4b

Observation c388c804-e5f4-456b-aaf6-2bd70cb16212 · outbound

This paper cites Dynamic economic emissions dispatch optimisation using multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Dynamic economic emissions dispatch optimisation using multi-agent reinforcement learning

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.387774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.405985Z digest=sha256:aa81ff9ed7974bdc5bfd003743f51af50c706502f94d3d81d69529e853fb4f3f

Observation 1da9306d-1e1b-4b3f-bee0-44382af1c89d · outbound

This paper cites Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.408829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.408829Z digest=sha256:d969282fcf4f49b95751276e209e63fb10b0a303ac6e737ecbd148eb680faabc

Observation 71f12ca2-e6d5-4a04-8ff2-318d5312c190 · outbound

This paper cites AlberDICE: Addressing Out-Of-Distribution Joint Actions in Offline Multi-Agent RL via Alternating Stationary Distribution Correction Estimation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition AlberDICE: Addressing Out-Of-Distribution Joint Actions in Offline Multi-Agent RL via Alternating Stationary Distribution Correction Estimation

Reference 33

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.107831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.411820Z digest=sha256:a5bf349634e39aec9745ca6ca4e4dc1f4fa7c5d558743f4bc756659e2c4aa23b

Observation d39dea81-78f9-4b71-bdc1-efafbffcc13c · outbound

This paper cites Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.414755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.414755Z digest=sha256:7f44a4e60abb445f07306b618a24d602eb18c4dbed7a7d17a1eeb9876fb484d9

Observation 1d194515-c6e7-4869-8a5d-7791e3210820 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.418518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.418518Z digest=sha256:d8bd416a176c29d8e3a3756c357cd2b1a48cd3b0aa85ca6fe4dfe95509018b1b

Observation 260eb825-7af6-4704-ac99-d38c03e6ac8c · outbound

This paper cites Plan better amid conservatism: Offline multi-agent reinforcement learning with actor rectification.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Plan better amid conservatism: Offline multi-agent reinforcement learning with actor rectification

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.421683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.421683Z digest=sha256:9e45ca79928e28450e5dbc193d773c0b60b6dcb003f2665524ea39b6a25cdc0b

Observation a85312c7-bba3-429e-9846-996f0f272feb · outbound

This paper cites Facmac: Factored multi-agent centralised policy gradients.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Facmac: Factored multi-agent centralised policy gradients

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.360156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.424577Z digest=sha256:29ef8997917641cdc4a7314f78c0bdec5af6ca977d90ac005fc31ba2bec7fb42

Observation c6bdc2e9-f4ee-4db5-b32a-9f7db8e1aede · outbound

This paper cites A survey on offline reinforcement learning: Taxonomy, review, and open problems.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition A survey on offline reinforcement learning: Taxonomy, review, and open problems

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.427565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.427565Z digest=sha256:32f93cde912c14aed812accf3fb2e2fa6164ef0732a9082da81d65e31667d6bb

Observation 5978b74e-ac05-4102-a484-f603438d68fe · outbound

This paper cites Monotonic value function factorisation for deep multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Monotonic value function factorisation for deep multi-agent reinforcement learning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.431436Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.431436Z digest=sha256:c5fdd4f598b7dcf36caabf43626d1072dcdcfa13f8a25ebd1ccc6e1618f15bad

Observation 9180358f-4391-4bbb-a6ce-28c01ca85939 · outbound

This paper cites Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement Learning

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-15T22:59:51.042106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.436133Z digest=sha256:72a05dfdef29228a334ff738323154d2c31e52e5870969da28d14e79dea7b5a2

Observation 440ee5e2-2047-4642-a67b-565297168f08 · outbound

This paper cites Deep unsuper- vised learning using nonequilibrium thermodynamics.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Deep unsuper- vised learning using nonequilibrium thermodynamics

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.439686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.439686Z digest=sha256:a8e0708505497e6f790c5fad933e01997c22b0f4628ccd88a37e7513c147f47e

Observation e2bca209-df4e-45d0-9489-0acdc0c0eeeb · outbound

This paper cites Generative modeling by estimating gradients of the data distribution.yang-song.net, May 2021.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Generative modeling by estimating gradients of the data distribution.yang-song.net, May 2021

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.298204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.443221Z digest=sha256:7d3e5bc3f6dcb0388d54b6b995d08a25571f19295f1580b094e45c3b984ab4e1

Observation 424fe638-8309-4658-b87b-c02f3a47c5b9 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Score-Based Generative Modeling through Stochastic Differential Equations

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.446948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.446948Z digest=sha256:cb959a3480e5885f8c95c3db4e762b547b9573ad1652f8bd93c5eeb39e72ebf1

Observation aa912955-c13d-494d-bb8a-bfa64493113a · outbound

This paper cites Arena: A general evaluation platform and building toolkit for multi-agent intelligence.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Arena: A general evaluation platform and building toolkit for multi-agent intelligence

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.273929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.450090Z digest=sha256:7976c66e0211f07ce4a2acb44c9ba8473b1666ceb2c2252f399a7c62f66a19bf

Observation 2b10dfcf-8119-432a-bcc2-09d1048aa270 · outbound

This paper cites Corl: Research-oriented deep offline reinforcement learning library.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Corl: Research-oriented deep offline reinforcement learning library

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.246918Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.452899Z digest=sha256:09d0e7eea0cd418466eafef545c2d1b7c977bb3fb1cad31e75226d9b75341dbf

Observation 8994c3c3-e1a8-43f0-b9d4-115e116cd291 · outbound

This paper cites Learning from good trajectories in offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Learning from good trajectories in offline multi-agent reinforcement learning

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:52.035848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.456202Z digest=sha256:54dd0e977b835c4b56495ee9b59ca6aa317d4c2941031452cf1c6e0ababd5ea2

Observation 3e5bd0d7-6e9f-4856-98ad-9edccc9b9a6b · outbound

This paper cites Coordination Failure in Cooperative Offline MARL.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Coordination Failure in Cooperative Offline MARL

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.459632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.459632Z digest=sha256:78b4215b5cd4bdb8f764d61717b800bc9629425e698726556962c90476a06f97

Observation 5333fee4-92a2-4ebd-a56e-7aee2cdbc5c1 · outbound

This paper cites Offline multi- agent reinforcement learning with knowledge distillation.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi- agent reinforcement learning with knowledge distillation

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.822838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.510720Z digest=sha256:f974dc90871b6c5f62207ecd73a42db99d0e88d0367b69726dab6ee82ffc7a11

Observation 2cbc3ce4-6ade-432a-ad7b-68f8c16a4c44 · outbound

This paper cites Visualizing data using t-sne.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Visualizing data using t-sne

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.564316Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.564316Z digest=sha256:05c913c670b6de33ce6d76a68d2ecab1912f861c739731fc89d186f705859e3f

Observation 3af2ea25-f153-45ff-976c-f7df1b6591f2 · outbound

This paper cites Offline multi-agent reinforce- ment learning with implicit global-to-local value regularization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Offline multi-agent reinforce- ment learning with implicit global-to-local value regularization

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.722059Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.633044Z digest=sha256:ea30ae071edf19b4672d288a34b8616cbea3a7ab5d809276194d345cb7737eee

Observation 0cf2474d-2b95-47c3-8f6f-317b9b3cd0e1 · outbound

This paper cites Order Matters: Agent-by-agent Policy Optimization.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Order Matters: Agent-by-agent Policy Optimization

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.682482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.682482Z digest=sha256:42044c57dae4ac4235135b9d5f07b0a50c6b6afed4b363f0d7b185cf49e03f04

Observation 190a48fe-a9cf-42f3-b51f-360084e11a24 · outbound

This paper cites Diffusion policies as an expressive policy class for offline reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Diffusion policies as an expressive policy class for offline reinforcement learning

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.687626Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.687626Z digest=sha256:8b64bc8140175734984e59fdfa92048de101262aa1893c31a79178692b78a159

Observation c48582e8-3d0b-4cba-8152-6d636294c178 · outbound

This paper cites MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.692456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.692456Z digest=sha256:e42429dd1a538e410dcc037d75242cbba6c260a562ef1f1031b56574187dd3f6

Observation aa076a28-958a-43c8-93a7-518dbd173854 · outbound

This paper cites Multi-agent reinforcement learning is a sequence modeling problem.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent reinforcement learning is a sequence modeling problem

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.696576Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.696576Z digest=sha256:1d997b00e43040e04a476fa0d3b5319cf36f44f649835e3b6e00aff5d4b9bedd

Observation 5a95ce8f-2087-49cd-8691-632001322ab2 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Behavior Regularized Offline Reinforcement Learning

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.700224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.700224Z digest=sha256:db7e377c12d34420c77d9ba14c405a5e42bafb9db0a4119d821893d9dcbae0d4

Observation 96f34187-5050-49fd-8303-b587aa7aec38 · outbound

This paper cites Game-Theoretic Multiagent Reinforcement Learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Game-Theoretic Multiagent Reinforcement Learning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.704955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.704955Z digest=sha256:09c4b6c3a8cf19096fd6421d83570c5ffbaa9db2e61e0047e0058aadaa9546d8

Observation 12eadc7e-a6bc-4888-af22-58cfc68e34ca · outbound

This paper cites Believe what you see: Implicit constraint approach for offline multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Believe what you see: Implicit constraint approach for offline multi-agent reinforcement learning

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.693472Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.765669Z digest=sha256:5ab026f072f29331b7ad9e34488fd541730eb987a4c6c537550606a95b6b562a

Observation 2d2f3544-5939-4d31-a95a-8cc75e2cd10d · outbound

This paper cites Multi-agent reinforcement learning: A selective overview of theories and algorithms.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Multi-agent reinforcement learning: A selective overview of theories and algorithms

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.668106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.854535Z digest=sha256:657b8c42c7d136331ff4a9ee29367dab0ad15f897489704398fb78119ab938a2

Observation e331b35d-80f7-4c13-a4a5-76714090dad9 · outbound

This paper cites Fop: Factorizing optimal joint policy of maximum-entropy multi-agent reinforcement learning.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Fop: Factorizing optimal joint policy of maximum-entropy multi-agent reinforcement learning

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.628298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.858923Z digest=sha256:754aaa63b0ab8bfc894fb8c353f2bc076dd7afec4dc2b315dacef69675b1ec38

Observation e18fa33e-eba4-4f3c-b0e6-c78371fa46ec · outbound

This paper cites The AI Economist: Improving Equality and Productivity with AI-Driven Tax Policies.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The AI Economist: Improving Equality and Productivity with AI-Driven Tax Policies

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-15T22:59:50.862730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:59:50.862730Z digest=sha256:b93e1b491ec79c9fa16f4ef15047b13e067a0bbd3d759771395b29daca94587b

Observation de72b18a-441d-4e2c-bf6b-5805072b165b · outbound

This paper cites guide-then-select.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition guide-then-select

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.616027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.867827Z digest=sha256:70252879f10f73c0016a9e36077dedd811651e7c8f22df330cb2970836f7ee14

Observation 561a1827-18f8-4ce6-a718-760e318fd1d7 · outbound

This paper cites an unresolved cited work.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition Unresolved cited work

Reference 63

Resolution
unresolved
raw_fallback, observed 2026-08-15T22:59:51.559769Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.876652Z digest=sha256:31ba6b7fabf5a56342edd58b0a58dabedff0b27074dcf6a40b560ed5c20148d3

Observation e1c3942d-e424-488b-b4fc-a8ba2f9b7fb8 · outbound

This paper cites The key hyperparameters for OMSD are summarized in Table 3.

Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition The key hyperparameters for OMSD are summarized in Table 3

Reference 512

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T22:59:51.601447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-15T22:59:50.872841Z digest=sha256:046ff91f83d5c2bf1c5efa677c8c3cf45c7faffc1bb47f9930e3d2104785176a

Pith citing papers

No inbound Pith citation observations are available.