Pith. sign in

Paper Citation Record · LEDGER

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus

As of 25 July 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2604.13472.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2604.13472 v1

Coverage vector

measured 72 of 72 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-10T13:41:07.197864Z

measured 73 of 73 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-07-24T06:31:00.690269+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-13T03:08:01.590659Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

72 of 72 outbound references displayed

  • verified exact10
  • verified fuzzy60
  • unresolved0
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation c86d3703-314f-4c84-8535-a76da6f6a3d5 · outbound

This paper cites Multi-agent reinforcement learning for resources allocation optimization: a survey.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-agent reinforcement learning for resources allocation optimization: a survey

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.537503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:3f1be33cfdfe3f4661fe9a617b4e57a16427d58c5629b15473d3b4a0ef3c25eb

Observation 0e29458e-103e-4a84-90bd-c9c8e7e5ec54 · outbound

This paper cites A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.407010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:91a9d98bac7108e5ded1077f6d1402b6026437ad94c4158bef3feccf951f6e85

Observation 28760e5d-6be6-4bd7-8d44-e206ce3b7f2e · outbound

This paper cites Monotonic value function factorisation for deep multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Monotonic value function factorisation for deep multi-agent reinforcement learning

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.516821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:84966f1e997ed081180274e412aca78f280efea5e55b02e497365cefead57309

Observation be0179c1-f285-4bef-9037-cb337be948fb · outbound

This paper cites Mean field multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Mean field multi-agent reinforcement learning

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.509624Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:026116d7a847dd5c51e3767023041638620c8a1ec0606aa117fc453435818bfc

Observation b42d7af8-b761-40dc-8f95-dea9b06c1858 · outbound

This paper cites Counterfactual multi-agent policy gradients.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Counterfactual multi-agent policy gradients

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.544311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:3f3683bafce87b39dee870359de096d63787ef2962271728d58907c84bc0d43f

Observation 928d45ae-17fd-4d39-bc90-5d3f2322828b · outbound

This paper cites A review of cooperative multi-agent deep reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A review of cooperative multi-agent deep reinforcement learning

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.534435Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:493a048831c2155a7722e3941264a00bd8c54f2de68ac74f1cc83b70a83f45cf

Observation 33d89aed-7da8-4adc-b855-ef3476577621 · outbound

This paper cites Exponential topology-enabled scalable communication in multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Exponential topology-enabled scalable communication in multi-agent reinforcement learning

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.523605Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a75ec3b71dd7f981fe31f2ead3292e9fdf5f42c4906bd68bc05f44761d682eb9

Observation 332ecd77-3843-4882-bbec-e1274abd7891 · outbound

This paper cites Multi-agent reinforcement learning is a sequence modeling problem.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-agent reinforcement learning is a sequence modeling problem

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.531442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:93a48d3b8f06d74676707443ed5eb61677d694dc20d585bfab7dc532a79f07fa

Observation 0141b6a6-b283-472f-898a-0ad2868bf64c · outbound

This paper cites Attention is all you need.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Attention is all you need

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.520176Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:e390398addafddcdacab77bcd410c871c53594d65b5447552d7166290175a025

Observation 11d586ff-8390-47d8-b1c9-53a54c17ee5f · outbound

This paper cites Pmat: Optimizing action generation order in multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pmat: Optimizing action generation order in multi-agent reinforcement learning

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.541062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:29c4c08eefdf3cf797e52a05145b3d69b483aca04e116031516df7fcabae4f4d

Observation eef1eff8-dc2e-4ba1-914d-dc86ef46e0a9 · outbound

This paper cites Aoad-mat: Transformer-based multi-agent deep reinforcement learning model considering agents’ order of action decisions.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Aoad-mat: Transformer-based multi-agent deep reinforcement learning model considering agents’ order of action decisions

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.527922Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7b8cd50af0131cfbba8a94b1740de7bc1370be88fd45f3a21ada8afeed5f9da1

Observation 1eee602e-0b89-43dd-983d-186e629abaab · outbound

This paper cites Triple-bert: Do we really need marl for order dispatch on ride-sharing platforms?.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Triple-bert: Do we really need marl for order dispatch on ride-sharing platforms?

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.513189Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:cc86a51da8e559a18ec2912b998e14f932d99c918adb5f17bcffc53997a8a6a5

Observation be482857-2f14-44cf-8710-8a88a5385e3d · outbound

This paper cites Proximal Policy Optimization Algorithms.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Proximal Policy Optimization Algorithms

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-10T13:45:28.411995Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:32d5b3c1858f120dce11eb6d9a871ac4b413baea8bec8f60b9f9c393fc35169d

Observation d63d0374-b71a-46e5-ae4d-eff35ecce698 · outbound

This paper cites The starcraft multi-agent challenge.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The starcraft multi-agent challenge

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.547488Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:58657b317ee04753f49feaf149a716391364bc752df96d392b5ca856afb0a45d

Observation e701f065-98fe-454b-8049-3ee0485ec490 · outbound

This paper cites FACMAC: Factored Multi-Agent Centralised Policy Gradients.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus FACMAC: Factored Multi-Agent Centralised Policy Gradients

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.397064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a9767b05f3d6ebb05cd560f84d4f050a61579d570cd2e978070c5db4774ee807

Observation c19e09f7-8ac9-4808-bf97-9cd05927a19e · outbound

This paper cites Google research football: A novel reinforcement learning environment.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Google research football: A novel reinforcement learning environment

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.695261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:d987a6e015d8128afebb07dcd690cf24d100fe1674ae1c73e3c124b91e344c37

Observation da9800b5-13fb-4d25-bcca-b436bbf654b3 · outbound

This paper cites Markov games as a framework for multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Markov games as a framework for multi-agent reinforcement learning

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.578972Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:975dbed6a5607619b8f85bbf5f43c16362b743503fc5a592f9c97e5ccf7877e3

Observation 2ee705e4-1e9b-4964-9106-0e79ceac8057 · outbound

This paper cites High-Dimensional Continuous Control Using Generalized Advantage Estimation.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus High-Dimensional Continuous Control Using Generalized Advantage Estimation

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-11T04:19:28.133246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7d05867caa561d2a6458e498684f1adadcbdbb3bd97c3aa4328d30bc9238773d

Observation 9842968f-2f81-4ebb-8a39-37e79efb39af · outbound

This paper cites Trust region policy optimisa- tion in multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Trust region policy optimisa- tion in multi-agent reinforcement learning

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.685324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:d789a54bb53f716b6af85a8f9c4bd72195ac1da70542ca39f048b9184da9b473

Observation fa899b0f-7bb8-444b-bff6-6dc483946e0a · outbound

This paper cites Heterogeneous-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Heterogeneous-agent reinforcement learning

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.644712Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:f5cb2397b68c24216dd1e7ab5b5031066138696223e3f5673b19d67a07933edf

Observation be7773f0-da5c-404e-9f38-a4181513f8fe · outbound

This paper cites Maximum entropy heterogeneous-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Maximum entropy heterogeneous-agent reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.599985Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:ca80305db1ad741f89cbf3222742e68986ab352ac601c223ef8f414f0b7898c8

Observation a8fe6afb-a308-440a-a564-253433bc1c30 · outbound

This paper cites Bert: Pre-training of deep bidirectional transformers for language understanding.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Bert: Pre-training of deep bidirectional transformers for language understanding

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.666170Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:165ca28e02f6a663c88c9b930cceb748abc1501de686b0c89ba7ec2c5e70ace5

Observation 94840eb0-4f3f-4446-9961-e1fd39d0e7be · outbound

This paper cites Csi-bert2: A bert-inspired framework for efficient csi prediction and classification in wireless communication and sensing.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Csi-bert2: A bert-inspired framework for efficient csi prediction and classification in wireless communication and sensing

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.589992Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7424efc027af68074c54927d3f0e504041c273afe75393212f4697c6a0da194b

Observation 08a694a6-b1ca-4d7d-b072-7e9317f07b10 · outbound

This paper cites Midibert-piano: Large-scale pre-training for symbolic music classification tasks.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Midibert-piano: Large-scale pre-training for symbolic music classification tasks

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.688807Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7f2cb354c24e580ce20cf3c4b991eb689a04ee08974a33d04d500849b8044dee

Observation 646ca71f-c68b-4747-ae0a-36297ae475cc · outbound

This paper cites an unresolved cited work.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Unresolved cited work

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.648102Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:2f9e07dacb6a001bdf65cb5dcfa2f44ac5300056c66d13eabbce1008511a6b72

Observation d05caa24-4934-43ca-b654-721cdeb66aa4 · outbound

This paper cites The analysis of permutations.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The analysis of permutations

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.612687Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:938cfcf259eca9ab17e05212b22e82a40cf46b4d3d39edc778d65a89c5719ea6

Observation dd3764f4-2c16-4043-8ff5-88d3f3fc93f2 · outbound

This paper cites The surprising effectiveness of ppo in cooperative multi-agent games.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus The surprising effectiveness of ppo in cooperative multi-agent games

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.651483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:de5cdfc5a589a79a2dcdcbfa66f176cc881252552cc100e7ad3f6a5efb24aa70

Observation 3d346dd4-09fc-4bfd-86d8-d5eaad71d134 · outbound

This paper cites A Survey of Progress on Cooperative Multi-agent Reinforcement Learning in Open Environment.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Survey of Progress on Cooperative Multi-agent Reinforcement Learning in Open Environment

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.387501Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:e06c41da7eb1d1d68018a95904579d56926482da9b9ec839552a1663e73cbcc2

Observation e50b7d2a-95ab-4a5a-aa06-b3b8cc82b696 · outbound

This paper cites Hysteretic q-learning: an algorithm for decentralized reinforcement learning in cooperative multi-agent teams.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Hysteretic q-learning: an algorithm for decentralized reinforcement learning in cooperative multi-agent teams

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.623467Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:221bdb5b9634fa746e94672130a549c5430553de2f68bcb75006092c88037319

Observation 5ad092ad-1771-43b9-a1b1-f162b199d3d5 · outbound

This paper cites Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.392636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:fc2b2e67b4ea68c30696775d5ce62dc47ee4b2aa24fa144190b551031442d802

Observation a18b067e-bc4a-4315-b53f-0499d087e12f · outbound

This paper cites Shapley counterfactual credits for multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Shapley counterfactual credits for multi-agent reinforcement learning

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.561719Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:983d49fc0e8c5cc5e063e5d0fbd29a20f0672ebcbf01baff9def928cb24b3607

Observation 22d06c83-0b09-4b73-8cf6-013ca5949fb9 · outbound

This paper cites Value-decomposition networks for cooperative multi- agent learning based on team reward.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Value-decomposition networks for cooperative multi- agent learning based on team reward

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.636959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:90dc93567f2f774d04687939bea6a40ed2a5dd3e724c218df7a6a94eb14b6bd6

Observation d26c974d-fd5d-4207-95ec-1a37fd91c1b5 · outbound

This paper cites Value-decomposition multi-agent actor-critics.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Value-decomposition multi-agent actor-critics

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.563040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:5d3643b9cb4fd42c887f243aac01050646034c3fc9fa941f80b50eeac2316664

Observation 729a46d1-d03f-4a0b-a05f-d5d616e960c8 · outbound

This paper cites Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.633431Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:cfb5d4c87663840fe6639bf99640d882b777a101677a1163bd2d6b026e1b9cce

Observation 16bf7a5d-dd01-43bf-bfc4-e45136db1599 · outbound

This paper cites Hierarchical value decomposition for effective on-demand ride- pooling.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Hierarchical value decomposition for effective on-demand ride- pooling

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.626910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:21159d4b2cd40aa774acb713e042c951a635be61c54aa6991bffebeba493d025

Observation beba685f-d31d-4685-a718-60e5bab21b1d · outbound

This paper cites Efficient distributed reinforcement learning through agreement.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Efficient distributed reinforcement learning through agreement

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.724890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a65b1179d3e93f872111d1eb3676e6952f8088b9a54d18969de56c867f981e94

Observation b1be2f81-0073-4177-b51d-afd963c56c3f · outbound

This paper cites Learning multiagent communication with backpropagation.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Learning multiagent communication with backpropagation

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.608675Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7d6e6e299e8bd294784f73e7cb211d2292fd76bc0fcad7b4309b12d5d810f5c5

Observation 0f606fb5-2dbd-4f7d-abed-feb4c973a09e · outbound

This paper cites Tarmac: Targeted multi-agent communication.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Tarmac: Targeted multi-agent communication

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.630306Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a92ceacecf8788cbce32ec01814c7f9e63fddd54072c336d5318b6ff6afa6454

Observation be93efa4-83fd-48f9-88b5-5ccb9fc74866 · outbound

This paper cites Context-aware communication for multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Context-aware communication for multi-agent reinforcement learning

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.677333Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:46d512c291ee0563f99e4c9ffc9b3d31c7edf271dcb9c66bc3d92fe19e92bcd2

Observation 27379304-1864-4d00-b793-498ea3f295ba · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus An image is worth 16x16 words: Transformers for image recognition at scale

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.687208Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:b8d8f1d2c1d1ddd5fecf4c769cefd9f16332c51feb68c8f2264ee26cf9841b6e

Observation d9bd53cf-bd36-410b-9f6e-06b642c1eb9e · outbound

This paper cites Automatic stage lighting control: Is it a rule- driven process or generative task?.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Automatic stage lighting control: Is it a rule- driven process or generative task?

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.590728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:8de6f26580cfb09c6b847c639a73f4e6c5f971d327290da2184b543b77e91fa2

Observation df3f0b05-357f-4b83-9b39-81d9f711e163 · outbound

This paper cites On transforming reinforcement learning with transformers: The development trajectory.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On transforming reinforcement learning with transformers: The development trajectory

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.597647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:31736fe44ec9e3d261c0adfd2c84806ddf6edb4b23308151d1bb2951533ba8fe

Observation 2afa11ee-1917-40db-a5f5-a0a5c7fcb8a7 · outbound

This paper cites Deep recurrent q-learning for partially observable mdps.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Deep recurrent q-learning for partially observable mdps

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.692107Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:fb3803b6484fc47676eab592eea210bfbfdff263036fb64fc6f51d3546bc79de

Observation 8be16c48-e515-4c8f-8b67-bb10d07acd67 · outbound

This paper cites Stabilizing transformers for reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Stabilizing transformers for reinforcement learning

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.718045Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:fb3eed3cd71922495b3dcb9f8c3bcb5316d6aa811b151974592c2248d0b1630a

Observation c750dc94-1609-45be-b767-15fe6e272af7 · outbound

This paper cites Transdreamer: Reinforcement learning with trans- former world models.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Transdreamer: Reinforcement learning with trans- former world models

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.714793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:37ae4a57ae88c4b503913f6c883b71d3710205b7cfbed9cd1c01f7d5f2cc8705

Observation 817159c6-f344-44e8-b986-b9a8214fddb8 · outbound

This paper cites Dream to control: Learning behaviors by latent imagination.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Dream to control: Learning behaviors by latent imagination

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.721690Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:e6ab9dbdd918a66c16fdd6284b1d14050e55db8868efa0070ae5926b5c7bbec4

Observation c40136a7-d168-4b79-bf4e-c349899e9e19 · outbound

This paper cites Offline reinforcement learning as one big sequence modeling problem.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Offline reinforcement learning as one big sequence modeling problem

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.728055Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:29195f63504d51e3840130702d115071424c2cb4ebdac763cbb3f7d30aef4a2b

Observation 62108fd5-69d9-403f-a7ff-4699ccc016b5 · outbound

This paper cites Decision transformer: Reinforcement learning via sequence modeling.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Decision transformer: Reinforcement learning via sequence modeling

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.709084Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:93f314e4e299181cb28ea7ba06a8137f76d103f8fe88a44d8c613565f924d682

Observation f5402d77-b1bb-42e0-bd25-62e9007aed63 · outbound

This paper cites Online decision transformer.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Online decision transformer

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.711984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:42f8f244a9fbdec1a4fd911a96eb48b918034e0fb61437d704f7d8cc80a3e534

Observation 18016945-e1c2-46bc-8603-c7bbe215d569 · outbound

This paper cites Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.606040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:23629dffe2e023ffee5366fd309fe8ae3d4f18be91bb41d2421c9838c834a70c

Observation b40fd9d2-3de6-4453-bfba-ea597c06826b · outbound

This paper cites A survey on transfer learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A survey on transfer learning

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.730813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:40d67048df6c2fbd666d7a5064deca4ac3adc9480181e0de1f2f561d5a41eeb2

Observation 579aafc0-4071-400b-a301-6f900c5cc799 · outbound

This paper cites Can Wikipedia Help Offline Reinforcement Learning?.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Can Wikipedia Help Offline Reinforcement Learning?

Reference 52

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T13:45:28.415938Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:2a1bd09c7ab003d9f734a6afca0bcfa656065148552862d8e598e656397bb153

Observation 734a6370-115e-4fe4-b9a5-4c65bf30a5fc · outbound

This paper cites Pre-trained language models for interactive decision-making.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pre-trained language models for interactive decision-making

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.705111Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:b9151d8b576bdfff821095bdee8d26ad7283185401b2da41d2eec5ae1d549481

Observation f5a5e6f5-954f-41f2-9926-8721cc7c694f · outbound

This paper cites Masked autoencoding for scalable and generalizable decision making.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Masked autoencoding for scalable and generalizable decision making

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.698147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a06ed897d84c8c671e5230a94f800b1d1a21de2711dc917ae72197eff0b4eac8

Observation 5c49afd1-f0c6-4113-b4d7-96f4697b2436 · outbound

This paper cites Masked trajectory models for prediction, representation, and control.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Masked trajectory models for prediction, representation, and control

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.705968Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:7201b259595d0ef6b61536ee34fe4ef99dcb748c83dee4f24838ec81bb11833b

Observation 15821520-95c4-49e2-90a7-d969ecb7537e · outbound

This paper cites Prompting decision transformer for few-shot policy generalization.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Prompting decision transformer for few-shot policy generalization

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.711687Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:c6cfc8584e504dac2dde4d2b1b29ce2b3f7e1bc80026d0c640302f5fbc90c888

Observation 2dbf92f0-eb57-4503-a147-45993712a694 · outbound

This paper cites Contextual Transformer for Offline Meta Reinforcement Learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Contextual Transformer for Offline Meta Reinforcement Learning

Reference 57

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.372360Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:e1c9f2e7a612491460f253f3a5a3e3afd90aac3a714dff08f23f70efd060e01b

Observation 79d2c5f8-963c-413e-ad03-bfaef7351c57 · outbound

This paper cites Multi-game decision transformers.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Multi-game decision transformers

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.660671Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:633489b6a69a880c6ef09152790f524f74fb735d6fbb9d42ec2f4ec017a463e7

Observation 7bb71cbc-edf3-4dd4-afdf-d901601faff1 · outbound

This paper cites A Generalist Agent.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Generalist Agent

Reference 59

Resolution
verified exact
arxiv_id, observed 2026-05-13T06:24:50.082909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:d8ce702a18dd10744969ac6251b13c5a274aaa5afd45483c9dc5762dd00ff601

Observation 83dd76cf-f458-4b7b-b493-525332e20611 · outbound

This paper cites Learning multi-agent communication from graph modeling perspective.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Learning multi-agent communication from graph modeling perspective

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.702295Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:17120526d0d901b7b5193c6e83c803cc0d0aa538feccd5dfaaa7de9bff5b3ca1

Observation c7aa0cb7-1070-4bc8-98f5-d8a748651aae · outbound

This paper cites MaskMA: Towards zero-shot multi-agent decision making with mask-based collaborative learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus MaskMA: Towards zero-shot multi-agent decision making with mask-based collaborative learning

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.676832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:a8d2817604fbb6560e84ac2e60954440a8b027fd673177c63acc1be8ffe1d709

Observation 4782a748-6f92-4605-9e06-2b40e716459c · outbound

This paper cites UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with Transformers.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with Transformers

Reference 62

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.382602Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:96b503ef1bfa8cdb4fc67de4423fbedd0095086993f0dfd536b26c98e4feeb80

Observation ab776399-381f-438d-af41-eb2beb21f0a1 · outbound

This paper cites Pytorch: An imperative style, high-performance deep learning library.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Pytorch: An imperative style, high-performance deep learning library

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.683645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:4e72681cc622bc2be2901c260b096a0175639d6c268915315220b08cab0227ed

Observation 1cdd7d3b-d2ad-49cd-85b9-9a7041305b4f · outbound

This paper cites On the theory of policy gradient methods: Optimality, approximation, and distribution shift.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On the theory of policy gradient methods: Optimality, approximation, and distribution shift

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.568127Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:ba193a892257d1ba1f85456345845b4538a3d59a795a406ea63f21707f4e383c

Observation 0f70c6c2-a14a-45eb-bc9e-71e96ff4ba98 · outbound

This paper cites On the global convergence rates of softmax policy gradient methods.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus On the global convergence rates of softmax policy gradient methods

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.681153Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:efa04ee6500984856536834b796aede0b1641ed295932a881997c25f51666ab7

Observation e56bebda-7c35-4a64-a84d-649ae890af7e · outbound

This paper cites Convergence rates of bayesian network policy gradient for cooperative multi-agent reinforcement learning.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Convergence rates of bayesian network policy gradient for cooperative multi-agent reinforcement learning

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.669489Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:ac2a190bf074d0c0b4413a7694c0821af8ed3e99613f48d808ac6bc8fb184945

Observation 7e994c4d-816c-4cfe-a444-66fc37b74be7 · outbound

This paper cites A reinforcement learning algorithm for obtaining the nash equilib- rium of multi-player matrix games.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A reinforcement learning algorithm for obtaining the nash equilib- rium of multi-player matrix games

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.658514Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:8c740e3a32099c531e82d06efe62be6d22ee324680e69940ede13b292d09e0ac

Observation 514581d4-48a9-45ec-b0be-23df7cdc46ca · outbound

This paper cites an unresolved cited work.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Unresolved cited work

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.655014Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:0c0f5e202a5e7721ac0fd88d8e8fcfd408f0c344ae8805c5f6ffa4f796c7a7d2

Observation 52f45822-c3b3-4de3-9765-9fdcb1cce40d · outbound

This paper cites A Generalized Alternating Method for Bilevel Learning under the Polyak-{\L}ojasiewicz Condition.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus A Generalized Alternating Method for Bilevel Learning under the Polyak-{\L}ojasiewicz Condition

Reference 69

Resolution
verified exact
arxiv_id, observed 2026-05-10T13:45:28.367237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:0c71cbdff97cddef250e91bd5b488c78aca29b897bed36604853565b85d13441

Observation 34fb28e1-9ab5-4b80-91d9-b1530fb3339a · outbound

This paper cites Convergence proof for actor-critic methods applied to ppo and rudder.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Convergence proof for actor-critic methods applied to ppo and rudder

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.661903Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:57f2cc3b1e6472897e6d12eeb4f240f48bb4ddfca3d402077ce2d2e649b616c3

Observation b13fbfc7-7e15-4599-9fef-f62c94e68425 · outbound

This paper cites Ppo-clip attains global optimality: To- wards deeper understandings of clipping.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Ppo-clip attains global optimality: To- wards deeper understandings of clipping

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-05-18T22:32:53.672940Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:445c71c2c823c0f859e6d24b62de3c3d4400936c04ada1353288b56ddb2056b3

Observation dffa6ee0-9dac-4779-9033-a77816ef9619 · outbound

This paper cites Implicit learning dynamics in stackelberg games: Equilibria characterization, convergence analysis, and empirical study.

Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus Implicit learning dynamics in stackelberg games: Equilibria characterization, convergence analysis, and empirical study

Reference 72

Resolution
malformed identifier
raw_fallback, observed 2026-05-18T22:32:53.708770Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.

source=pdf_text observed=2026-05-10T13:41:07.197864Z digest=sha256:dd28e97dae5406cf2ba70702596892bcf8b068869fab806144e8bd36a1ab4771

Pith citing papers

Observation 88069d6a-9a26-46e2-9735-4ffaba853dc0 · inbound

Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning cites this paper.

Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-13T03:08:01.590659Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T03:08:01.590659Z digest=sha256:298e2837cc4a27ecfb1da6b212640da2bfd0dc1f58f6d97062a343487cbf7859