Pith. sign in

Paper Citation Record · LEDGER

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning

As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18537 v1

Coverage vector

measured 52 of 52 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:32.169248Z

measured 52 of 52 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

52 of 52 outbound references displayed

  • verified exact2
  • verified fuzzy13
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76 · outbound

This paper cites Foerster, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Foerster, G

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.311324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.311324Z digest=sha256:8a924c4f96de01ced45c20fdda22fb3d1caa00d5340dc29b90a8da9880242fda

Observation 670b9cf7-041f-435a-b87d-4fd94af0e41f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.550524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.366523Z digest=sha256:cc9e81c229f1ced48b66247c4acb4653df05ec444a6956662d0b71be4178fe27

Observation 892c0908-7457-4ed2-b477-2495d8df3d51 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.421622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.450660Z digest=sha256:052d1b614d1a4a5e1c41916c1d5933f7aa728aa040f4671e9a3af4f5dc0d80f0

Observation 7086a3b2-c44a-4683-8ea7-b2911993b7b4 · outbound

This paper cites Rashid, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Rashid, M

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:38.230715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.521090Z digest=sha256:e76ffee799be50b84ecadf7aae2fa9aae412232c12f9bdf922b64c2842b76ff6

Observation 7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.098300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.562989Z digest=sha256:6e212a9efdf25fe3d5d9023140041137d2d5914a4ee4f893c21a9a62665ca422

Observation 51b1d0c6-6538-43a4-8d92-cdacd102bf9b · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.949118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.624855Z digest=sha256:472e40da7509d3aec83700405475e6f2d7c37525d32d6d7cab473fe1da96e303

Observation bcc92c2c-ac51-40c4-8e86-91aebc4546b2 · outbound

This paper cites Sunehag, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Sunehag, G

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.772354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.696489Z digest=sha256:71f973d405b5c30748517d07460c46a19826472d0ab23db1eab53439be3831d0

Observation f03313aa-1f87-42ec-b468-756ec9790148 · outbound

This paper cites Hernandez-Leal, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Hernandez-Leal, B

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.555190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.769153Z digest=sha256:6fc9a34a592ae8abc83156bddfc1dced01ab2c4dca3af00fba24a0d379317099

Observation 62c69c87-b74b-41cc-a208-ef9d7c55579c · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.803514Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.803514Z digest=sha256:91482baacf073e3fa80437fc9624c7ba7d08cfe3546ce213e95cb3931ffcb10c

Observation 7702dffd-a447-4a1c-94a4-2ee8706b91c6 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.354835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.817421Z digest=sha256:c4e06445294ef3e6a59251901143d49f4add6ca3ccb1ac3a6d264271b55c0146

Observation 4ddf7ce3-a302-4ad3-8304-5d4aeb044141 · outbound

This paper cites Egorov, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Egorov, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.196178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:28.890898Z digest=sha256:1aa4e90c490248f6995744886f2a572ac270326661bb0587a24c4611eff3e020

Observation 78fe9301-a32b-410b-85db-9b54424ff29b · outbound

This paper cites Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.702325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.004887Z digest=sha256:ec2e93c987b962312b9dc8dd35da0cd26caa4cfbf5358bfac2380e03caefc8df

Observation ec09dc8c-c50d-436b-a0a7-b1398fb45a70 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.937261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.078472Z digest=sha256:a3919c5ea21366a0e8f4d21bafaa210174670b2336a6a7548e98c3582d43624e

Observation f34b69ad-927f-4bdb-8911-999c70ec660c · outbound

This paper cites Zhang, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Zhang, G

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.767503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.184049Z digest=sha256:3501054279e38fa0686110b4914c962f13e86263a8a557d29ee75227e507e98c

Observation aa327fd1-8690-4a44-9268-1fe9e3f21bfb · outbound

This paper cites Mastering Atari with Discrete World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Atari with Discrete World Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.283214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.283214Z digest=sha256:38539087135cebddaaa2ea755d49965e8cb53f3f06e7a6b38566e23a328ddc41

Observation 8405a811-c03a-4b27-9035-0d95d19af726 · outbound

This paper cites Mastering Diverse Domains through World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Diverse Domains through World Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.344519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.344519Z digest=sha256:defb2bef26dfef063f80f30508821218b42d7c225c51c2d31d52d9c70bd9e338

Observation 8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801 · outbound

This paper cites Robine, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Robine, M

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.506890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.406224Z digest=sha256:e5778c11841ab23e6e415d9321dc58d1f60a4b169dcb34ee97503d8d5ef47392

Observation 47055219-0b33-4145-acdf-f327c2c81e86 · outbound

This paper cites Vaswani, N.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Vaswani, N

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.285500Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.536183Z digest=sha256:2c2957bf326458757a29eebdc678553eb3506c0c90e5cceb76638d765bf8d0dc

Observation 753ab512-5a5a-4986-8682-de0db114877a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.000493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.685619Z digest=sha256:d4507e5ce62e35f624cfbc4e9a1c5f3c6e24f732f4e633168d21c75eecd33072

Observation 45d3a010-12e4-4047-8c27-7c6228b5ec26 · outbound

This paper cites A Survey of World Models for Autonomous Driving.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning A Survey of World Models for Autonomous Driving

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.802749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.802749Z digest=sha256:9c6638737579c87b47ab4bd27e963e0d8a1c70780658f98f062978f994093cb5

Observation 5d65e8b3-7495-439c-876c-ee9891189759 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.604750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:29.923185Z digest=sha256:cf4406c3bd5f3297afac6bc095a80f81e75ad10908c60d8cb1b00e91f9c18a1e

Observation 7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.439578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.015588Z digest=sha256:43e9ec669c7389036e21f8c9420c1568493409d45d1a2cb05afb2e3571cd2d48

Observation e0305426-09ee-41c8-ba35-497340364e5d · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.267342Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.117925Z digest=sha256:29faa680498303e0d58d587889e3a2c9f092dfe8cc06f7f7474c2d0b08ba97f2

Observation d56e01c4-570c-437f-a3be-409fa6f8e06f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.065567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.187134Z digest=sha256:892c762f47b4a4f0bd327101fe57ef828f124d9556b2ba0f574dbb396397b2d9

Observation 63d6670e-ecd6-4555-97bf-536d9f267df8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.884792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.226022Z digest=sha256:f8cc3e10a0983bc560823f99b6b409f494c01e83bd4377cc9f4a9a91d7b80424

Observation 69867348-7969-4bbc-95f1-24cb4116f468 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.305724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.305724Z digest=sha256:bd328aec31c65823306f3a9a28f0a7f5e595d8b09531a413478e95681a872702

Observation 9e14a86e-bb17-4ae6-9f95-b0650677a5e3 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.687038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.326286Z digest=sha256:c8d535de24e377c870d521c51dfa8b89267c5772c607c48e9fef0763ebfaaca4

Observation 29ef450f-0f10-48ee-967a-420008cda3ec · outbound

This paper cites Kaiser, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Kaiser, M

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.431278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.387216Z digest=sha256:e8736f0298aff7be83e3bf8ccf878e80167bb18db23f49d02da92085a2c4c736

Observation a85dcc65-b8d3-42e7-9cb1-57d9d49a8948 · outbound

This paper cites Dream to Control: Learning Behaviors by Latent Imagination.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Dream to Control: Learning Behaviors by Latent Imagination

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.455023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.455023Z digest=sha256:1a56570518ee52bf1a2100e71a0e0116475ccaed1f88ef056b86255a267f53ff

Observation d6887050-c496-42b9-b1cb-97dab50519cc · outbound

This paper cites Micheli, E.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Micheli, E

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.293068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.660794Z digest=sha256:2a47144ff1f223bab223a251eb5863b630ef3fbd21038e2ca12c55f456a8d259

Observation 83cba1cd-5af4-40a8-a889-c6fa7942aa32 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.083836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.717149Z digest=sha256:c060981330f583e44e64efe6bb735927e0a17bc6def0c0c1564056391ff8e0dd

Observation cdcf0096-8500-4471-be57-a2a7f69f86ba · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.812755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.812755Z digest=sha256:549c4ff4cd50766ec6df5506b8781adb6e16f09013142e85967db4c5b4607f03

Observation 3c067b8d-2b56-494a-847b-ebb110e9221a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.925377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:30.944783Z digest=sha256:a9860b955d4baaa5f84d7a6188997222dde42c00a950c479a21a3311d97d4100

Observation b5843f77-6448-457d-bbb3-e64d2aaf2308 · outbound

This paper cites Schrittwieser, I.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Schrittwieser, I

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.028162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.028162Z digest=sha256:9e487dc11993686f83a7b2a8660398a22bd921c9fb42193688e655d231326c3c

Observation 9d48df79-19b7-48b7-ad84-6515c0db7b00 · outbound

This paper cites Jaegle, F.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Jaegle, F

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.804133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.081223Z digest=sha256:024c172e746b9045a73523c6ca6f84ceaa297a62b92c446d6fca9b9734286fa8

Observation 00f35743-d668-45c1-b0f3-afe9be41a040 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.164693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.164693Z digest=sha256:77f66728280ffc7fceb48587c8d50b48a7161e6d3bfd926cfd526360dd651b14

Observation f6c7e6c7-a0e5-42fc-8024-a970b62bd7da · outbound

This paper cites Policy Consolidation for Continual Reinforcement Learning.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Policy Consolidation for Continual Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.219011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.219011Z digest=sha256:11cc08e22a8a25704c54b888a70f443a4d14377148eb5edb90099d89251825ed

Observation 82f832ce-301b-4726-a849-9592a7234465 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.640682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.255948Z digest=sha256:c4855812c0892aca5b191de421cfee6445411837a6dcc94b1fdb40b779e780e3

Observation a37fddcc-757e-4d52-a820-677a86314d8d · outbound

This paper cites Auto-Encoding Variational Bayes.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Auto-Encoding Variational Bayes

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.310103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.310103Z digest=sha256:3fe470ef3053f2c8fefe682c7bdfc02e492056d135ac786a38471610593bf523

Observation 5be1d56b-27d8-41ef-a37e-6c2a4112c066 · outbound

This paper cites van den Oord, O.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning van den Oord, O

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.526786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.367005Z digest=sha256:05ecc0b475ba990454d56af78286b468c16f3d89a1526180f3f726951b07329b

Observation 97aea435-9078-4de1-8748-a7caad63346d · outbound

This paper cites DeepMind Lab.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning DeepMind Lab

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.423861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.423861Z digest=sha256:94cf27c90de34a53b20d25b4146b13dcc943420c5f10e582f357baf658367db9

Observation 09bed2c9-ca32-47ab-ae08-7ff29f7001c8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.416713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.486552Z digest=sha256:52549e8670e7e1137cc43869b88392c92addb30a4f63674f448963f922eb4924

Observation 09d6e2b7-d554-411d-9174-89e35ab71755 · outbound

This paper cites Categorical Reparameterization with Gumbel-Softmax.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Categorical Reparameterization with Gumbel-Softmax

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.535334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.535334Z digest=sha256:dae6add9f5770ff0560f74290abfea22d33f349a355edba3faab84c0250f3926

Observation 592c5658-206b-4f0f-9b53-e57bd0aa7a3d · outbound

This paper cites LeCun, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning LeCun, B

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.619481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.619481Z digest=sha256:9e93e38a206750eda09be6608fd1e9bd00d8177e2e2c7989039b06cfcba25b6d

Observation 7430370c-5a14-4f31-84b9-d241af7e2256 · outbound

This paper cites Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.697779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.697779Z digest=sha256:da3845b1d7f578df181856f1e4a175c5e26228585451cf53dd98fcbf1f7dbabd

Observation 20a7be27-0e4f-4fa7-a9ba-3e49864a3458 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.283106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.790288Z digest=sha256:c59f16dc4fecd9db091e64c35b5c86818706ced197d70c9e585d39f483182ca7

Observation d37b0c5b-51df-4556-9e2d-bf6fb873780c · outbound

This paper cites Samvelyan, T.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Samvelyan, T

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.129379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.851998Z digest=sha256:bb6ca9ce6cb89bfa39762653652f7863c23286a5d4610a0ed2ad368bdc74464f

Observation 642f466d-0bc1-470e-aa98-edaad5891daa · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.007884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:31.969512Z digest=sha256:c3aa701251f7ca9eab8cbcc8fdc3e7c779ab8bcf773623eb40c934ea740878c0

Observation ccb30152-bd25-4b84-b799-820587482dd7 · outbound

This paper cites Melting Pot 2.0.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Melting Pot 2.0

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.017785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.017785Z digest=sha256:7f9c780ab43bdd612d2853c5498da0427c1d488be02dd65ed4d5aed391c8b6b7

Observation 75e6f2ae-b847-4c12-9093-6f0199de36f7 · outbound

This paper cites Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.068608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.068608Z digest=sha256:973884b941305f2c08ff3c84ff6cfcc77e091fffc150e7b10fe9cc624cb3bfdc

Observation 6b60707d-1f0a-403e-8d8c-30a975cfb7ad · outbound

This paper cites An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.326732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:32.100038Z digest=sha256:6f41a73b9843c6496c3e719bf0e289e6b875b313eea5f55b93cf9c0dfe6a1c61

Observation 3fd8aaa9-eb35-4385-bc22-6b4d0790554c · outbound

This paper cites Formanek, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Formanek, A

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:32.887100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T23:20:32.169248Z digest=sha256:7a138a6e2d3148b8342b850c01ab5dd8a02c5548010cdd295c68ea84c5ffbd0e

Pith citing papers

No inbound Pith citation observations are available.