Pith. sign in

Paper Citation Record · LEDGER

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning

As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18537 v1

Coverage vector

measured 52 of 52 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:32.169248Z

measured 52 of 52 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

52 of 52 outbound references displayed

  • verified exact2
  • verified fuzzy13
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76 · outbound

This paper cites Foerster, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Foerster, G

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.311324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.311324Z digest=sha256:8a924c4f96de01ced45c20fdda22fb3d1caa00d5340dc29b90a8da9880242fda

Observation 670b9cf7-041f-435a-b87d-4fd94af0e41f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.550524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.366523Z digest=sha256:3ee60a5811491fa7077654da8a0bdeb5a9e4dfd7cce021d2d34eb5ea8d15ae94

Observation 892c0908-7457-4ed2-b477-2495d8df3d51 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.421622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.450660Z digest=sha256:1adb688a8c3d82275872311aa2ad2013ab1afb45486ecbcb079c339b209ee370

Observation 7086a3b2-c44a-4683-8ea7-b2911993b7b4 · outbound

This paper cites Rashid, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Rashid, M

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:38.230715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.521090Z digest=sha256:cc59582469f3a02849822125d706b2cf2793abc1065892a7d7b5355d5dc321fc

Observation 7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:38.098300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.562989Z digest=sha256:827c53c134483f051a3cc5c3592db5bb62a369e8599ab5fc74ad39a9fe3c5925

Observation 51b1d0c6-6538-43a4-8d92-cdacd102bf9b · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.949118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.624855Z digest=sha256:9b9175f0c152d060afaafff61aa680f8f676cfffa6e349123715aabb5ef88e9b

Observation bcc92c2c-ac51-40c4-8e86-91aebc4546b2 · outbound

This paper cites Sunehag, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Sunehag, G

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.772354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.696489Z digest=sha256:f63e957f649f0271cf111c51d546795602dd2032bebabe6a915ffd9e3f9acaca

Observation f03313aa-1f87-42ec-b468-756ec9790148 · outbound

This paper cites Hernandez-Leal, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Hernandez-Leal, B

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.555190Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.769153Z digest=sha256:9f52ad06f6723f7d41a3e6899d390524bb7e3c6ff3a13d73f733fff1a150d95b

Observation 62c69c87-b74b-41cc-a208-ef9d7c55579c · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:28.803514Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:28.803514Z digest=sha256:91482baacf073e3fa80437fc9624c7ba7d08cfe3546ce213e95cb3931ffcb10c

Observation 7702dffd-a447-4a1c-94a4-2ee8706b91c6 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:37.354835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.817421Z digest=sha256:6ea4d087eba439c9a440b390d58c0d9c11d4c3b48ce015c98ef269ebf9650c79

Observation 4ddf7ce3-a302-4ad3-8304-5d4aeb044141 · outbound

This paper cites Egorov, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Egorov, A

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:37.196178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:28.890898Z digest=sha256:24e9dc2f90584c0cb66f17482b6d573846245ad18ba82443ee01538cccaabe1e

Observation 78fe9301-a32b-410b-85db-9b54424ff29b · outbound

This paper cites Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.702325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.004887Z digest=sha256:106be479010a2122c85dd887be5b4be07320c76041919a19f03c5e005e6a3d77

Observation ec09dc8c-c50d-436b-a0a7-b1398fb45a70 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.937261Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.078472Z digest=sha256:0a800249f250a854bbcf98094cabce1ca2802ac400df04d8ab10055191837073

Observation f34b69ad-927f-4bdb-8911-999c70ec660c · outbound

This paper cites Zhang, G.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Zhang, G

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.767503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.184049Z digest=sha256:136ecc83327c3bdd59171e9667a8c6761114b0fbabcc844f53e1d64629cf5607

Observation aa327fd1-8690-4a44-9268-1fe9e3f21bfb · outbound

This paper cites Mastering Atari with Discrete World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Atari with Discrete World Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.283214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.283214Z digest=sha256:38539087135cebddaaa2ea755d49965e8cb53f3f06e7a6b38566e23a328ddc41

Observation 8405a811-c03a-4b27-9035-0d95d19af726 · outbound

This paper cites Mastering Diverse Domains through World Models.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Mastering Diverse Domains through World Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.344519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.344519Z digest=sha256:defb2bef26dfef063f80f30508821218b42d7c225c51c2d31d52d9c70bd9e338

Observation 8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801 · outbound

This paper cites Robine, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Robine, M

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.506890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.406224Z digest=sha256:cd61593b2b8fa13720a97c7e098671202b7b1a0511216e3ad396411641c8c8cc

Observation 47055219-0b33-4145-acdf-f327c2c81e86 · outbound

This paper cites Vaswani, N.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Vaswani, N

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:36.285500Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.536183Z digest=sha256:a384ee02b7a113ad865382c51dcc87be87c2f3f426bf0bb2bf94793de8538824

Observation 753ab512-5a5a-4986-8682-de0db114877a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:36.000493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.685619Z digest=sha256:4f7a50aa141f3aded6828779b78f2cdd0dc17c23dad128d01117c4e2cb49bd23

Observation 45d3a010-12e4-4047-8c27-7c6228b5ec26 · outbound

This paper cites A Survey of World Models for Autonomous Driving.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning A Survey of World Models for Autonomous Driving

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:29.802749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:29.802749Z digest=sha256:9c6638737579c87b47ab4bd27e963e0d8a1c70780658f98f062978f994093cb5

Observation 5d65e8b3-7495-439c-876c-ee9891189759 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.604750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:29.923185Z digest=sha256:e3e1cf4faa30e377163a5616de1bb89de5f9c869fac333e43fcb70bdd4af755d

Observation 7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.439578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.015588Z digest=sha256:f43c9fd10e2458d8c93054f96b6a3bfb6b6a865b2f38d87db7e12f5d3c7e23f0

Observation e0305426-09ee-41c8-ba35-497340364e5d · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.267342Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.117925Z digest=sha256:319c563e942d45c2c1c1850c1a8f363d80d9547b7b31680bcb5cf3482168e8d4

Observation d56e01c4-570c-437f-a3be-409fa6f8e06f · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:35.065567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.187134Z digest=sha256:f6debcf6d7ba0af93a3bb8eb006e9e3fe813c4362cf20b813c622db4893fa26a

Observation 63d6670e-ecd6-4555-97bf-536d9f267df8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.884792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.226022Z digest=sha256:1d59617730c849d33a228bc514e43b50c384b9c3869d907571234e3db5b99c60

Observation 69867348-7969-4bbc-95f1-24cb4116f468 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.305724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.305724Z digest=sha256:bd328aec31c65823306f3a9a28f0a7f5e595d8b09531a413478e95681a872702

Observation 9e14a86e-bb17-4ae6-9f95-b0650677a5e3 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.687038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.326286Z digest=sha256:1210ec1393e317e3cf53a179aa099cf9e0d57b0c89e413da1ce1c9a8e6edd239

Observation 29ef450f-0f10-48ee-967a-420008cda3ec · outbound

This paper cites Kaiser, M.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Kaiser, M

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.431278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.387216Z digest=sha256:033a9fd99f90112ded174e5e62a4c6cc66235337436db99c6c8c0b4c326d7170

Observation a85dcc65-b8d3-42e7-9cb1-57d9d49a8948 · outbound

This paper cites Dream to Control: Learning Behaviors by Latent Imagination.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Dream to Control: Learning Behaviors by Latent Imagination

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.455023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.455023Z digest=sha256:1a56570518ee52bf1a2100e71a0e0116475ccaed1f88ef056b86255a267f53ff

Observation d6887050-c496-42b9-b1cb-97dab50519cc · outbound

This paper cites Micheli, E.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Micheli, E

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:34.293068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.660794Z digest=sha256:de781ec82339962fa83dc1f30a38faa8ca191b37e5964d3befea3b77b445711c

Observation 83cba1cd-5af4-40a8-a889-c6fa7942aa32 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:34.083836Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.717149Z digest=sha256:f147fe0fe4b1acd8da3d7d2dc098a9bb67c075f36bce5302cd8f82011bde8e4a

Observation cdcf0096-8500-4471-be57-a2a7f69f86ba · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:30.812755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:30.812755Z digest=sha256:549c4ff4cd50766ec6df5506b8781adb6e16f09013142e85967db4c5b4607f03

Observation 3c067b8d-2b56-494a-847b-ebb110e9221a · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.925377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:30.944783Z digest=sha256:3f972d60a8dfc4ccc78ac0e94ac5485510d5e40bbaaf2ddf5e1ea9a72837af03

Observation b5843f77-6448-457d-bbb3-e64d2aaf2308 · outbound

This paper cites Schrittwieser, I.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Schrittwieser, I

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.028162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.028162Z digest=sha256:9e487dc11993686f83a7b2a8660398a22bd921c9fb42193688e655d231326c3c

Observation 9d48df79-19b7-48b7-ad84-6515c0db7b00 · outbound

This paper cites Jaegle, F.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Jaegle, F

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.804133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.081223Z digest=sha256:72c4352ebfcb6c9e25fc7b18a7e98d1d21542e591ad44c51a797464b7ab29a16

Observation 00f35743-d668-45c1-b0f3-afe9be41a040 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.164693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.164693Z digest=sha256:77f66728280ffc7fceb48587c8d50b48a7161e6d3bfd926cfd526360dd651b14

Observation f6c7e6c7-a0e5-42fc-8024-a970b62bd7da · outbound

This paper cites Policy Consolidation for Continual Reinforcement Learning.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Policy Consolidation for Continual Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.219011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.219011Z digest=sha256:11cc08e22a8a25704c54b888a70f443a4d14377148eb5edb90099d89251825ed

Observation 82f832ce-301b-4726-a849-9592a7234465 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.640682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.255948Z digest=sha256:9cffbd773ecc4a376a18d41c33143c327fcf3026eab5b73462e72a748f1a62de

Observation a37fddcc-757e-4d52-a820-677a86314d8d · outbound

This paper cites Auto-Encoding Variational Bayes.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Auto-Encoding Variational Bayes

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.310103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.310103Z digest=sha256:3fe470ef3053f2c8fefe682c7bdfc02e492056d135ac786a38471610593bf523

Observation 5be1d56b-27d8-41ef-a37e-6c2a4112c066 · outbound

This paper cites van den Oord, O.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning van den Oord, O

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.526786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.367005Z digest=sha256:4df8ad99e7ac56e83e031b6b391b4ffbb21bf8761dea79131da45134d2ddea47

Observation 97aea435-9078-4de1-8748-a7caad63346d · outbound

This paper cites DeepMind Lab.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning DeepMind Lab

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.423861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.423861Z digest=sha256:94cf27c90de34a53b20d25b4146b13dcc943420c5f10e582f357baf658367db9

Observation 09bed2c9-ca32-47ab-ae08-7ff29f7001c8 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.416713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.486552Z digest=sha256:22630a8bfc147b7e8b5172f1aff69313a3c5aa8b5f00fa83adc96a7276695e0c

Observation 09d6e2b7-d554-411d-9174-89e35ab71755 · outbound

This paper cites Categorical Reparameterization with Gumbel-Softmax.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Categorical Reparameterization with Gumbel-Softmax

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.535334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.535334Z digest=sha256:dae6add9f5770ff0560f74290abfea22d33f349a355edba3faab84c0250f3926

Observation 592c5658-206b-4f0f-9b53-e57bd0aa7a3d · outbound

This paper cites LeCun, B.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning LeCun, B

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.619481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.619481Z digest=sha256:9e93e38a206750eda09be6608fd1e9bd00d8177e2e2c7989039b06cfcba25b6d

Observation 7430370c-5a14-4f31-84b9-d241af7e2256 · outbound

This paper cites Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:31.697779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:31.697779Z digest=sha256:da3845b1d7f578df181856f1e4a175c5e26228585451cf53dd98fcbf1f7dbabd

Observation 20a7be27-0e4f-4fa7-a9ba-3e49864a3458 · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.283106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.790288Z digest=sha256:ec51f6133abda296359851815fe55d077d62071e191c5b76ae6c12efa1638b38

Observation d37b0c5b-51df-4556-9e2d-bf6fb873780c · outbound

This paper cites Samvelyan, T.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Samvelyan, T

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:33.129379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.851998Z digest=sha256:eb25a11fdadc6d281bdf525765a3f3cb9c223647e8ae4dd14383b2b2667ce3f4

Observation 642f466d-0bc1-470e-aa98-edaad5891daa · outbound

This paper cites an unresolved cited work.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-06T23:20:33.007884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:31.969512Z digest=sha256:0cd332d34e2c1b0a8c3084dd89add825da9f371fb2384b069d5db8c1462fe9dc

Observation ccb30152-bd25-4b84-b799-820587482dd7 · outbound

This paper cites Melting Pot 2.0.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Melting Pot 2.0

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.017785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.017785Z digest=sha256:7f9c780ab43bdd612d2853c5498da0427c1d488be02dd65ed4d5aed391c8b6b7

Observation 75e6f2ae-b847-4c12-9093-6f0199de36f7 · outbound

This paper cites Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:32.068608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:32.068608Z digest=sha256:973884b941305f2c08ff3c84ff6cfcc77e091fffc150e7b10fe9cc624cb3bfdc

Observation 6b60707d-1f0a-403e-8d8c-30a975cfb7ad · outbound

This paper cites An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-06T23:20:32.326732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:32.100038Z digest=sha256:3660b59d675c5b1c3b8421f113cf595a0ed5aefc11527ce212eddb85d8bc4ce6

Observation 3fd8aaa9-eb35-4385-bc22-6b4d0790554c · outbound

This paper cites Formanek, A.

Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning Formanek, A

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:32.887100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-08-06T23:20:32.169248Z digest=sha256:3f5cfb0520f769a0845bcccdb2c5359ce0d4047821c97ffc9cc1a951cc80b6d1

Pith citing papers

No inbound Pith citation observations are available.