Pith. sign in

Paper Citation Record · LEDGER

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning

As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2505.19637.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.19637 v1

Coverage vector

measured 33 of 33 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:15:38.154456Z

measured 33 of 33 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

33 of 33 outbound references displayed

  • verified exact0
  • verified fuzzy3
  • unresolved30
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ad21ae39-8999-4ef2-94e7-f9c17e8a69e1 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:44.522075Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.223458Z digest=sha256:86d8160d38e7525979367354a244786d3b2a3e061a8fffe05e6a0b641160ac57

Observation e8981b93-8a6b-46ac-9551-ba24883404db · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:43.979608Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.390294Z digest=sha256:13efd799b199a4400fd2ebe4445d103fa10b8070b03fe0269ad436fe3ecc7d85

Observation d79a646d-a141-40f2-aac2-bd2ebf198d5d · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:43.575134Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.577073Z digest=sha256:a6ec28036ab0baac261596ef1b6ae0b8edb5c9fec666a456332aa235f75c0b05

Observation 76b54ddb-d11a-416a-9969-0aa0cbc0063a · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:43.379088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.689988Z digest=sha256:873489b1d01aaf16b1e1e00a7a5ca56ee012b3d474a685796b137fd89c670f79

Observation 920462f9-38b6-4e5d-ac7a-2511318944c4 · outbound

This paper cites Guided Deep Reinforcement Learning for Swarm Systems.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Guided Deep Reinforcement Learning for Swarm Systems

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:35.804796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:35.804796Z digest=sha256:e77fe4c19298e268f6a368d2daf2a7921b5100517eaa9460fc11d8740f605308

Observation 5275ae44-41d5-4eba-bfec-257a98839941 · outbound

This paper cites Risk Sensitive Dead-end Identification in Safety-Critical Offline Reinforcement Learning.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Risk Sensitive Dead-end Identification in Safety-Critical Offline Reinforcement Learning

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:35.927209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:35.927209Z digest=sha256:cce8df8fb5b8384316f753d1dc551bc153c1f7f32f62216fdff03b8fb85e4299

Observation cbdd3ceb-3fa7-4316-809b-d30f25aaf303 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:43.151744Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.067854Z digest=sha256:19faadf5b5ae3719f19a7ec3670ae6afed87ac41e286ce026cf515d057cdab88

Observation 1c94055f-29f9-4135-8ff2-871740d9e4de · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.970375Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.168756Z digest=sha256:9331356546864f839f368012e3fcb4c36d76352cc7235f57e4977ae462efd0a3

Observation 215d52a9-f784-4da4-b41c-4d3e3d30b8c7 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.781691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.233451Z digest=sha256:9853cd46c3e7a49a9571f1e76416aae27425552fd6980e509dba90c1bf15f55e

Observation bdb2bbca-923e-469a-833a-af5086f762ec · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.671354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.312690Z digest=sha256:6fcdd54ef9d2024c6dbb6749615d12b04848ae31ed92291a84b5565f806fb517

Observation 83f9843e-880c-40bb-9273-4fe24bec63f1 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.459870Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.365183Z digest=sha256:8d0d6839f333229ed706e4d7055a371415ca4be542573fb840bff12528d0f13a

Observation c99c871f-31ea-4a6b-9a81-65c477de1f1e · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.284446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.401037Z digest=sha256:0af7f27c05a9095d0109f44154aff6e5c0fdf6cb8a8b6b22a0e236ee8a17dc49

Observation 7d756808-7d2d-488f-ab31-78e2bcc30a22 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:42.122511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.480104Z digest=sha256:20db9b7762d00ca468d93317a5b53baadf84f2386049f83ee1ef70f8e04a49f8

Observation d23433b9-550d-4dbc-a259-56e6ddc0f409 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:41.959506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.543453Z digest=sha256:f67fd46f60659147820408dbb120d22063004a374d9dc82d5900f7e827223d15

Observation 3ad9db5d-fcd1-43ff-8955-3b7e2fd05a1f · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:41.776163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.606188Z digest=sha256:e65c214451f800a95de7c97dfeb4ea35247168069db21a01fb1e7cb56595b90f

Observation 1c4b17c6-4f97-4efa-9c92-77fd32f5cd1d · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:41.586776Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.667159Z digest=sha256:d6178041b0bb978412981b9ba17fafc5530cc128b2510ea4a2e9f9fb28d09e82

Observation bd717aef-f044-4849-bbfc-b86806811bf1 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:41.373253Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.733149Z digest=sha256:b0a7ce1de22537f9686647350257283a5c82d0e88501ef5e6b2eb53c1adfe14c

Observation 1c981c9d-8ecc-4b06-8d4f-6634566536cf · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:36.794886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:36.794886Z digest=sha256:32268621c2d241c75515b6d97ef5b9d9d01d23ef0759ddf9a044dcf2f4008a5b

Observation 608481de-d355-4b2e-8d23-41bfbcd66510 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:41.158140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.862854Z digest=sha256:397f4b4bf2f384131a2c060b5fa78f0f63c06b5268aecdb2b03a74bcf62a4d69

Observation 4e7f9a19-8b7e-43b0-9017-45a921be481a · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:40.971470Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:36.942839Z digest=sha256:a69ac786757c2802c726313d79b0bf92bb7048aa5d87a746eb1d3300cf2be7d1

Observation 33dc39e7-105d-449b-abf0-c08761114523 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:40.767842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.000140Z digest=sha256:741db923f708fad9b94b4fb0146aa3658f95e5c58a5a486da5e78ae34b62da49

Observation c47b14b9-05f5-4477-9e39-19233e5c1d4a · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:40.562548Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.063381Z digest=sha256:063c38a67e3c9feef97031764ad4d0fbc4e4a532f7e5f71ed51eb76bb4268261

Observation d98b25ff-e6a5-4791-bf9c-f3079b0ed975 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:40.316108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.223046Z digest=sha256:875f02f15783db65703e0a529217393648bd13a1601f872a2cd408bf2077ac1e

Observation 202f2fa9-86a4-4c3c-afbb-0e8e4178b581 · outbound

This paper cites 2018.Reinforcement learning: An intro- duction.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning 2018.Reinforcement learning: An intro- duction

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:15:37.348845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:15:37.348845Z digest=sha256:6f12f422952c93f6194d32580ed202ab4197b94e0ff2a0dfb9295ef5bddebe71

Observation daad16d8-2c23-43e8-9019-928a536e5908 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:40.054193Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.499312Z digest=sha256:3e084ac494d78cf293bbd1984edd654928fffc2c2382dd69b8e80261a965a04e

Observation 30f942b9-ce81-41f8-a15f-ec0eb9e75d10 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:39.816799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.608137Z digest=sha256:13af2adcfc763c4a49820667e28b26101fd4499a0ded9422b5bb2e0850134e87

Observation 780effeb-ce24-454e-98df-f5e48ecce527 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:39.539867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.723537Z digest=sha256:8db27a58c25c8f28db55effbb33495f8ea441044dbddf2464299e5d6ed37f85d

Observation f6b5dec2-595a-41ac-a96b-e819dbff65a9 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:39.270173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.832535Z digest=sha256:b49b33bae3c0b5667cfcb1d7e39e2d3cd08c485e9632ae083996d03a5f1f23de

Observation b7e2cf42-cce1-44b5-a37c-fbb495edbd1f · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:38.980676Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:37.949044Z digest=sha256:1425521c530bd7778bfb53f80b455268bba984cee1816d6cb441cf3c9c3cc12b

Observation 5fdcf949-a71e-4b6c-9772-3b2eadb9bc78 · outbound

This paper cites an unresolved cited work.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:15:38.758562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:38.042519Z digest=sha256:bfe157662876652f4c3734a36a3ebb486d121b8cd3e1cc4147a4455758b6130a

Observation 9c80b2f3-6447-46ae-842e-406600d9f7b0 · outbound

This paper cites 𝐸𝐿 Í𝐸𝐿+1 𝑙=1 𝑃𝑠(𝑙)−(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1) # (21) =𝑁 total×  𝐸𝐿 Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙)+𝑃 𝑠(𝐸𝐿+1) −(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1)  (22) =𝑁 total×.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning 𝐸𝐿 Í𝐸𝐿+1 𝑙=1 𝑃𝑠(𝑙)−(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1) # (21) =𝑁 total×  𝐸𝐿 Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙)+𝑃 𝑠(𝐸𝐿+1) −(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1)  (22) =𝑁 total×

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:15:38.463188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:38.154456Z digest=sha256:f52841afef052ed15d1173a8a53e0838efc1d47e924c2c7ed1fbf90a73261502

Observation 6e024169-4675-4f5e-8463-d6c253d42a5f · outbound

This paper cites InInterna- tional Conference on Machine Learning.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning InInterna- tional Conference on Machine Learning

Reference 2019

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:15:43.800522Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.491810Z digest=sha256:391422aca7d072f4ca96a7f5196d54b18b761449f5701cf8042b658591fc1edd

Observation 3a701974-7636-40b8-91d7-ac30053c2a86 · outbound

This paper cites Autonomous Intelligent Systems2, 1 (2022), 1–12.

Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning Autonomous Intelligent Systems2, 1 (2022), 1–12

Reference 2022

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:15:44.263001Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T14:15:35.304614Z digest=sha256:1274b43f9747363cd6de76964b06aefc73b5002a16b4bf3f7c3cfff377c820a6

Pith citing papers

No inbound Pith citation observations are available.