{"as_of":"2026-08-08T09:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc7b97843840e1ede03b3efe2f73d1eaa889d9f4fd7b3f61a39a9507758738e5","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:15:38.154456Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19637/citation-record","integrity":"/paper/2505.19637/integrity","json":"/paper/2505.19637/citation-record.json","paper":"/paper/2505.19637"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:44.405207Z","title":null,"venue":null,"work_id":"25ad3166-2312-4543-8ebe-c358899ee6a1","year":null},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.223458Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:37ce600d19015f133579218ee4c6f1925cd38856576f00f6649e8bcf9cd6bdaa","observation_id":"ad21ae39-8999-4ef2-94e7-f9c17e8a69e1","resolution":{"observed_at":"2026-08-07T14:15:44.522075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:43.890059Z","title":null,"venue":null,"work_id":"e54f72e7-7fba-4ce3-b669-48abbc002912","year":null},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.390294Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:712e7235140cd7a66f757d36fd1b1992847d9f5136c43729f806e387d858a03c","observation_id":"e8981b93-8a6b-46ac-9551-ba24883404db","resolution":{"observed_at":"2026-08-07T14:15:43.979608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:43.487713Z","title":null,"venue":null,"work_id":"5c925538-4478-49b0-9c04-dcc64c594865","year":2019},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.577073Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:2b27fa32d6e706858280c6dd11217b9ab1554d765cf76fa440f003c182fc587c","observation_id":"d79a646d-a141-40f2-aac2-bd2ebf198d5d","resolution":{"observed_at":"2026-08-07T14:15:43.575134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:43.298584Z","title":null,"venue":null,"work_id":"5d87c91c-d1f8-4372-b306-787d853f9dd4","year":2021},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.689988Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:cb94bbc4c5de14a0b8ef04cb85021387c177efe6621ba3700e1d80de5d8fc317","observation_id":"76b54ddb-d11a-416a-9969-0aa0cbc0063a","resolution":{"observed_at":"2026-08-07T14:15:43.379088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06011","last_updated":"2017-09-18T15:37:45Z","snapshot_observed_at":"2026-07-06T06:00:08.350506Z","submitted_at":"2017-09-18T15:37:45Z","title":"Guided Deep Reinforcement Learning for Swarm Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06011","snapshot_observed_at":"2026-08-07T14:15:35.804796Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.804796Z"},"links":{"cited_paper":"/paper/1709.06011","citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:e77fe4c19298e268f6a368d2daf2a7921b5100517eaa9460fc11d8740f605308","observation_id":"920462f9-38b6-4e5d-ac7a-2511318944c4","resolution":{"observed_at":"2026-08-07T14:15:35.804796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05664","last_updated":"2023-01-30T16:08:48Z","snapshot_observed_at":"2026-08-07T23:21:03.004245Z","submitted_at":"2023-01-13T17:01:58Z","title":"Risk Sensitive Dead-end Identification in Safety-Critical Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05664","snapshot_observed_at":"2026-08-07T14:15:35.927209Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.927209Z"},"links":{"cited_paper":"/paper/2301.05664","citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:cce8df8fb5b8384316f753d1dc551bc153c1f7f32f62216fdff03b8fb85e4299","observation_id":"5275ae44-41d5-4eba-bfec-257a98839941","resolution":{"observed_at":"2026-08-07T14:15:35.927209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:43.061843Z","title":null,"venue":null,"work_id":"ba93ee3b-17b6-4292-8647-83da931fb1a9","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.067854Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:b9ce12e05604aa169ca49cc3763ff104461ac8ab7e6f3c472d49572c60305201","observation_id":"cbdd3ceb-3fa7-4316-809b-d30f25aaf303","resolution":{"observed_at":"2026-08-07T14:15:43.151744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.870031Z","title":null,"venue":null,"work_id":"f178e7e1-85d3-4896-acfe-41ae8bc13efc","year":2022},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.168756Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:40929933b7cbd52a1d86fa81431d2a14212f85a7a25ff066f3b49bc6deef55c5","observation_id":"1c94055f-29f9-4135-8ff2-871740d9e4de","resolution":{"observed_at":"2026-08-07T14:15:42.970375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.751572Z","title":null,"venue":null,"work_id":"3024b6c0-d4c0-482f-b791-486e56c33831","year":2019},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.233451Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:8fd196fcf48ecef85aa9c28f02ebfbb21c3c7077d17ff5ef32b76c3ff2e74c9f","observation_id":"215d52a9-f784-4da4-b41c-4d3e3d30b8c7","resolution":{"observed_at":"2026-08-07T14:15:42.781691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.564067Z","title":null,"venue":null,"work_id":"932cf4b3-70e7-4ab6-aced-484b07a33d77","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.312690Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:614b1a08cc1ef69ba48ff0d1b24a6b91d6590131ee3d76e92db37643160893af","observation_id":"bdb2bbca-923e-469a-833a-af5086f762ec","resolution":{"observed_at":"2026-08-07T14:15:42.671354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.384685Z","title":null,"venue":null,"work_id":"343c2b82-1da6-4246-8af0-63fbfc1fd896","year":2024},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.365183Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:9c8ce377f5fcf4632cb124e690aa77ccf87d57ce2a86969fa2024a20706f47ee","observation_id":"83f9843e-880c-40bb-9273-4fe24bec63f1","resolution":{"observed_at":"2026-08-07T14:15:42.459870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.211847Z","title":null,"venue":null,"work_id":"1d2e58bb-941d-4541-b393-fbacd4789c69","year":2018},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.401037Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:967a90a7fada3a46597b7b9809b0bef64872bc87d6d12a6dd19c2252220fe1fd","observation_id":"c99c871f-31ea-4a6b-9a81-65c477de1f1e","resolution":{"observed_at":"2026-08-07T14:15:42.284446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:42.048724Z","title":null,"venue":null,"work_id":"5826dfd6-d2be-49d7-a6d8-8b6e3669c13d","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.480104Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:dbbf41cc00826ad5c80887654fb52d44a6a562b47a797fe99565b95fd199995e","observation_id":"7d756808-7d2d-488f-ab31-78e2bcc30a22","resolution":{"observed_at":"2026-08-07T14:15:42.122511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:41.870087Z","title":null,"venue":null,"work_id":"170ec065-80e8-476c-8eaf-81889a7c5c51","year":2024},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.543453Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:b30f89fb56cd85aaf823a90fbd54f86d2d29f805236768743507a27c7b6966da","observation_id":"d23433b9-550d-4dbc-a259-56e6ddc0f409","resolution":{"observed_at":"2026-08-07T14:15:41.959506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:41.682713Z","title":null,"venue":null,"work_id":"527fe94a-0d99-4513-b80c-6849a5297df3","year":2021},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.606188Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:f58f5b946eaf5ef96046f3e7d1d786e54550d88ac0e2c65278def0fd49d57a87","observation_id":"3ad9db5d-fcd1-43ff-8955-3b7e2fd05a1f","resolution":{"observed_at":"2026-08-07T14:15:41.776163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:41.455164Z","title":null,"venue":null,"work_id":"7095b20a-93ff-48cb-a89b-a9c4a60f1912","year":2020},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.667159Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:0deea51b50dbf6dd10fa1fdd7b20f4b8e229da0adee89d672c78712fe07d5072","observation_id":"1c4b17c6-4f97-4efa-9c92-77fd32f5cd1d","resolution":{"observed_at":"2026-08-07T14:15:41.586776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:41.306494Z","title":null,"venue":null,"work_id":"a0ed943d-dda6-4d99-a75e-0ffd9ac19ea9","year":2018},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.733149Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:148cba67e2053aaf491f70186604eff91c191873be200e315b29f88c3ef56de6","observation_id":"bd717aef-f044-4849-bbfc-b86806811bf1","resolution":{"observed_at":"2026-08-07T14:15:41.373253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:36.794886Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.794886Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:32268621c2d241c75515b6d97ef5b9d9d01d23ef0759ddf9a044dcf2f4008a5b","observation_id":"1c981c9d-8ecc-4b06-8d4f-6634566536cf","resolution":{"observed_at":"2026-08-07T14:15:36.794886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:41.075214Z","title":null,"venue":null,"work_id":"305f9f95-753c-467c-a88b-49178ffce437","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.862854Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:be0b6a60ebc095b965c01a7124729e9f5a54d188119e489289920eccb51a7938","observation_id":"608481de-d355-4b2e-8d23-41bfbcd66510","resolution":{"observed_at":"2026-08-07T14:15:41.158140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:40.872995Z","title":null,"venue":null,"work_id":"229051ad-32c5-4650-8d5e-0d7858b081c9","year":2019},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:36.942839Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:3cdc825907f03325dddf3856a16436fcf479415a2a2eb568c43bc8f990d02662","observation_id":"4e7f9a19-8b7e-43b0-9017-45a921be481a","resolution":{"observed_at":"2026-08-07T14:15:40.971470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:40.678269Z","title":null,"venue":null,"work_id":"1d02df74-a4be-4678-b903-a99114987c4b","year":2022},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.000140Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:7d33f8dc1debe7644fbff899862a22e4f5955d9480eaf7f410d9301ed5e1fc82","observation_id":"33dc39e7-105d-449b-abf0-c08761114523","resolution":{"observed_at":"2026-08-07T14:15:40.767842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:40.446854Z","title":null,"venue":null,"work_id":"1820a2be-b007-4e89-9753-f10df6dcc1e1","year":2021},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.063381Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:b0ed48c0a374dccd312b0e7f11b42366367c8ca6298f7f84996b3cadf4946f31","observation_id":"c47b14b9-05f5-4477-9e39-19233e5c1d4a","resolution":{"observed_at":"2026-08-07T14:15:40.562548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:40.230648Z","title":null,"venue":null,"work_id":"544013e8-fbbd-4e98-ad46-1cf2209aaf9f","year":2018},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.223046Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:623e9bfabdd23874b818a7183a53fe9e86b931c7745bb3d705e593861dc538fe","observation_id":"d98b25ff-e6a5-4791-bf9c-f3079b0ed975","resolution":{"observed_at":"2026-08-07T14:15:40.316108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:37.348845Z","title":"2018.Reinforcement learning: An intro- duction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.348845Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:6f12f422952c93f6194d32580ed202ab4197b94e0ff2a0dfb9295ef5bddebe71","observation_id":"202f2fa9-86a4-4c3c-afbb-0e8e4178b581","resolution":{"observed_at":"2026-08-07T14:15:37.348845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:39.946926Z","title":null,"venue":null,"work_id":"46a7a9c2-aad4-4c0b-9163-ba2d4f38771c","year":2020},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.499312Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:56e14e418ef0a3c8720d6c6adb0e068ef47aceef23362052f5ba4c1b15315b61","observation_id":"daad16d8-2c23-43e8-9019-928a536e5908","resolution":{"observed_at":"2026-08-07T14:15:40.054193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:39.711194Z","title":null,"venue":null,"work_id":"8962f7a7-0e01-455d-91a2-ab0f23c31d45","year":2020},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.608137Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:01e6babdb7b6791a89cbbe2d249e639772206c2ed2ae11482fb432746f549e4a","observation_id":"30f942b9-ce81-41f8-a15f-ec0eb9e75d10","resolution":{"observed_at":"2026-08-07T14:15:39.816799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:39.429777Z","title":null,"venue":null,"work_id":"ce6d55c9-bfc3-4393-9908-31ac31a2216f","year":2021},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.723537Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:a000ad51b6eb1d9b8450a06dc26be67576e66d9be8cdbb05c2305dcec6fa1831","observation_id":"780effeb-ce24-454e-98df-f5e48ecce527","resolution":{"observed_at":"2026-08-07T14:15:39.539867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:39.127291Z","title":null,"venue":null,"work_id":"1648e6f2-8ffb-4dd6-b325-aad3cb0f73a5","year":2015},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.832535Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:9a1a44979da72b637113587aa90208c20bca60e1da1d41f2f4e1f6d5390d9842","observation_id":"f6b5dec2-595a-41ac-a96b-e819dbff65a9","resolution":{"observed_at":"2026-08-07T14:15:39.270173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:38.886764Z","title":null,"venue":null,"work_id":"70af2e86-a023-4deb-be37-fb0d44ed27f7","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:37.949044Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:b80c63dd23cdcbd2c8e61942b8406866b2d1b36625c8b95e05d7d262027422fb","observation_id":"b7e2cf42-cce1-44b5-a37c-fbb495edbd1f","resolution":{"observed_at":"2026-08-07T14:15:38.980676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:38.622355Z","title":null,"venue":null,"work_id":"b2ae75be-224c-4f83-8b93-594b765f296d","year":2023},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:38.042519Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:0db18ad615acc9011138d5468108c41eb43e409548b91248a27b50aeb8124449","observation_id":"5fdcf949-a71e-4b6c-9772-3b2eadb9bc78","resolution":{"observed_at":"2026-08-07T14:15:38.758562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:38.358210Z","title":"𝐸𝐿 Í𝐸𝐿+1 𝑙=1 𝑃𝑠(𝑙)−(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1) # (21) =𝑁 total×  𝐸𝐿 Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙)+𝑃 𝑠(𝐸𝐿+1) −(𝐸 𝐿+1) Í𝐸𝐿 𝑙=1𝑃𝑠(𝑙) 𝐸𝐿(𝐸𝐿+1)  (22) =𝑁 total×","venue":null,"work_id":"ed8fa8c1-2795-41f5-b7e0-8852a10f33c5","year":2021},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:38.154456Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:0c59993eb99a468bdf6f35abe545532cdc89dbec69ecf6cdeddb9b938cb757d8","observation_id":"9c80b2f3-6447-46ae-842e-406600d9f7b0","resolution":{"observed_at":"2026-08-07T14:15:38.463188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:43.691016Z","title":"InInterna- tional Conference on Machine Learning","venue":null,"work_id":"6500f103-97cf-4b55-ad58-8fc2c40f3ab6","year":null},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.491810Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:7c6898413c7a68b6ced609774727c6592ee85402699c9124e3e9c3b71187b495","observation_id":"6e024169-4675-4f5e-8463-d6c253d42a5f","resolution":{"observed_at":"2026-08-07T14:15:43.800522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:15:44.122174Z","title":"Autonomous Intelligent Systems2, 1 (2022), 1–12","venue":null,"work_id":"d421c599-9aab-4d1a-9d73-610d181b46c0","year":2022},"citing_paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:35.304614Z"},"links":{"citing_paper":"/paper/2505.19637"},"observation_digest":"sha256:c2e0a6b190f88ad3760c4083313cf67e8488dd70831d1614a349daee96f137b7","observation_id":"3a701974-7636-40b8-91d7-ac30053c2a86","resolution":{"observed_at":"2026-08-07T14:15:44.263001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19637","last_updated":"2025-05-26T07:54:58Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T14:07:32.994821Z","submitted_at":"2025-05-26T07:54:58Z","title":"Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2505.19637."}