{"as_of":"2026-08-07T09:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:59fc2d229aff1e4d4e6a6d2296ef983f525d691d9175ff4adff77fe818accd1c","coverage":[{"denominator":180,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:57:08.508816Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T19:03:03.886581Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T19:03:08.378969Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"cited_work":{"arxiv_id":"2507.09495","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09495","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genai-based multi-agent reinforcement learning towards distributed agent intelligence: A generative-rl agent perspective","venue":null,"work_id":"0cfbf2f8-41ad-4ba2-a0fc-e2816188ec0b","year":2025},"citing_paper":{"arxiv_id":"2604.09682","last_updated":"2026-04-03T15:20:16Z","snapshot_observed_at":"2026-08-03T01:31:13.035567Z","submitted_at":"2026-04-03T15:20:16Z","title":"Decision-Theoretic Safety Assessment of Persona-Driven Multi-Agent Systems in O-RAN","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T19:03:03.886581Z"},"links":{"cited_paper":"/paper/2507.09495","citing_paper":"/paper/2604.09682"},"observation_digest":"sha256:a47428eee8272e6fc217e812c8f274d1bf04e50ee15e057cd862e942ae26e3a4","observation_id":"a41ca731-8bb2-48b5-bb1e-3abcf01ac25b","resolution":{"observed_at":"2026-05-13T19:03:08.380665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.09495/citation-record","integrity":"/paper/2507.09495/integrity","json":"/paper/2507.09495/citation-record.json","paper":"/paper/2507.09495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.145250Z","title":"Multi-agent reinforcement learning: Foundations and modern approaches","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.145250Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a95fcb0c849c9baecb1615f86606bf96ddfaf7ce3eda49a7c4d6b7c35ed80d24","observation_id":"a2085058-4427-4276-b642-97a4ea49b422","resolution":{"observed_at":"2026-08-06T17:57:08.145250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16677","last_updated":"2024-12-12T18:40:16Z","snapshot_observed_at":"2026-08-06T09:19:26.296394Z","submitted_at":"2024-07-23T17:44:54Z","title":"From Imitation to Refinement -- Residual RL for Precise Assembly","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16677","snapshot_observed_at":"2026-08-06T17:57:08.149682Z","title":"From Imitation to Refinement–Residual RL for Precise Assembly","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.149682Z"},"links":{"cited_paper":"/paper/2407.16677","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:c6962ec79114deff9c017fa4d456a8c29f9d89261286ba04cb7f5cf06acc8995","observation_id":"65500bde-5bb0-4996-91d0-5f8bb4ceb4e2","resolution":{"observed_at":"2026-08-06T17:57:08.149682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.154505Z","title":"Foundation Mod- els Defining a New Era in Vision: a Survey and Outlook","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.154505Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:b75f30b4e40c322e8237a783aa6a7ae6116d966c74bab77f98c6ea91fb1d08ca","observation_id":"9c225ea1-6557-43cf-97d1-789062e8e115","resolution":{"observed_at":"2026-08-06T17:57:08.154505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.160263Z","title":"Evolutionary reinforcement learning: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.160263Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:bb2094356a5ef357d6897c204f4f277752bd8e99bd51281fa7c8c73ce30f5dbc","observation_id":"fce280fa-4dfb-406c-84e6-7c32ce9d8d47","resolution":{"observed_at":"2026-08-06T17:57:08.160263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.166609Z","title":"The power of generative ai: A review of requirements, models, input–output formats, evaluation metrics, and challenges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.166609Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:21baf70f04d1be2add8c24fda2c39057e2092ad7b51c20355b257bfade3aca2d","observation_id":"3f8d8296-cdd4-4874-83c3-4a0ca6de77ea","resolution":{"observed_at":"2026-08-06T17:57:08.166609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.170744Z","title":"Recent advances in hierarchical reinforcement learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.170744Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:03647c2bb5b0b04411425fcc0443744d1acb455b50b9055e331dc547770d84eb","observation_id":"71b083e2-bbe2-423a-b6e7-3ff9007d3c3b","resolution":{"observed_at":"2026-08-06T17:57:08.170744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.174849Z","title":"Modelling and prediction in a complex world","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.174849Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:13e7aa1795b840ad63d4096e203d515657f12062585397dd021190787645de37","observation_id":"1a43708f-5ad7-4412-b84f-264441d6eccb","resolution":{"observed_at":"2026-08-06T17:57:08.174849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03801","last_updated":"2016-12-13T12:19:48Z","snapshot_observed_at":"2026-07-06T05:22:21.129782Z","submitted_at":"2016-12-12T17:32:49Z","title":"DeepMind Lab","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03801","snapshot_observed_at":"2026-08-06T17:57:08.178468Z","title":"Deepmind lab","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.178468Z"},"links":{"cited_paper":"/paper/1612.03801","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:7ed5cd077b6131dacc290985dccbac33cc5c9b26dd575e94369f5897d6b1d739","observation_id":"03e565fe-313c-4cb9-b7cc-698c78718c85","resolution":{"observed_at":"2026-08-06T17:57:08.178468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.181987Z","title":"The arcade learning environment: An evaluation platform for general agents","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.181987Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:d42c9feb57188b5069a731b0c5add5caf6727960632c4f8153bdd059253f8a75","observation_id":"0a4120c5-b91d-4bfe-a8f3-b07b2574ead5","resolution":{"observed_at":"2026-08-06T17:57:08.181987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.185930Z","title":"Ex- ploiting redundancy for reliability analysis of sensor perception in automated driving vehi- cles","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.185930Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:80782bc07394e8c83e54f0243c920390c350df905eacdbe94fa115487e06729c","observation_id":"d3059d33-5017-4369-b9a5-f719c543ce5d","resolution":{"observed_at":"2026-08-06T17:57:08.185930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.190542Z","title":"Multiagent reinforcement learning: Rollout and policy iteration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.190542Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:c304ab4c89e0e2ad5381a0ae5a0d90dbe3ad9b729c09e1183ac45aa6cb42d8a4","observation_id":"f2997cff-248e-4605-b66e-a3741e47ecf9","resolution":{"observed_at":"2026-08-06T17:57:08.190542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.193998Z","title":"Stochastic model updat- ing with uncertainty quantification: an overview and tutorial","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.193998Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:064a2a5ed3723500c8f734d55b26b37d5bdcd3ba95a481293ef304796e97eee5","observation_id":"3b3f179c-6406-4da2-9797-a649b57d6cf0","resolution":{"observed_at":"2026-08-06T17:57:08.193998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.197243Z","title":"Evolutionary dy- namics of multi-agent learning: A survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.197243Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:2b13de1420203639a2e6be3f371b1ab39aea323f85f56265bb33e8bdcec7d512","observation_id":"a3681d17-40b5-4002-89e4-6e79f1ef3d26","resolution":{"observed_at":"2026-08-06T17:57:08.197243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10046","last_updated":"2019-10-22T15:27:41Z","snapshot_observed_at":"2026-08-04T02:04:27.829537Z","submitted_at":"2019-10-22T15:27:41Z","title":"Uncertainty Quantification with Generative Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10046","snapshot_observed_at":"2026-08-06T17:57:08.200394Z","title":"Uncertainty quantification with gener- ative models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.200394Z"},"links":{"cited_paper":"/paper/1910.10046","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:178b20ea5d46073168f0f545a069ee5426a7b0c26058d9e5fcf13e0d2f3f7412","observation_id":"0d8e1ecb-f769-49ce-b6cc-7bd1193cca6c","resolution":{"observed_at":"2026-08-06T17:57:08.200394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.204081Z","title":"Human–agent interaction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.204081Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:95135aadc93d826aa6d1608b37c5ca22c0bd6b26b33ad1314de01fee6d05a4b9","observation_id":"d2c37e8a-bb69-4641-b7d6-2e50d3a0a15c","resolution":{"observed_at":"2026-08-06T17:57:08.204081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-06T17:57:08.207193Z","title":"Openai gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.207193Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:25667d59669dbdb05fd84b72facde79c208d729f9930ca323ec89fbafe1b6399","observation_id":"b860fcbc-4008-442a-99e2-e9eb56e75962","resolution":{"observed_at":"2026-08-06T17:57:08.207193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.211251Z","title":"A comprehensive survey of mul- tiagent reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.211251Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:49e4d73534ef44d66d69d1c12e70c57c277223b9e7dad8db74e5344d5f5924b0","observation_id":"5a1a9fd4-4673-43e2-aa94-1312c694a1ea","resolution":{"observed_at":"2026-08-06T17:57:08.211251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.215453Z","title":"Multi-agent reinforcement learning: A review of challenges and applications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.215453Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:1890b6322b49885bd44385c258457a591499c47ef208e5f50b08786d73a1f1e6","observation_id":"d7ae785f-6fbb-4328-992b-4567826c5316","resolution":{"observed_at":"2026-08-06T17:57:08.215453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.218686Z","title":"A survey on generative diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.218686Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:21399e547faf27ae30f3df0e257dcb8e990542f6fe61b0befbf607dd1cb99fa5","observation_id":"f9c53c47-8aeb-40ca-9519-2fc09707df50","resolution":{"observed_at":"2026-08-06T17:57:08.218686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02644","last_updated":"2024-01-05T05:28:40Z","snapshot_observed_at":"2026-08-04T15:37:47.750655Z","submitted_at":"2024-01-05T05:28:40Z","title":"Simple Hierarchical Planning with Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02644","snapshot_observed_at":"2026-08-06T17:57:08.221828Z","title":"Simple hi- erarchical planning with diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.221828Z"},"links":{"cited_paper":"/paper/2401.02644","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:bf8b5af69ea20b7d56f3d4a5e3c5802cf28ed28a5d4818fd7536f29dea5042c1","observation_id":"94a67fd3-e025-427f-8432-9bc648116c74","resolution":{"observed_at":"2026-08-06T17:57:08.221828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.225673Z","title":"Adversarial counterfactual environment model learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.225673Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:6a3fa3e6d666952e51e7a4847240cb9069596a0eff6de7ecb5b9dbba01ad06a1","observation_id":"8fe6566a-1829-4eba-992d-73c6bb620b65","resolution":{"observed_at":"2026-08-06T17:57:08.225673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.228793Z","title":"Diffusion policy: Visuomotor policy learning via action diffu- sion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.228793Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:216e2896a4a6b56dc3898ad69c54e3c5ad9a1dd061c8e2ceead297473fd92992","observation_id":"8acdc828-97f3-44f2-9113-310d6356e730","resolution":{"observed_at":"2026-08-06T17:57:08.228793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.231789Z","title":"A survey on aerial swarm robotics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.231789Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:d1993de6c13036c250b267b83f14e7dfcc2e6c127f51851a9ee880f744b3cb26","observation_id":"fe531cb2-c134-4a41-8b66-f1dbdd07bc09","resolution":{"observed_at":"2026-08-06T17:57:08.231789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.235438Z","title":"Designing human-agent collaborations: Commitment, responsiveness, and sup- port","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.235438Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a4869f27830d423174b93b33c832996ffd5f62506f4b698310767e735c790664","observation_id":"32ed251e-c8d4-4ec0-a695-175e1c075e3d","resolution":{"observed_at":"2026-08-06T17:57:08.235438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.238483Z","title":"Hierarchical planning in a distributed environment","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.238483Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:50ab4dffdf0a4856a0177abbc59b644b2d8244fd2acb119215852eea2804e39f","observation_id":"7409b4ae-9f2c-4fa1-aeed-528fd3d624b1","resolution":{"observed_at":"2026-08-06T17:57:08.238483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.241599Z","title":"Adaptive dynamics in coordination games","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.241599Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:e05a47d72f5c4e2af7c7a70d50be15b77f512946d4af17a9f8f42e1ddf4dd989","observation_id":"3494bb18-e648-42b0-8e65-f190fb49e301","resolution":{"observed_at":"2026-08-06T17:57:08.241599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.245162Z","title":"From creatures of habit to goal-directed learners: Tracking the developmental emergence of model- based reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.245162Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:ba538c312b5a4b9cbb3c9e3be3fcc4a625e6dfd0a2830b7af26367669725c648","observation_id":"30305fae-4a84-4bf1-9d0e-eb16753c06c4","resolution":{"observed_at":"2026-08-06T17:57:08.245162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.248618Z","title":"Analytical evaluation of hierarchical planning systems","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.248618Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:81b927964dc873cf9fe27dcebff64ea69fe61f7a11554c238e945dcb9258aec1","observation_id":"68b8006c-20c8-4de3-85e4-c78638f61df7","resolution":{"observed_at":"2026-08-06T17:57:08.248618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.251881Z","title":"Swarm robotics: A perspective on the latest reviewed concepts and applications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.251881Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:268dea3e7bc9b9296774baf43941cbd5894c9bb6a409ece6367501b657ce0e72","observation_id":"4f97ec2c-e2b7-4401-84cc-59440e8174df","resolution":{"observed_at":"2026-08-06T17:57:08.251881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05908","last_updated":"2021-01-03T16:56:46Z","snapshot_observed_at":"2026-08-04T06:56:29.565877Z","submitted_at":"2016-06-19T21:02:30Z","title":"Tutorial on Variational Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05908","snapshot_observed_at":"2026-08-06T17:57:08.255677Z","title":"Tutorial on variational autoencoders","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.255677Z"},"links":{"cited_paper":"/paper/1606.05908","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:c447099e4ac80b1c74e2901fcbc075d3b82474bebf789f3ddffef7bba97df921","observation_id":"eed115d1-6909-4d37-a272-dcb2fbc9db50","resolution":{"observed_at":"2026-08-06T17:57:08.255677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.258996Z","title":"Swarm robotics: Past, present, and future [point of view]","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.258996Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:50cf478a252e3bdc8f56e819b835d70493cc79e7f6385ca2124da9f735126793","observation_id":"647f7a18-eb24-49e1-94b0-9ceac9a3910a","resolution":{"observed_at":"2026-08-06T17:57:08.258996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.262931Z","title":"A survey on multi-agent deep reinforcement learning: from the perspective of challenges and applications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.262931Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:dc441c9a02ebabbb3dc9c28110d3a58a7712bb7df6701157f60e295a5213a05e","observation_id":"f6a10d56-2093-4e07-9798-b0306386579e","resolution":{"observed_at":"2026-08-06T17:57:08.262931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12348","last_updated":"2024-06-10T17:14:09Z","snapshot_observed_at":"2026-08-06T16:37:19.128638Z","submitted_at":"2024-02-19T18:23:36Z","title":"GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12348","snapshot_observed_at":"2026-08-06T17:57:08.266513Z","title":"Gtbench: Uncovering the strategic reasoning limitations of llms via game-theoretic evaluations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.266513Z"},"links":{"cited_paper":"/paper/2402.12348","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:0292e545edffff3c1ebd9359e85f7ff0f4844baf3096792c55d87fff914b5aa4","observation_id":"611fddd2-c4d0-4182-8f8c-7c17f856217b","resolution":{"observed_at":"2026-08-06T17:57:08.266513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.271101Z","title":"Minecraft, beyond construction and survival","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.271101Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:6aecf135c1e9ad60458a16fd2e8907f76cd269a287bc0bd2b60e5ee0b9021340","observation_id":"15c6ba7d-33a5-4c90-a857-2c9a7d541967","resolution":{"observed_at":"2026-08-06T17:57:08.271101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.274634Z","title":"Biases for emergent communication in multi-agent reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.274634Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:2a3fe6e97fd84c8011438f7f47ecaa8c9b496feaae52348327fdd65f15149d8d","observation_id":"33cd9862-c1d3-4dc9-9513-7ceecda5a44b","resolution":{"observed_at":"2026-08-06T17:57:08.274634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.278860Z","title":"Scalable Multi-Agent Model-Based Reinforcement Learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.278860Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:4ccc022f40c4be121cfaf4db20b137cabbcac077db2c3f5cb4663bdbc68d6958","observation_id":"3320755f-9560-46bc-b7c0-575b0117cd90","resolution":{"observed_at":"2026-08-06T17:57:08.278860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07489","last_updated":"2023-10-17T14:05:58Z","snapshot_observed_at":"2026-08-03T17:36:29.821835Z","submitted_at":"2022-12-14T20:15:19Z","title":"SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07489","snapshot_observed_at":"2026-08-06T17:57:08.282307Z","title":"Smacv2: An improved benchmark for cooperative multi- agent reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.282307Z"},"links":{"cited_paper":"/paper/2212.07489","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:e8821d529434ead189a25140fb73361fee593ef2c1a8d23c948e7b5d5ab4a48d","observation_id":"b9cf3c3c-8c82-4afe-835d-d8c8b7442702","resolution":{"observed_at":"2026-08-06T17:57:08.282307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.286721Z","title":"Adaptive team coordination","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.286721Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:3b3d6c8bec746f3399230e483b9cb3bcad3be541c9b9996c0482b62161a00c43","observation_id":"e4126653-2d6d-4474-b678-fa70c09f17eb","resolution":{"observed_at":"2026-08-06T17:57:08.286721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.290350Z","title":"The influence of agent reliability on trust in human-agent collabo- ration","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.290350Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:4b49c8cd80309cecdedbc3aa09c5522cc2013b28df5888abfffdcda8896a98fe","observation_id":"93eb87ec-4308-432f-b170-beed3c59cb21","resolution":{"observed_at":"2026-08-06T17:57:08.290350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.293503Z","title":"Extending the recognition- primed decision model to support human-agent collaboration","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.293503Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:8137be980a9035d560867c6882714a0e70dc13201b777afb9ed1074f2981aa16","observation_id":"acc6ca0c-3769-4bd1-981e-1cafc91decd3","resolution":{"observed_at":"2026-08-06T17:57:08.293503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.297231Z","title":"GenAI against humanity: Nefarious applications of generative artificial intelligence and large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.297231Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:5f48c44acdeb6e535ef3d6e263747377a6a95f77b17bc3d7ce8aebabac98788a","observation_id":"d15e1ff7-14aa-46af-8e01-dee9e192c002","resolution":{"observed_at":"2026-08-06T17:57:08.297231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.300559Z","title":"Generative ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.300559Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:43d73c499601c33854bac3b60649641c7a1d56d1c4cceb03359591407e3831fd","observation_id":"81ac8566-4dd1-4413-8ccc-6d546a02ec4c","resolution":{"observed_at":"2026-08-06T17:57:08.300559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.304133Z","title":"Learn- ing to communicate with deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.304133Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:650d1759c80c5ffdc1301a3357d0db02cda8e8d2d44bb805981e2d751953ff76","observation_id":"2f96b05c-317d-4526-b311-37e222df6563","resolution":{"observed_at":"2026-08-06T17:57:08.304133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.307162Z","title":"Counterfactual vision-and-language navigation via adversarial path sampler","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.307162Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:06bca564bee45c12ddc08bfac658edc4ff736fdd13be44d8308cd2555e98bd90","observation_id":"00a80ef1-071a-4ee9-b654-d5be11dc9845","resolution":{"observed_at":"2026-08-06T17:57:08.307162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.310837Z","title":"Generative AI and ChatGPT: Applications, challenges, and AI-human collaboration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.310837Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:713b918fe24217dcb0e886db07f4530995e69a249bd28999721ee4ed9f4cc2aa","observation_id":"29b5aab9-c7c0-4af1-adfc-27a34203d1da","resolution":{"observed_at":"2026-08-06T17:57:08.310837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.314720Z","title":"Cardreamer: Open-source learning platform for world model based autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.314720Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:5133f44c41e660bbf1f934c10388570fc1fbf3623004686f2aaafd4a4da0ab3d","observation_id":"9d8f5c46-2874-4836-9154-143ae7a1ec79","resolution":{"observed_at":"2026-08-06T17:57:08.314720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.317796Z","title":"Model predictive control: Theory and practice—A survey","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.317796Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:e08096f2c685a2b538b88b3a416e7edc110bce7074d3780ef9d9d16f119e1130","observation_id":"ad04fa96-04fa-49c9-a242-36d0f07acc8b","resolution":{"observed_at":"2026-08-06T17:57:08.317796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.320828Z","title":"A framework for sequential planning in multi- agent settings","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.320828Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:ea20a71febcea6d0fbed5389694cebe58aee95012e3d33b4837bda3199dfe13e","observation_id":"7328455e-21d7-4598-a029-ae77df503108","resolution":{"observed_at":"2026-08-06T17:57:08.320828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02781","last_updated":"2026-04-09T12:47:33Z","snapshot_observed_at":"2026-07-06T15:38:20.791132Z","submitted_at":"2023-06-05T11:14:18Z","title":"An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02781","snapshot_observed_at":"2026-08-06T17:57:08.324100Z","title":"A survey of Generative AI Applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.324100Z"},"links":{"cited_paper":"/paper/2306.02781","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:59160f604c94128b28e65d4fb4bdc6ff9f4ad6688d5a3c8b299cdeb5af54d07f","observation_id":"3f60a63c-75a6-4506-ba00-3202ec040a25","resolution":{"observed_at":"2026-08-06T17:57:08.324100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.328134Z","title":"Multi-agent deep reinforcement learning: a survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.328134Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:11dd00c46219349815b00d0b09805324754574bf59fda7af88d8330585754ef1","observation_id":"2983d9ad-735f-4419-a16e-b3d79f351cfe","resolution":{"observed_at":"2026-08-06T17:57:08.328134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.331477Z","title":"Concept-based un- derstanding of emergent multi-agent behavior","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.331477Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:83e58da8e45ecabe4e5a986ec06adc572ae21103f979bc18485e8d814dc582c2","observation_id":"2fdc1283-8f3d-4ef0-9dcf-41d5c0d6d0d9","resolution":{"observed_at":"2026-08-06T17:57:08.331477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T17:57:08.335027Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.335027Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:20cd3e1472091c87129987b8aeee25a02ff8f12ca8fbd6e2be45fcde5207b06b","observation_id":"5c7d2bc8-d1d2-4c88-a448-6a6583813caa","resolution":{"observed_at":"2026-08-06T17:57:08.335027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02780","last_updated":"2020-04-09T04:14:14Z","snapshot_observed_at":"2026-07-06T09:10:17.507304Z","submitted_at":"2020-04-06T16:13:23Z","title":"Networked Multi-Agent Reinforcement Learning with Emergent Communication","version":2},"cited_work":{"arxiv_id":"2004.02780","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.02780","snapshot_observed_at":"2026-08-06T17:57:09.242388Z","title":"Networked Multi-Agent Reinforcement Learning with Emergent Communication","venue":"cs.MA","work_id":"78257a4a-acb9-49ad-9441-c7cd66317dac","year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.338404Z"},"links":{"cited_paper":"/paper/2004.02780","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a1233731191ea170bd5972798c3525d9187b638fb84b853ca868a2b3b4b72832","observation_id":"ceb2ed73-d0c6-458e-91d2-7a66b478eb5c","resolution":{"observed_at":"2026-08-06T17:57:09.246534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.342773Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.342773Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:992f1cd8d0f6aab43469d3b580c7e8c393b4260fefead13b2b5ae606f1b71a0a","observation_id":"77977bf0-3bf7-4124-bf79-a649b5830743","resolution":{"observed_at":"2026-08-06T17:57:08.342773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T17:57:08.346191Z","title":"World models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.346191Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:c9458a37dfa04a173aadbe66b8db1710c9687781af7af3dd1768b1d62533457c","observation_id":"53c8ab06-d312-4b41-91b7-5cec96ddfa19","resolution":{"observed_at":"2026-08-06T17:57:08.346191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.349556Z","title":"Deep hierarchical plan- ning from pixels","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.349556Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:f30b50b7322ef4da1ab23a7683b59d844820968f111df368ae35a56b92af869d","observation_id":"d31b1e51-0f57-434c-8359-f2141b90fc77","resolution":{"observed_at":"2026-08-06T17:57:08.349556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.353224Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.353224Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:43cd2ee8ead188b8f603a3434fdd8bd04a3f61e4f839580e6c44e78b887e78f3","observation_id":"53acc668-cda1-4483-9aa0-37bb85701b5c","resolution":{"observed_at":"2026-08-06T17:57:08.353224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-06T17:57:08.356988Z","title":"Mastering atari with discrete world models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.356988Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:f80bd1b727685003b4dd460435ba0eb9ab20ab4075512300d36bdb67f3f462b1","observation_id":"b89f7375-ae50-4ce2-b33b-b258726d5942","resolution":{"observed_at":"2026-08-06T17:57:08.356988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T17:57:08.360200Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.360200Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a0821b1363ef688ceaac2b9dcaf45c39a8789ae229ee3f797c4b53fab5348806","observation_id":"602f7c77-b38c-426c-975c-326b1c07b9af","resolution":{"observed_at":"2026-08-06T17:57:08.360200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.364240Z","title":"A comprehensive survey and analysis of generative models in machine learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.364240Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:cca11cdf6fe6e808fe8949d10d8b94e7a4fd8020d81f37bd2113d7a11f376924","observation_id":"df0fd140-fc59-4342-aaaa-80d2d69f4f45","resolution":{"observed_at":"2026-08-06T17:57:08.364240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.367961Z","title":"Opponent modeling in deep reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.367961Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:528b5ad05633f37df4ac57045a47850e508dc701b6e8b63602855ac472197494","observation_id":"fc42466d-e6f9-4a33-ac93-d07c72bdcf36","resolution":{"observed_at":"2026-08-06T17:57:08.367961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09183","last_updated":"2019-03-11T20:17:29Z","snapshot_observed_at":"2026-07-06T05:53:08.086224Z","submitted_at":"2017-07-28T10:49:41Z","title":"A Survey of Learning in Multiagent Environments: Dealing with Non-Stationarity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09183","snapshot_observed_at":"2026-08-06T17:57:08.370915Z","title":"A survey of learning in multiagent environments: Dealing with non-stationarity","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.370915Z"},"links":{"cited_paper":"/paper/1707.09183","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:3f14c390c915036ce15a7eacf844318ce02bd950079909b210cb7f934cc7c7e5","observation_id":"cb3adc4e-d9c6-4ea2-97db-706df8da744f","resolution":{"observed_at":"2026-08-06T17:57:08.370915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.374085Z","title":"HDDL: An extension to PDDL for expressing hierarchical planning problems","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.374085Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:15378030f785fcbfbb85b302595a95268c47c8fe08061b0a8cc1061a1d06bbcd","observation_id":"8a4b1d10-bd80-4395-80b9-8daade278f44","resolution":{"observed_at":"2026-08-06T17:57:08.374085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T17:57:08.377392Z","title":"Gaia-1: A generative world model for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.377392Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:5f4e8bf8b42d2f70b8ff5cb5729f60657ec8287e05d1a4e5a8167aeffb8a67cc","observation_id":"98ac1d49-a500-4a90-851e-807ec033ad31","resolution":{"observed_at":"2026-08-06T17:57:08.377392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03479","last_updated":"2023-06-08T07:43:05Z","snapshot_observed_at":"2026-07-06T10:38:59.396722Z","submitted_at":"2021-02-06T02:28:09Z","title":"Rethinking the Implementation Tricks and Monotonicity Constraint in Cooperative Multi-Agent Reinforcement Learning","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03479","snapshot_observed_at":"2026-08-06T17:57:08.380659Z","title":"Rethinking the implementation tricks and monotonicity constraint in cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.380659Z"},"links":{"cited_paper":"/paper/2102.03479","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:464dd9e709c222e27c4750b06c4c0af159fba46120ba51e597ab3c58887ddaba","observation_id":"3e19c696-c2af-43c6-bd84-71d64f848b02","resolution":{"observed_at":"2026-08-06T17:57:08.380659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.384895Z","title":"MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.384895Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:09b59e782ea72a1c5a35986cea1b4ae4fbaf999f6125554df0581448ddc5f250","observation_id":"73cae829-8867-4502-9250-2b83778fd7f7","resolution":{"observed_at":"2026-08-06T17:57:08.384895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.387968Z","title":"Deep reinforcement learn- ing for swarm systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.387968Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:6493585e643b0931665a4672b052a7dd1c1dc49184f5ac5b82f643affe7ad22c","observation_id":"bc7d975d-fe8f-43ac-8047-c9530f4806bc","resolution":{"observed_at":"2026-08-06T17:57:08.387968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.392023Z","title":"Reinforcement learning algorithm for partially observable Markov decision problems","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.392023Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:f0442f23f476ce5178dfa04700ae806f10bf25f0a89e3cee0e157a5bdd31262e","observation_id":"702d4bd5-0c73-484d-82ab-15ee8b39175c","resolution":{"observed_at":"2026-08-06T17:57:08.392023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.396093Z","title":"Learning attentional communication for multi-agent co- operation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.396093Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:7644e1cc5caf49a94085d45f17394266efc652331df528f18a00f79ec62fcdf9","observation_id":"64a8fe0e-4e7e-43e1-801d-b6aa614249c3","resolution":{"observed_at":"2026-08-06T17:57:08.396093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.399172Z","title":"Reinforcement learning of coordination in het- erogeneous cooperative multi-agent systems","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.399172Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:9f2f54e8edc2c913941516c3b9e2c318a420921af0426f79508331403a3af71a","observation_id":"031aa91d-85fb-4d1d-baeb-cd0a27715ac3","resolution":{"observed_at":"2026-08-06T17:57:08.399172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.402481Z","title":"On generating plausible counterfactual and semi-factual explanations for deep learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.402481Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:fea70ad48123ac05972ad143b73e4cc37af2ff3462051af1df94cdfc88a64a93","observation_id":"297d55db-fb62-47d2-a382-3e37ecc75e04","resolution":{"observed_at":"2026-08-06T17:57:08.402481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.405852Z","title":"An overview of swarm robotics: Swarm intelligence applied to multi-robotics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.405852Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:1ef27ffe3bef3c5df590849b45f75fd222dd5f2a1919f1c470d16469b4ff2244","observation_id":"1c0594bc-17a5-4821-8247-d9bb1ea91530","resolution":{"observed_at":"2026-08-06T17:57:08.405852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-06T17:57:08.409319Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.409319Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:fe1f3420d5d194db6c3301b0ee7711f5457b150e08a2f3d0442371403c24aae7","observation_id":"6ea5ef3d-deee-43e0-864f-6224c70ba49a","resolution":{"observed_at":"2026-08-06T17:57:08.409319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.413692Z","title":"Communication in multi-agent reinforce- ment learning: Intention sharing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.413692Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:f8d56a987dc6cdc653a07b4768422da5ce4da5953b1c352b33799c87254b6c80","observation_id":"35772ec2-ba35-4d70-93ac-65347bb79743","resolution":{"observed_at":"2026-08-06T17:57:08.413692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T17:57:08.417114Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.417114Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:668346ae0c13eb3374ea574f17899f32ba59792bb1abfccf428f32de1499795f","observation_id":"d5bfc42d-a10e-4f95-bf3d-abdf95207a88","resolution":{"observed_at":"2026-08-06T17:57:08.417114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.420405Z","title":"Human interaction with robot swarms: A survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.420405Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:b405f925a8e06d72caae4d1ebe1987c8c0a24e38998f09bed8f2891215bafbbf","observation_id":"49122826-ea69-4e39-beda-74809d23d43e","resolution":{"observed_at":"2026-08-06T17:57:08.420405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.423714Z","title":"Multi-agent reinforcement learning with multi-step generative models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.423714Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:3d45bda2c3595fa0dbf6dd9eac00f2edb51cfdd220d768932a26fa54504b520d","observation_id":"c05f9a9d-6781-4e41-97c3-b016df3fe54d","resolution":{"observed_at":"2026-08-06T17:57:08.423714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04779","last_updated":"2020-08-19T17:07:05Z","snapshot_observed_at":"2026-08-05T14:26:27.718486Z","submitted_at":"2020-06-08T17:53:42Z","title":"Conservative Q-Learning for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04779","snapshot_observed_at":"2026-08-06T17:57:08.426907Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.426907Z"},"links":{"cited_paper":"/paper/2006.04779","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:6505989e254a7520b12bdcd4f0b6efa8a4aa625f276ed076197919501423d803","observation_id":"5e093172-a8ce-45df-91fc-d68450c80dea","resolution":{"observed_at":"2026-08-06T17:57:08.426907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.431098Z","title":"Application of generative artificial intelligence (GenAI) in language teach- ing and learning: A scoping literature review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.431098Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:44d8c9c67506bfed3c0cef6852295f3d89a70ff1f2f6985bfc65bc80a5185155","observation_id":"969fff06-ee99-4e45-8208-aac42dae3809","resolution":{"observed_at":"2026-08-06T17:57:08.431098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.02419","last_updated":"2020-07-14T09:21:53Z","snapshot_observed_at":"2026-08-06T23:14:01.358514Z","submitted_at":"2020-06-03T17:50:16Z","title":"Emergent Multi-Agent Communication in the Deep Learning Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.02419","snapshot_observed_at":"2026-08-06T17:57:08.435353Z","title":"Emergent multi-agent communication in the deep learning era","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.435353Z"},"links":{"cited_paper":"/paper/2006.02419","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:ee15d1cc6d5817a3c404b1e020882ba49d1ef372416bfbcb1b1ce53e86c9639b","observation_id":"62497cf0-8f7a-4ddd-a086-3649b66723b3","resolution":{"observed_at":"2026-08-06T17:57:08.435353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.439253Z","title":"Backpropagation applied to handwritten zip code recog- nition","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.439253Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:3cddcf37ab5588861acd53f489be5147f9a819f32b6cfb0be19e4f2d5cbcd6ea","observation_id":"845ff234-b8b0-445a-90e2-556444a3d382","resolution":{"observed_at":"2026-08-06T17:57:08.439253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06922","last_updated":"2018-04-11T03:22:49Z","snapshot_observed_at":"2026-07-06T06:04:56.966823Z","submitted_at":"2017-10-12T00:37:27Z","title":"Emergent Translation in Multi-Agent Communication","version":2},"cited_work":{"arxiv_id":"1710.06922","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.06922","snapshot_observed_at":"2026-08-06T17:57:09.128879Z","title":"Emergent Translation in Multi-Agent Communication","venue":"cs.CL","work_id":"70d211d6-b0b9-4ab0-91d5-fca9cbb7add8","year":2017},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.443390Z"},"links":{"cited_paper":"/paper/1710.06922","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:042cb1a33daff1b365069a4aefec04cd6c75dedc1deb14300e715dfb5f39c571","observation_id":"a1748ec4-eb34-4901-b21b-3b780acdb33e","resolution":{"observed_at":"2026-08-06T17:57:09.133121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.446841Z","title":"Guided policy search","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.446841Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:1f01caab643cfdbd406dbaac9fb13df0879aa0fb7d20f36a21ce17aeb07db651","observation_id":"7e8cb6cc-67ea-4611-8709-8bb01e62e683","resolution":{"observed_at":"2026-08-06T17:57:08.446841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.450176Z","title":"Hierarchical planning through goal-conditioned offline reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.450176Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:cf4b8aba74d8e8591e3281be7519fa74312677073523316ee1ffbd5a52aa5445","observation_id":"9ebfad2e-df40-4bb9-b029-87e5af283682","resolution":{"observed_at":"2026-08-06T17:57:08.450176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.453699Z","title":"Adaptive iterative learning control for coordination of second- order multi-agent systems","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.453699Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a970327df7aab5c1919a39dc22010c35e6c24183d3ca529bc9a22a1abf4564b0","observation_id":"329f452a-6e11-4806-b408-03ff85fdad45","resolution":{"observed_at":"2026-08-06T17:57:08.453699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-06T17:57:08.458037Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.458037Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:80b8388e2c34bf2c0365178506b44b3ed49b7ae87ff3f8cff95615b338688db1","observation_id":"4b241d68-5e75-450d-9759-9ca1bfe176e8","resolution":{"observed_at":"2026-08-06T17:57:08.458037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-06T17:57:08.461783Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manip- ulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.461783Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:ebd7d5bdcb1269513393cd9ad7e6947f37ae7534ede28e919dfdaa8edc9d7296","observation_id":"d63427eb-a570-4a69-8893-fb1cb7153e0b","resolution":{"observed_at":"2026-08-06T17:57:08.461783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.465856Z","title":"Multi- agent game abstraction via graph attention neural network","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.465856Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:abdddb0a7478fc26c2d703e050e65e74b7b7302f9124cbc04bfe5da7278f3130","observation_id":"4ddf6fec-b156-4b9b-8501-7d9b8f59c2ea","resolution":{"observed_at":"2026-08-06T17:57:08.465856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.469614Z","title":"A review of uncertainty for deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.469614Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:ac242e4cd1a6f0877c2fc2c3ca44baebc8b0d7b9972eef736cad042980f44ffe","observation_id":"d5ad5a74-7f30-4bcd-93d0-04232c643192","resolution":{"observed_at":"2026-08-06T17:57:08.469614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.472786Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.472786Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:7918a10b1727ea6f4e18b53f1aafbe5b408d6321d4867ac196722cc4473fbd57","observation_id":"50590969-e092-4e61-9d47-a293efe1496d","resolution":{"observed_at":"2026-08-06T17:57:08.472786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.476263Z","title":"Jfp: Joint future prediction with interactive multi-agent modeling for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.476263Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:658a31baca9f057127eab92a09cc80ce3ab9035dbafc4c0b89fbbd1a306b4800","observation_id":"85cdbe7d-380b-4e60-a00d-1ecbae8d0f6d","resolution":{"observed_at":"2026-08-06T17:57:08.476263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03858","last_updated":"2021-02-15T17:29:47Z","snapshot_observed_at":"2026-07-06T06:49:27.569841Z","submitted_at":"2018-07-10T20:53:04Z","title":"Algorithmic Framework for Model-based Deep Reinforcement Learning with Theoretical Guarantees","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03858","snapshot_observed_at":"2026-08-06T17:57:08.479427Z","title":"Algorithmic framework for model-based deep reinforcement learning with theoretical guar- antees","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.479427Z"},"links":{"cited_paper":"/paper/1807.03858","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:add1bd4a6e3c1b3e6e6fba3d91ac8b992dd03ba6f6cd9bb82b831e54ae38c408","observation_id":"f5d71691-64c1-4048-835c-aab0ea2216d4","resolution":{"observed_at":"2026-08-06T17:57:08.479427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.483171Z","title":"Generate your coun- terfactuals: Towards controlled counterfactual generation for text","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.483171Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:dda32c34df6d2523ef02e6c3a716f2e09713abb1991890e4eb35763e8d3ed519","observation_id":"86c3296f-8a0b-4494-a216-c99c090eb661","resolution":{"observed_at":"2026-08-06T17:57:08.483171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-06T17:57:08.486504Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.486504Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:432b9bdf7e9ba2c499c638f3d1c42d6b3233f930435fe06d46b353638bc1e6d4","observation_id":"967d34f2-379c-44df-968f-b47dced961f6","resolution":{"observed_at":"2026-08-06T17:57:08.486504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.489873Z","title":"Wedge: A multi- weather autonomous driving dataset built from generative vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.489873Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:f190664b69252ca270fc1ede8734f3f8fd00a0a9eb319cc6f15eeb3316460b1a","observation_id":"ae0b1977-1818-4b24-92df-e33a54894b01","resolution":{"observed_at":"2026-08-06T17:57:08.489873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.493621Z","title":"Emergent behaviors and scalability for multi-agent reinforcement learning-based pedestrian models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.493621Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a6975ebdcb1541efb64e7e13d60883a43b71f9e43569050efadec210ec066d00","observation_id":"c87c7111-c16d-41ca-a84e-a7d663fdeec5","resolution":{"observed_at":"2026-08-06T17:57:08.493621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.497033Z","title":"Independent reinforce- ment learners in cooperative markov games: a survey regarding coordination problems","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.497033Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:8c34a75164c849d7b10e5837e7de6b18026ade5ad5c0c246e788c6f16ccc0462","observation_id":"93bfe875-d155-4c5e-b3ec-dbd5b94dce25","resolution":{"observed_at":"2026-08-06T17:57:08.497033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T17:57:08.501109Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.501109Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:b0f03ef1b419baa07675b24b8e6c1955c61b2a6a5f6d3dccd1032e536c357ab5","observation_id":"c7916d12-dcb1-4332-92b9-d6207029d491","resolution":{"observed_at":"2026-08-06T17:57:08.501109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.505102Z","title":"Model-based reinforcement learning: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.505102Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:a83939337b13ed1665a53c24cdd8ced48fda1795fffb235c6c9728bd33978324","observation_id":"aff566c8-6b43-41e9-b5d0-0737073d5055","resolution":{"observed_at":"2026-08-06T17:57:08.505102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:08.508816Z","title":"ML-Plan: Automated machine learning via hierarchical planning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.508816Z"},"links":{"citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:c7a919650960d21ab3f468d3c8eded8fd7dbf30cfae3b296ce01f49096907cb6","observation_id":"4bb209d4-1c66-40c6-bc57-8cb734718e51","resolution":{"observed_at":"2026-08-06T17:57:08.508816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":180},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 180 outbound references and 1 inbound Pith citation observation for arXiv:2507.09495."}