{"as_of":"2026-08-22T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33c2ca8f67e6f56ac3455c31b75b62a6072e6c7b5c3e2b7579922fc33daee51b","coverage":[{"denominator":176,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:36:31.727662Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:00:39.290029Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:31:25.830730Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"cited_work":{"arxiv_id":"2504.21048","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.21048","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2504.21048 , year=","venue":null,"work_id":"65a51595-52a1-4e46-9d4c-a4e4444c23fe","year":null},"citing_paper":{"arxiv_id":"2605.08758","last_updated":"2026-05-09T07:40:35Z","snapshot_observed_at":"2026-08-11T13:03:06.914406Z","submitted_at":"2026-05-09T07:40:35Z","title":"Omni-scale Learning-based Sequential Decision Framework for Order Fulfillment of Tote-handling Robotic Systems","version":1},"reference_index":148,"source":"arxiv_source","source_observed_at":"2026-05-12T01:00:39.290029Z"},"links":{"cited_paper":"/paper/2504.21048","citing_paper":"/paper/2605.08758"},"observation_digest":"sha256:a6a93940ccb29f3c863b5e47696a5454f8b1113e3af82a2056a535dc1a8f6cce","observation_id":"3ebc976a-354d-4fc7-b518-7e500cbbceb6","resolution":{"observed_at":"2026-05-12T08:31:25.833724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.21048/citation-record","integrity":"/paper/2504.21048/integrity","json":"/paper/2504.21048/citation-record.json","paper":"/paper/2504.21048"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.251180Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.251180Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:18d6faee7f265bd37ba603a6a13e3cbd5b695bdbbbf25e968078c391dea6f695","observation_id":"93146fee-a45c-4616-ada5-da7afad255eb","resolution":{"observed_at":"2026-08-16T05:36:31.251180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.258029Z","title":"sn-aps.bst","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.258029Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:9836ff501efcac7d9af5849a37dc3267f0256911254a0ace7f90ac43aae163af","observation_id":"dfc346fb-a974-40b7-8ff1-9d1c390607db","resolution":{"observed_at":"2026-08-16T05:36:31.258029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.264011Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.264011Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e390aeae6790072eb6ee7e6cdb36cea5914d658c568e44badc911fdfda7dcd31","observation_id":"5679e43a-cb8d-4250-9a31-0dd4a5498d45","resolution":{"observed_at":"2026-08-16T05:36:31.264011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.269252Z","title":"sn-basic.bst","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.269252Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:ce2e5e6652de539357a88e440bd23d1d5a5a5619b6d0a11a23243dad71703378","observation_id":"792f9e9f-778d-45e5-a2e7-8ed3f603c48a","resolution":{"observed_at":"2026-08-16T05:36:31.269252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.274631Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.274631Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:958b5c39ceda857a5bf98a1fad08da781060030684b57dc25ca7073321783147","observation_id":"b2e1376b-a3f6-4353-b9a2-e35671a2f7e6","resolution":{"observed_at":"2026-08-16T05:36:31.274631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.280105Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.280105Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:bfa98f20c4968ea0b97e38389bd102f97bfce350645762d358bf92d46ef4f8b4","observation_id":"d1fc7499-9587-4096-9f79-fea6c6e7d83e","resolution":{"observed_at":"2026-08-16T05:36:31.280105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.285400Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.285400Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:160f59e2719892b7d12bd614c1a9611795052172cd144d58675474af42439a93","observation_id":"2c30ec3d-c696-454b-b14e-42b864d16821","resolution":{"observed_at":"2026-08-16T05:36:31.285400Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.291090Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.291090Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:4c2c3f32c0040be8dfd0a51607cf4328a0e870dfaf394717898c199bdc3c7c8d","observation_id":"7aac23f8-86f7-4165-b4c4-39d8f91d2795","resolution":{"observed_at":"2026-08-16T05:36:31.291090Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.296856Z","title":"sn-nature.bst","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.296856Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:63cf3d2bf96ec14ad7bf18faddb151c565d5e3b73adfedc57b0970f270efba56","observation_id":"4304094c-08d2-4679-a71c-e275051502c0","resolution":{"observed_at":"2026-08-16T05:36:31.296856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.302078Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.302078Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:721d4236309bdd1c63bed1656af8f24bed503108023a6647651dbb7736e15613","observation_id":"604d270a-cbd7-4368-b776-30e6950508ca","resolution":{"observed_at":"2026-08-16T05:36:31.302078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.307273Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.307273Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:b08bfffabdb762e7b7496c09bcbf2709ecdb884f77939acb0f0b5712b6843eb1","observation_id":"671780c0-80f2-4775-8bdf-87a4b7eb3240","resolution":{"observed_at":"2026-08-16T05:36:31.307273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.312488Z","title":"sn-vancouver-num.bst","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.312488Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:693fe0f1fe764efcb13d347fe8318b4eddb7e55c809c7463a1c624004429f702","observation_id":"9b39e256-1a12-44cf-af15-780ae7e5c834","resolution":{"observed_at":"2026-08-16T05:36:31.312488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.317632Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.317632Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:3bf204134769cab4f9d4d301c9108aaec204e648bb60e8de5eace1be28e5ccf0","observation_id":"d4a77e7a-94d8-48f6-90c4-0f0d0ec660c4","resolution":{"observed_at":"2026-08-16T05:36:31.317632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.322576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.322576Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:a092b4092a9b7ddcca0faf0ce5c3a748ca8480b334d3f33e685874530308386b","observation_id":"7d7256ac-4582-4637-bbf0-67aa9219e0c5","resolution":{"observed_at":"2026-08-16T05:36:31.322576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.327478Z","title":"Liu, M.A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.327478Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:3b2086e1dec82db3d1ab79ab2c777d6d00f0a43ea4843921e3fbd605d3520e56","observation_id":"c50dd511-0c6a-4bc6-9543-0699356adf2a","resolution":{"observed_at":"2026-08-16T05:36:31.327478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.332814Z","title":"Rastegar, and A.R","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.332814Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:5a6a3751e5df0735492d0cb490b35de450a51e8bec4e6c8573a880acb2fb80f2","observation_id":"2b0d893a-5760-4bab-ace1-f5db3013e6a4","resolution":{"observed_at":"2026-08-16T05:36:31.332814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.337550Z","title":"St-Hilaire, and T","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.337550Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:c6a2f868dd3c8c4e27104ebae74cb76fb11901b9e097925ca65ee71b5a464002","observation_id":"1464a8ca-bf36-4e82-a4c4-05616eb4a304","resolution":{"observed_at":"2026-08-16T05:36:31.337550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.342455Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.342455Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:1020db90153bd99ed530753df92615c56f042bdb09395de580eaca7262f37f9b","observation_id":"fc2c75c4-227c-4a2c-9fff-354d596b1440","resolution":{"observed_at":"2026-08-16T05:36:31.342455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.347254Z","title":"Abdellatif, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.347254Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:8542bf68d2eb73a7cc46b82fe6939bacedbfbe02101cfbdca4929d083459c8ca","observation_id":"6afddee4-88f7-469f-870c-9b05d2bfc4d1","resolution":{"observed_at":"2026-08-16T05:36:31.347254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.351955Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.351955Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:d84df30e1410c2b38d13020adbd4382c790c876c648f1547a9b7703a619a70fe","observation_id":"118b8396-8091-472b-8c82-6ce89a604c4c","resolution":{"observed_at":"2026-08-16T05:36:31.351955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.357566Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.357566Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:f8bf10c1c8fac6d54b467acb5053fc4c6c5cc09fab5d90d7c2df7d75cb2b5f89","observation_id":"c43d3950-07b4-4d78-bf4b-c7fcd2947cc2","resolution":{"observed_at":"2026-08-16T05:36:31.357566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.362363Z","title":"Kanitscheider, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.362363Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:916bc6bd158ab386d56331f5458413187e8610eca7e51f4268f9ad39c17a7559","observation_id":"bdcb167c-9bbe-4fd3-a659-d480f4d77586","resolution":{"observed_at":"2026-08-16T05:36:31.362363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.367028Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.367028Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:3aa5dfdecde9598d48a2f872d0a29fdc26199f04feda57da46291ae816927626","observation_id":"fb65ffef-e76c-4682-91e1-8d6f65e02b81","resolution":{"observed_at":"2026-08-16T05:36:31.367028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.371845Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.371845Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:4229deb40207f7a1637bd0bf57e04b79eb7e9c96fcf11adf62c9e074d33f1f2b","observation_id":"3d8657c0-1bbe-4e4e-a80e-cedb4c771f40","resolution":{"observed_at":"2026-08-16T05:36:31.371845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.376715Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.376715Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:d05d81364ff000a5fd27a30b9fd0a1bf7a0e135a8594333650f63a7c4da1ed0a","observation_id":"9be33e80-1c1c-4c3f-bb9b-3d937ed961bd","resolution":{"observed_at":"2026-08-16T05:36:31.376715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.381661Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.381661Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:270a238d2cc04c7fc7ed877ae03e9f467ac92e9148d88a84afc174d60c094283","observation_id":"6bc81a47-0f5f-4b23-a02c-db2a88b1e199","resolution":{"observed_at":"2026-08-16T05:36:31.381661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.386446Z","title":"Galinho, and J.P","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.386446Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:f380ae038d8c401f105f83004debd2fd0e54030fa311b893746406b57ffd28cc","observation_id":"2158cc69-6267-4373-9abe-1c7ee59386b5","resolution":{"observed_at":"2026-08-16T05:36:31.386446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.391268Z","title":"Malanchini, and A","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.391268Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:c60ad2bee26b7bbcd0317ef29e17007a00cb342679a7dbcca503bc9b37274a7d","observation_id":"d55717c7-707e-4265-96ea-092eac3666f3","resolution":{"observed_at":"2026-08-16T05:36:31.391268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.395768Z","title":"Morstyn, and M.D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.395768Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:906b7ab2a13e3e6225d79cb7a0335eeb1b26fa51508f8b6978780b76bcbe1ddb","observation_id":"9f815431-79c0-4891-8c96-40a054949ddf","resolution":{"observed_at":"2026-08-16T05:36:31.395768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.400533Z","title":"Hajidavalloo, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.400533Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e01486710efb83988da87fe757f29623fb6aa1bce2b0f583fd35257533396e02","observation_id":"83076d38-2bca-4a79-893c-d6356189af52","resolution":{"observed_at":"2026-08-16T05:36:31.400533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.405163Z","title":"G \\\"u nd \\\"u z, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.405163Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:05c2d7a4f5fe8eb2d66b9c797f6025d7a084da0c0435d82dbb834e4c152ce9bc","observation_id":"7bbb9462-3326-45d0-8e66-7ada19bfe84d","resolution":{"observed_at":"2026-08-16T05:36:31.405163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.409672Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.409672Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:0a67378c6b8f9b995d01199c4638af4973835fe7e229a937a54111a930fb21ab","observation_id":"5ac9b0c0-582b-465a-afc8-8ac0b8487675","resolution":{"observed_at":"2026-08-16T05:36:31.409672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.414309Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.414309Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:da727193e1643fac297ecb6f9bebd09c933048348bd35c55abdaecdb3ef46d3d","observation_id":"496b9cb1-1aef-46ce-ba86-0515b67cc690","resolution":{"observed_at":"2026-08-16T05:36:31.414309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.418915Z","title":"Carvalho, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.418915Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:10f00559802a70e5d3a465059b5a4dff904d217f970f2475e67acbc740402fa8","observation_id":"1901ad07-732e-4ae7-9de6-6d3e30ac4bc1","resolution":{"observed_at":"2026-08-16T05:36:31.418915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.424437Z","title":"Liu, and A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.424437Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:1ef9f2bbc25f31eb63f264ff627eb89a7c39e40ee1f1ce843ed5c2080c1b43ae","observation_id":"513716c4-0c52-45d3-a803-1727caa13c22","resolution":{"observed_at":"2026-08-16T05:36:31.424437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.428989Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.428989Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:95729b3927319db758e22f53d33bb0ccc9dd5f6d9dad0d35490a38158feece43","observation_id":"f1bc51c0-6d25-4e28-b0cc-005bc7cfbe5c","resolution":{"observed_at":"2026-08-16T05:36:31.428989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.433781Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.433781Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:ae96720caf165784f4205c2681eeb2ef43494eec97ec11dc89dfe23794053d37","observation_id":"bf399191-bd64-47b2-9bd8-8c16bd39d20f","resolution":{"observed_at":"2026-08-16T05:36:31.433781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.438675Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.438675Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:bce4d955f942bd70369b94bbbf0241664235df610a18b9e2cdf8fcc82f387df5","observation_id":"cc31b77d-bc3c-441d-8471-fd083fc64f09","resolution":{"observed_at":"2026-08-16T05:36:31.438675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.443421Z","title":"Liu, and A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.443421Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e85a8ac9d0afedadb62f9d57a6c871fea14086758802421878d82aded764a7a0","observation_id":"891791a5-2367-418b-a128-0ec10a898be4","resolution":{"observed_at":"2026-08-16T05:36:31.443421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.447929Z","title":"Yang, and Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.447929Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:94263f1284b81c4e9a39c04e24551e135346c0ca5d2a0f99ac19a9db5ec946aa","observation_id":"11b8d3c6-0914-44e8-93d4-a73e2db082b9","resolution":{"observed_at":"2026-08-16T05:36:31.447929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.452388Z","title":"Yang, and Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.452388Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:805e6f515dae26447f97891e0557445327f1364fdb619eeecb285062e472178a","observation_id":"34060aec-fd8e-490e-b020-3393ad11cc52","resolution":{"observed_at":"2026-08-16T05:36:31.452388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.457143Z","title":"Yang, and Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.457143Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:21d503b4e197cd737f06731a23a2210e03e4cc32459900a1f9070ea04b34b14f","observation_id":"20b8bd77-9fae-4a12-9390-869d2426cf8c","resolution":{"observed_at":"2026-08-16T05:36:31.457143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.461891Z","title":"Zhang, H.S.H","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.461891Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:74936cdc584c32a4f094d7a581e4518cd77835dcbda294fde195510aaf84b8cf","observation_id":"6c19a703-290f-4c4a-937f-69eb76695171","resolution":{"observed_at":"2026-08-16T05:36:31.461891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/1478-7547-10-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:32.161140Z","title":"Wagner, R","venue":null,"work_id":"26ae3212-26cc-4d09-9c31-c1c3e80bf576","year":2012},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.466427Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:55207d772fd80cf84be77f3da081aee77a68690ffbceab64b3b9c0215b34d0d2","observation_id":"007354d4-3b5b-4630-a853-6714caeb0a26","resolution":{"observed_at":"2026-08-16T05:36:32.166587Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.470981Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.470981Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:6d719317840b687c2392b24550007ce42122e7c94e8c38b0c2af1cd2730ca4e6","observation_id":"02b5be5f-25fc-411c-8de2-cf47fa12a98d","resolution":{"observed_at":"2026-08-16T05:36:31.470981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.475470Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.475470Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:b254c61b9c4c3f601399894a2792240929ccb375d34d50bae16c13b9abaa34a7","observation_id":"bfb63434-eaa0-429e-9a67-5adac5c25fa5","resolution":{"observed_at":"2026-08-16T05:36:31.475470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.480255Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.480255Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:9bb0d4281d4241157e3fd27defeb04164bb81b5c8814b7615e1c24ad74a1e985","observation_id":"fd8c286f-06a4-4955-b646-7429d59ebd05","resolution":{"observed_at":"2026-08-16T05:36:31.480255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.485012Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.485012Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:cbc396af9436e5b2774f84b12e1ad44a3cc889b6b44f125f5078f383266efa28","observation_id":"1a4e36db-a34b-4f52-ad38-68749e12076b","resolution":{"observed_at":"2026-08-16T05:36:31.485012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.489712Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.489712Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:83705c82ace52dd0552da730a865ce5a3e9a17a55e679de275497e331da25b62","observation_id":"01261c3d-f3ce-4056-b5cf-35c38130039f","resolution":{"observed_at":"2026-08-16T05:36:31.489712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.494433Z","title":"Bahrpeyma, and D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.494433Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:cab6a52e93cf1393152b1ade4ea04be4f47c493534c8de830a811fd27f56bc96","observation_id":"6324c280-d633-4920-9e56-ef7a97be5cfb","resolution":{"observed_at":"2026-08-16T05:36:31.494433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.499346Z","title":"Stephenson, and H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.499346Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:07c26508c7f475195f5274bf6a8de46eedfe8ccb7e47cb5a2a6103cb706a4e74","observation_id":"9085da9f-edd0-4c98-baaf-30be3feb44de","resolution":{"observed_at":"2026-08-16T05:36:31.499346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.504362Z","title":"Stephenson, and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.504362Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:c6538a34e9b33b3939ac88d594bfa30cab7dfd47431043fb8275dc1099588087","observation_id":"d4657edb-2d39-423a-8912-4cb7a99d7757","resolution":{"observed_at":"2026-08-16T05:36:31.504362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.508858Z","title":"Jin, and Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.508858Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:35d05aad49bbd62e28de4e87195a3bc5267f6ce68c3350fe1468cd975b51cbd0","observation_id":"5e7f3351-cc48-444a-a8cd-59928654b9ad","resolution":{"observed_at":"2026-08-16T05:36:31.508858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.513544Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.513544Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:981889675b374d1159e3d3ddd68773f7ce2e231db87f0b40e51a6dac05e9198e","observation_id":"3c0d1c10-28e2-436f-98c3-d6eb25355725","resolution":{"observed_at":"2026-08-16T05:36:31.513544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.518224Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.518224Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:c13c0f5a785897c288f0a4f6f66e7dff8b5f262a2cc4845d402165da3c6226c8","observation_id":"c82a190c-6279-4294-bb0c-830066f162be","resolution":{"observed_at":"2026-08-16T05:36:31.518224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.522760Z","title":"Zhang, L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.522760Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:2b42bef5fc844fd978fee0ac90f07f1d2f68463662e5c1c8f3289756f80c2a84","observation_id":"336de327-3660-4691-9363-d061dd23492d","resolution":{"observed_at":"2026-08-16T05:36:31.522760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.527489Z","title":"Zhou, X.S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.527489Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:096659c87611b528f0253d6641dd0b0203ffc36a456d1b5151992cf75d1fe348","observation_id":"1080f985-1a44-4236-8dd6-1db593ad4e23","resolution":{"observed_at":"2026-08-16T05:36:31.527489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.532115Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.532115Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e3d1073269a7c78783c559ae2ae6cf5514fcb17338bcc626cbcb12a35a03cff6","observation_id":"edd38162-fc68-4237-8487-6a529bd41df6","resolution":{"observed_at":"2026-08-16T05:36:31.532115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.536860Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.536860Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:0819502d6cc1e1d8fac71a0824e06ce51cb608bb31013bcdaff025bf41ade963","observation_id":"542b8bf3-a3ce-4066-b101-205cbd3feb7c","resolution":{"observed_at":"2026-08-16T05:36:31.536860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.541512Z","title":"Halgamuge, and R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.541512Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:3b1f387dacdd8a6ab612d7750cdcb8b1faa94b8a91bcfaea3f01dd8bd16b7b0a","observation_id":"adcc5e94-825f-4a2c-a690-1c0960c0f554","resolution":{"observed_at":"2026-08-16T05:36:31.541512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.546221Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.546221Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:776f03006810d99bab8c41ca513177c67d4435e7c14de89a4977a82103981996","observation_id":"2e246c6b-0c1b-4c5b-a0ec-88fb119bba80","resolution":{"observed_at":"2026-08-16T05:36:31.546221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.551170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.551170Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:98689f61f124d36d52eca962019595ab71df6290356a88b21ba85721630ad05c","observation_id":"14f7282e-807d-47bd-96ab-a87d7435f0aa","resolution":{"observed_at":"2026-08-16T05:36:31.551170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.555729Z","title":"Qiming, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.555729Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:9859fb44f2e892ed26c674f538c28d157d01079d24069da710c26f8ce8d0cc7b","observation_id":"762f611e-6c45-440b-95fc-777b11e162f9","resolution":{"observed_at":"2026-08-16T05:36:31.555729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.560321Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.560321Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:71867d9c76f768455e56446c7a2e850053f97bb39a7ecca5081ebd8d7601a401","observation_id":"57fd5483-6b56-423b-8b0c-e7fbbf9eabb1","resolution":{"observed_at":"2026-08-16T05:36:31.560321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.564860Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.564860Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:0d64c2ee0b913e92ef2f076b46d8bdfa2af934dc7df2f74c75fb4624afd51e7c","observation_id":"1d1bb655-8a36-4598-b4b4-5a239e04857d","resolution":{"observed_at":"2026-08-16T05:36:31.564860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.569622Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.569622Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:a96c264824f22b65a7b9052f081ed6aa0ccf6707f8c5e26d7b49e0fece59e285","observation_id":"202f945a-7bd7-4dc9-8c92-1bf230f2a884","resolution":{"observed_at":"2026-08-16T05:36:31.569622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.574432Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.574432Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:756201b09f7f648d77ace35ba8de90968287889480f1ad0cb810dc059e8dbcf4","observation_id":"becac456-b324-4a63-85cf-804ee6c756b7","resolution":{"observed_at":"2026-08-16T05:36:31.574432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.579004Z","title":"Chang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.579004Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:eb023a052c01ee817957e650be353c205b3456019f5522e3ef18baa64eeb405a","observation_id":"5fb7a95d-5dcc-4759-bc81-0b2f52969068","resolution":{"observed_at":"2026-08-16T05:36:31.579004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.583558Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.583558Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:7cb53d012e36375c0d8e3f861c2a9516e8ed02a2cb8eca61e38bd1344674224e","observation_id":"b4dfbeef-6c01-4a36-b5f8-97f5124f2344","resolution":{"observed_at":"2026-08-16T05:36:31.583558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.588149Z","title":"Abolhasan, W","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.588149Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:b61f0630b40bca57d3fef9266f44a213d9a894236dde96b02bb19130dddaae20","observation_id":"81129561-58a4-4e48-9068-9f8591a690f5","resolution":{"observed_at":"2026-08-16T05:36:31.588149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.592726Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.592726Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:533def46fd996757aa60ea635006fb022250677c4c8da7da5204489833a9cfb4","observation_id":"f11951b3-8b0c-4e53-8947-ed89d2e31ad3","resolution":{"observed_at":"2026-08-16T05:36:31.592726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.597531Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.597531Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:c73a0690adbc4f6d80af0682f06d11d922c1b99be672b692450546c2d2a0919e","observation_id":"63d0b257-762d-454b-8db4-53487a51b5a0","resolution":{"observed_at":"2026-08-16T05:36:31.597531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.602170Z","title":"Gelatt Jr, and M.P","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.602170Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:75c3a11e6dce7ffbf3e4fb35b18b36302db2288af35e27d5b8008e759609dd5e","observation_id":"a6e6ccaa-dc85-481d-a0a5-5f469743770c","resolution":{"observed_at":"2026-08-16T05:36:31.602170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.606869Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.606869Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:b3c9b3d42e0cadf5e8cca7127359bc3d1014f2a5670d8a43c5d5766d980a3b31","observation_id":"c4058f2b-2b07-49f3-9b71-54bbed92a40f","resolution":{"observed_at":"2026-08-16T05:36:31.606869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.611748Z","title":"Atmis, and H.H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.611748Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:4c4b3258063c2c95a76826773e2fc72f7bf157e50ebad68e25c5b296d13a6a2d","observation_id":"46a6d67f-00fb-4d83-919e-df2406b47eec","resolution":{"observed_at":"2026-08-16T05:36:31.611748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.616698Z","title":"Kakkar, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.616698Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:6786c6efcc5eb5085ead4fb87819848c4361a869509ce35fe589bad8c1a35982","observation_id":"b592165d-36de-4fd4-93be-a6a0293513a0","resolution":{"observed_at":"2026-08-16T05:36:31.616698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.621273Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.621273Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:b11c58634d8221a40cefe2a40e902dde8793f4a1ed5517907a1c568cd9943ef3","observation_id":"8663ada8-02e0-4bba-b4a2-24514e550d4c","resolution":{"observed_at":"2026-08-16T05:36:31.621273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.625878Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.625878Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:af4eb56031add511b24c4d9eb4cf91a20eaad22a507c5f60928a845b3363fc6f","observation_id":"ec55de39-0306-47c7-b281-f05a50a8685f","resolution":{"observed_at":"2026-08-16T05:36:31.625878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.630529Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.630529Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:fd4ebd9d85f1b64b5f5e12a456ea20325811d24db7a0235a0b11fc8a6a80716d","observation_id":"41d87f6b-066c-408f-88d9-4c9a2bd6acc5","resolution":{"observed_at":"2026-08-16T05:36:31.630529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.635140Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.635140Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:10988de0c6df489c657bf4c5adef4a7704e34243176af13de95983c08b1059e5","observation_id":"5dd0940a-9a1d-4355-bb62-1116c57b4491","resolution":{"observed_at":"2026-08-16T05:36:31.635140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.639795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.639795Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:79437fdd50ce95f086e60e9b7946442a913417b0c3ee656b69dae98456cc6196","observation_id":"9731e203-aec1-4273-8259-c687ea2ffe0a","resolution":{"observed_at":"2026-08-16T05:36:31.639795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.644285Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.644285Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:28f56a4aa1084ee7ed8bcbba2fabf922a71fdbc67eaeb3fcc07277253310c108","observation_id":"a3924474-2a56-44f0-bdd7-35aedf7881cb","resolution":{"observed_at":"2026-08-16T05:36:31.644285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.649196Z","title":"Zhang, and J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.649196Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:4cc8474a3bd1daa174f693a61b11c1953de1bef00a68c323b3a8dc3a6ae24c3f","observation_id":"dad569d5-7dc7-4b65-919a-bf6560b50a6c","resolution":{"observed_at":"2026-08-16T05:36:31.649196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.653835Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.653835Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:cfe6ddfdc9be25645d05ca88af2bfad1488871e023c866f528e6c9f68bf2d917","observation_id":"9568b77a-d36b-4e90-9c0b-8f7188ab5c98","resolution":{"observed_at":"2026-08-16T05:36:31.653835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.658358Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.658358Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:2d11ee6fd4003c00ff54f74a1984431d364667b23b9f60f741d5f524d7e9f761","observation_id":"019e8c1d-dfa5-4cdf-8616-06ba3e38635c","resolution":{"observed_at":"2026-08-16T05:36:31.658358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.662932Z","title":"Zhang, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.662932Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:d494b8a350d8043fd92e9165161ee5478479fe5218d373a05677ae6460befe4d","observation_id":"6e34a804-9fac-44e8-9292-a3d0ff4f2747","resolution":{"observed_at":"2026-08-16T05:36:31.662932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.667372Z","title":"Xiang, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.667372Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:9d5b442207a63838ff05400d05543b712de47038bb7951a046dbd9af325a8131","observation_id":"f7de4016-ae5a-4da9-9046-dc39afb9c60d","resolution":{"observed_at":"2026-08-16T05:36:31.667372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.671911Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.671911Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:2954a19dc9e34d6b0e73b6b1d92dc18e1a924df97eae1d67c2646832cf34c1ab","observation_id":"aeb91223-d133-4bb1-b05d-c305ac382a34","resolution":{"observed_at":"2026-08-16T05:36:31.671911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.676343Z","title":"Alizadeh, I","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.676343Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:367bdf86e5ce746553f5bee67f7c6d37304b7a04770c4f32d745e7252603e454","observation_id":"365449f5-f4e0-4867-9d4e-38d6d480f7dd","resolution":{"observed_at":"2026-08-16T05:36:31.676343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.681065Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.681065Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:f08fbb1c9e2c196cabdedbf567cc49d6734520bc80231b0f9393e4b9d4176f58","observation_id":"acbc198d-e316-4836-a759-86ffc6a99ddc","resolution":{"observed_at":"2026-08-16T05:36:31.681065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.685847Z","title":"Badia, M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.685847Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e3cf27ba9a06c0ea889e0865036c0a7bd7049a6e544172ff29ecbd21f6199287","observation_id":"e59af907-0e63-4ea9-856f-9309f253b61a","resolution":{"observed_at":"2026-08-16T05:36:31.685847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.690472Z","title":"Sydir, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.690472Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:0b8cc16d3b1d401f9ff1db07f1c367d27651817772b5c15e7bfd9c5c9414147b","observation_id":"11ccbfab-c8bb-431e-bfd9-df57211ad94e","resolution":{"observed_at":"2026-08-16T05:36:31.690472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.695051Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.695051Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:35eef3199c5ef308aab174996dd39c8267954991990a06743873b6cf53ee041a","observation_id":"b01e859a-c1ee-4e82-96ff-8af4494549d2","resolution":{"observed_at":"2026-08-16T05:36:31.695051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.699690Z","title":"Nguyen, and S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.699690Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:7c404bc9a251840da700ec0967bf44b850f9eab18c2f69df4ff007b6db1f5214","observation_id":"d22ec2e0-82fe-486f-9e2b-9eb71cb93afd","resolution":{"observed_at":"2026-08-16T05:36:31.699690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.704289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.704289Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:3dea27ae7d0c3046e3f4b432728ff076d1d3af3af0cd8bb1ef990246db5c9c56","observation_id":"5648b51e-e906-4e4b-b992-af014a60fd71","resolution":{"observed_at":"2026-08-16T05:36:31.704289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.708900Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.708900Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:284b856726d4e532d888a7430a4d6225786126a1f73a8236c4cc9ac659f80b45","observation_id":"3ae8f9b7-29c6-4507-9cf3-99c1e1b0e4a2","resolution":{"observed_at":"2026-08-16T05:36:31.708900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.713477Z","title":"Amato, et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.713477Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:13e8971900f4843d1c3985eae7847f14bcd0b40fc7801d03ef1103052ea62742","observation_id":"362c49b7-aca2-472d-9cf4-615672734432","resolution":{"observed_at":"2026-08-16T05:36:31.713477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.718048Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.718048Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:a3e8756631529dc405ef80545ce8fd6480ce3466730e29b5d92ceeab3096628f","observation_id":"3e26a2a2-efd0-4af0-9599-dc1a7538d888","resolution":{"observed_at":"2026-08-16T05:36:31.718048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:31.723054Z","title":"Javan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.723054Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:bd87ffde600b470bedc9184aa0c9599c1a641d5457ee6e689a7ee53e819b4b43","observation_id":"cdd7582e-cfc3-44c1-a0b2-a5da40023d0b","resolution":{"observed_at":"2026-08-16T05:36:31.723054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:36:33.669954Z","title":null,"venue":null,"work_id":"8ba222b6-8742-411b-9f60-dcab717a4730","year":2008},"citing_paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-16T05:36:31.727662Z"},"links":{"citing_paper":"/paper/2504.21048"},"observation_digest":"sha256:e20ec663d705d3cadd98144cf506a37aeb3f67dd30991e4fa54ec26904fe9ffa","observation_id":"530c115b-01b3-4dc5-b69f-776f095fea95","resolution":{"observed_at":"2026-08-16T05:36:33.674602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.21048","last_updated":"2025-04-29T00:18:31Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-16T05:29:47.514751Z","submitted_at":"2025-04-29T00:18:31Z","title":"Multi-Agent Reinforcement Learning for Resources Allocation Optimization: A Survey"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":176},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 100 of 176 outbound references and 1 inbound Pith citation observation for arXiv:2504.21048."}