{"as_of":"2026-08-21T05:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbb03763ab6b05e6ff8a68cba79c8b6702569562c87001481e8adf61577371eb","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:02:24.707037Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.20039/citation-record","integrity":"/paper/2506.20039/integrity","json":"/paper/2506.20039/citation-record.json","paper":"/paper/2506.20039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.047041Z","title":"Stable matching with uncertain linear preferences","venue":null,"work_id":"ce3bcc0b-b27a-4774-a682-5130d29ee7c0","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.594430Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:9d7e87da2f6f2c2111d3d900c2cdc1a16bbd580bf01ac4206f4c4e983ad371c1","observation_id":"7a5639bf-cd14-43b5-a012-a0a69ed01672","resolution":{"observed_at":"2026-08-06T23:02:25.050215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.037769Z","title":"College admissions and the stability of marriage","venue":null,"work_id":"ea99d34d-3700-4e55-bba4-369c89b8580c","year":1962},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.598695Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:f8e31fa505a81fb8910669f51638215151c78cad5fcd0a5c498f8550cb0a4657","observation_id":"46769786-b675-40a3-a040-f7aa58ebd7ad","resolution":{"observed_at":"2026-08-06T23:02:25.041145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.029037Z","title":"Hypernetworks","venue":null,"work_id":"996de28a-4a5c-412c-878c-e7690744959a","year":2016},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.602195Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:6eb54bfd277ebb1efe5d4ac75e390f36be9222a326975584786b54a715f77e84","observation_id":"b3eac34b-3100-42c6-bac9-33fdde0e2e1e","resolution":{"observed_at":"2026-08-06T23:02:25.032248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04376","last_updated":"2024-10-14T23:37:37Z","snapshot_observed_at":"2026-08-17T17:54:31.958286Z","submitted_at":"2024-10-06T06:47:53Z","title":"Putting Gale & Shapley to Work: Guaranteeing Stability Through Learning","version":2},"cited_work":{"arxiv_id":"2410.04376","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04376","snapshot_observed_at":"2026-08-06T23:02:24.812907Z","title":"Putting Gale & Shapley to Work: Guaranteeing Stability Through Learning","venue":"cs.GT","work_id":"6e12306c-7b1b-4abd-8fc0-d480c7096081","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.606383Z"},"links":{"cited_paper":"/paper/2410.04376","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:abfa21893c57a3b32443e3610f2f9666ce345d8244858dfaaf2aa52f05e71fc5","observation_id":"b12e2aae-af6c-441f-9dfa-84008a9a6a11","resolution":{"observed_at":"2026-08-06T23:02:24.816273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04222","last_updated":"2021-06-11T18:53:47Z","snapshot_observed_at":"2026-08-10T11:03:34.596270Z","submitted_at":"2020-06-07T18:28:41Z","title":"Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2006.04222","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.04222","snapshot_observed_at":"2026-08-06T23:02:24.801049Z","title":"Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"94fd776f-1389-4981-af85-15fb663060f0","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.610463Z"},"links":{"cited_paper":"/paper/2006.04222","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:a382814f508830494c4cc8501bba4986a3c1df66dbf9d3db864c9e334fdbb99c","observation_id":"e94a828c-58e2-4c64-8e4a-e45361a16340","resolution":{"observed_at":"2026-08-06T23:02:24.804543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.019101Z","title":"Randomized entity-wise factorization for multi-agent reinforcement learning","venue":null,"work_id":"7ac00950-4f17-49a1-a922-2917c6c7fadf","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.614253Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:16fcdf5f3fa83343323602b1ebd736870985c3f432d24d55c74b9b30868c77fa","observation_id":"dab9c7a8-6212-41bd-8a69-735047f87efe","resolution":{"observed_at":"2026-08-06T23:02:25.022626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.008180Z","title":"Supplementary material: Randomized entity-wise factorization for multi-agent reinforcement learning","venue":null,"work_id":"3532d31f-a37d-48d1-93db-433249eb2e48","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.618001Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:d9bc72e5eea4f056fdff75f8deb94ba9bcbb726c8f85e4c8ff62d0a2da24f252","observation_id":"3435bb02-3a28-4653-920e-dc5c22e034e9","resolution":{"observed_at":"2026-08-06T23:02:25.011662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.997627Z","title":"Improved bandits in many-to-one matching markets with incentive compatibility","venue":null,"work_id":"d861829e-4b1d-423f-874f-d03dbe23c841","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.621332Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:013ab1d091d677997343141747e19c7939e1ca4411649e8db3498e5377ec4461","observation_id":"d47118d0-70bb-4634-9c74-dd1881eff4e8","resolution":{"observed_at":"2026-08-06T23:02:25.001442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.987444Z","title":"a fer, Andrew Wing Keung To, Kuan-Ho Lao, Murat Cubuktepe, Matthew Haley, Peter B \\","venue":null,"work_id":"ef157c12-20d3-41a8-bc15-5800a7ee9f5a","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.625364Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:ac7d1ff711400c41a30775ab0290478a8eda900624809f823062d771b6af4fc3","observation_id":"48877d1c-c5e1-49c7-a250-fe9c15168b0b","resolution":{"observed_at":"2026-08-06T23:02:24.991008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.978438Z","title":"Traffic control via connected and automated vehicles (cavs): An open-road field experiment with 100 cavs","venue":null,"work_id":"22302a46-cd2b-41a8-9fca-29007766c680","year":2025},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.629894Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:4d0a65fe1fca25c7cff59a7b6689514ee6123559f456f608bc695da3f1c4152a","observation_id":"11642d83-dec9-4ef0-b41c-a368e80bbd12","resolution":{"observed_at":"2026-08-06T23:02:24.981794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.967812Z","title":"Self-improving reactive agents based on reinforcement learning, planning and teaching","venue":null,"work_id":"7142aa8a-3f34-4056-8756-1739de263eef","year":1992},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.633163Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:b11a28ccc3f001d7707e074bad2d8dbb3aa87346ca8422c28c5d82abc7c5ecc0","observation_id":"f2658eeb-cf3b-4a2e-b0fd-10e43b7393c3","resolution":{"observed_at":"2026-08-06T23:02:24.972196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.958164Z","title":"Coach-player multi-agent reinforcement learning for dynamic team composition","venue":null,"work_id":"4d0f4a28-0b27-4edc-8060-2d12f9795588","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.636343Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:1cfbd9dada7594d0ec635b649b8d93a5b2995d1a5230e5c8c214eb44c04df115","observation_id":"074fbe33-7275-424d-b5c2-707fa11fb79c","resolution":{"observed_at":"2026-08-06T23:02:24.962122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.949150Z","title":"Competing bandits in matching markets","venue":null,"work_id":"496625f5-2bbf-49c8-8397-d58caf9a7f07","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.640108Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:51255b554b4dec87d4cab9d4a25f6ba3d64a304fbeb1b5a520b8113492e0e9be","observation_id":"f04278ee-2dca-4be7-8668-28abe5cb1af1","resolution":{"observed_at":"2026-08-06T23:02:24.952425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.643277Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.643277Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:6ed7f0a9b75de46ebf7adcc141f0593193d6683dbb78b2369017bd7fdc23ce8f","observation_id":"98c76698-e626-437e-ab70-29ce687b52ae","resolution":{"observed_at":"2026-08-06T23:02:24.643277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.646615Z","title":"A concise introduction to decentralized POMDPs, volume 1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.646615Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:a3ff5dad9fee011e01bfc5d576f3ab8ad1aa6e2f46c1b2fcbf41b094c046ba6d","observation_id":"ec4aa29f-00a0-4ba2-91cc-cd15e4de6e4a","resolution":{"observed_at":"2026-08-06T23:02:24.646615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.927062Z","title":"Vast: Value function factorization with variable agent sub-teams","venue":null,"work_id":"55e7ecaa-9411-465c-a960-a160000a4f54","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.650349Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:7c1336f2f1f3bd091ae0e54080f93ab0399b53373c4cf309455ae75909cface0","observation_id":"faf24d3a-6bef-4210-af83-591500930fd0","resolution":{"observed_at":"2026-08-06T23:02:24.930833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.916072Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"2f646c52-2832-4ad1-9ac6-a1f73d2b0775","year":2018},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.653564Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:30dc81b234929f7ddde579f77e1abc0d2b8dde1de30e3d02630b9823256931a3","observation_id":"b0c198d2-9533-4526-acaf-86a06819ec17","resolution":{"observed_at":"2026-08-06T23:02:24.919816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.656644Z","title":"The evolution of the labor market for medical interns and residents: a case study in game theory","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.656644Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:cae7f2f28736a834b0041bef5754036952dd78d31fa4c79f326f7b721286d625","observation_id":"b03041e7-9959-45ee-8da9-140caa03d69b","resolution":{"observed_at":"2026-08-06T23:02:24.656644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.659867Z","title":"The redesign of the matching market for american physicians: Some engineering aspects of economic design","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.659867Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:5f39d5cf4320c854bb7e50785ac80cd9fe192a9add721e38294fef5bed1b67a3","observation_id":"06b10604-25c5-4091-bfbd-c09cfbb03418","resolution":{"observed_at":"2026-08-06T23:02:24.659867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-20T09:24:13.203173Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T23:02:24.663940Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.663940Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:1b9ad5836ab7024e53c21d2a2e101ca18fd771c476941dc90f2561bee225676a","observation_id":"bc81f89e-a19b-4baf-ac9f-ab4709027df4","resolution":{"observed_at":"2026-08-06T23:02:24.663940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.896037Z","title":"Multi-agent common knowledge reinforcement learning","venue":null,"work_id":"6ea5b490-af0d-4ab5-80ff-18d7002685d3","year":2019},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.667629Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:cf51568683a2f4ba2831667f2f0996f642bdff2e8066def5db30721e8756f525","observation_id":"ada18395-8398-4d1a-a694-79c060c82b58","resolution":{"observed_at":"2026-08-06T23:02:24.899257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.887032Z","title":"Self-organized group for cooperative multi-agent reinforcement learning","venue":null,"work_id":"9612c55f-004b-41a8-90dd-29d566d8db65","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.671392Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:0ee1de0ffdabb1f3b9bedba364b56b8c4b7be797c14882be6a3716e67c7ceee3","observation_id":"f4faa8b9-647b-4e8e-89f9-ba215c9f7986","resolution":{"observed_at":"2026-08-06T23:02:24.890617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.876306Z","title":"Complementary attention for multi-agent reinforcement learning","venue":null,"work_id":"77887c73-6712-4cec-a805-dad21980b987","year":2023},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.675025Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:c7c71c9935a6d4c6233f3eaa93b1a68dc070addca4622e73caf426901d283609","observation_id":"ed8dc84d-6866-4c25-9f4d-c70d3531a74c","resolution":{"observed_at":"2026-08-06T23:02:24.880095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-06T23:02:24.677906Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.677906Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:a4c2cd506c0a5c2c2a6c56709b698df92c17d800fdc83780d5e1b6509ee6408b","observation_id":"ca2d4e57-492d-4b92-bb8b-f21c5dd1636b","resolution":{"observed_at":"2026-08-06T23:02:24.677906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01523","last_updated":"2020-10-04T09:20:59Z","snapshot_observed_at":"2026-08-16T19:16:04.362262Z","submitted_at":"2020-10-04T09:20:59Z","title":"RODE: Learning Roles to Decompose Multi-Agent Tasks","version":1},"cited_work":{"arxiv_id":"2010.01523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.01523","snapshot_observed_at":"2026-08-06T23:02:24.769361Z","title":"RODE: Learning Roles to Decompose Multi-Agent Tasks","venue":"cs.LG","work_id":"11bf5ead-4409-4dba-a1c7-4381ac45b91f","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.681242Z"},"links":{"cited_paper":"/paper/2010.01523","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:7a1f7dfd55e160e987aba355e2c1b61b3169a3a0bc1f89bb4f0145e0f589e3ff","observation_id":"c80fa642-2190-4b68-9251-4bc3e882a074","resolution":{"observed_at":"2026-08-06T23:02:24.772871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.865280Z","title":"Bandit learning in many-to-one matching markets","venue":null,"work_id":"9c053420-bce0-4540-bfa4-9bc1233b9e9b","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.684315Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bcc966c63142e7e8d91d3e79499009fd326999678e893821dfda797a7be4bcf0","observation_id":"9060c47b-6fa1-4cdf-9415-78ce84c183be","resolution":{"observed_at":"2026-08-06T23:02:24.869213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.855844Z","title":"Mutual-information regularized multi-agent policy iteration","venue":null,"work_id":"eaa94b52-e389-4413-98b1-1f2b9d8bcbc5","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.687037Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:b87fc2c4729c270379bc7fa393731e95f6550d354e57f2973dd2656f9929ab9e","observation_id":"97288320-c884-49c6-bae7-fbb21fb06501","resolution":{"observed_at":"2026-08-06T23:02:24.859040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-20T08:43:39.407075Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-06T23:02:24.690287Z","title":"Differential transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.690287Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:5ad94217207d01953ac6efe22e63631aae2dc5b732f7cf451f3cb5745d0a2329","observation_id":"c503f879-3746-428b-b69b-6e01fede1f7c","resolution":{"observed_at":"2026-08-06T23:02:24.690287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.846126Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":"f2b8de0b-97f2-40ef-a3b3-a58e7b6f2177","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.693264Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:7a662a1257867ce800ad6cbeae5ab0836f4e6b7e23d4ec06c4ce6ca27d3cfdb4","observation_id":"df51810c-7d7a-4e63-86a5-5ac8f72de928","resolution":{"observed_at":"2026-08-06T23:02:24.849716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.836828Z","title":"Automatic grouping for efficient cooperative multi-agent reinforcement learning","venue":null,"work_id":"17bb0315-674e-4d00-875f-7b1d9c26c10a","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.696185Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:31f8e227cf8f498c06ac70b1f4f25d76d16e976b328481348db1c10db6fcfdf0","observation_id":"c0cdff10-c6fa-4fd4-b3c1-999bbac6c4e7","resolution":{"observed_at":"2026-08-06T23:02:24.840129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.08531","last_updated":"2020-10-16T17:42:11Z","snapshot_observed_at":"2026-08-18T06:48:06.221620Z","submitted_at":"2020-10-16T17:42:11Z","title":"Multi-Agent Collaboration via Reward Attribution Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.08531","snapshot_observed_at":"2026-08-06T23:02:24.699200Z","title":"Multi-agent collaboration via reward attribution decomposition","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.699200Z"},"links":{"cited_paper":"/paper/2010.08531","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bd4d58f2ab97a706035a4f0635419dfcbc0fd1021f9c20b2b492c1134408f8cd","observation_id":"7831cae8-b698-456b-b2b7-ef239124daef","resolution":{"observed_at":"2026-08-06T23:02:24.699200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.827877Z","title":"Decentralized two-sided bandit learning in matching market","venue":null,"work_id":"7652d27f-baf3-43b4-a948-1a102ad838ef","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.701863Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:766719813ad49404f0b94ddbd4237c491aab47dc2fcf3fe32013fdf68f2a18fa","observation_id":"74d00d99-fcb3-4167-8165-a11aea147ea3","resolution":{"observed_at":"2026-08-06T23:02:24.830828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08021","last_updated":"2024-07-10T19:59:59Z","snapshot_observed_at":"2026-08-16T13:35:17.915151Z","submitted_at":"2024-07-10T19:59:59Z","title":"Field Deployment of Multi-Agent Reinforcement Learning Based Variable Speed Limit Controllers","version":1},"cited_work":{"arxiv_id":"2407.08021","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08021","snapshot_observed_at":"2026-08-06T23:02:24.735774Z","title":"Field Deployment of Multi-Agent Reinforcement Learning Based Variable Speed Limit Controllers","venue":"cs.MA","work_id":"6058e7cd-65e0-48b0-adca-e32f8863d81b","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.704454Z"},"links":{"cited_paper":"/paper/2407.08021","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:927dbbd8716d10fa016e61ea102808c3627a52082b23130f8eaabd92a2d062bc","observation_id":"67482f99-fa48-4f50-be2f-7b43f3202e1e","resolution":{"observed_at":"2026-08-06T23:02:24.741328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.707037Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.707037Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:414eca7da19086e04cf302a90d46353b72be89de7eefcd76488643ad81c055f7","observation_id":"1156f9e6-8de7-4150-8229-83f3eadb02b5","resolution":{"observed_at":"2026-08-06T23:02:24.707037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-13T12:19:25.920456Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2506.20039."}