{"as_of":"2026-08-15T10:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84dc6853bc74d3f70fbac68aca56320b8f900442dd7f5d623c62b63386883710","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:02:18.838862Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.06554/citation-record","integrity":"/paper/2501.06554/integrity","json":"/paper/2501.06554/citation-record.json","paper":"/paper/2501.06554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1609.05140","last_updated":"2016-12-03T02:47:51Z","snapshot_observed_at":"2026-08-14T21:59:38.551417Z","submitted_at":"2016-09-16T17:05:55Z","title":"The Option-Critic Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.05140","snapshot_observed_at":"2026-08-10T21:02:18.674067Z","title":"The option-critic architecture","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.674067Z"},"links":{"cited_paper":"/paper/1609.05140","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:1ae0dfc7f3d0f9d608c3fd2d3d241749f4b6bd14d96a02435423bc697424aaae","observation_id":"eadc3631-0158-434b-89ca-ae7084e7a4f3","resolution":{"observed_at":"2026-08-10T21:02:18.674067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12825","last_updated":"2020-03-19T23:11:08Z","snapshot_observed_at":"2026-08-14T17:58:52.195808Z","submitted_at":"2019-11-28T18:38:19Z","title":"Option-Critic in Cooperative Multi-agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12825","snapshot_observed_at":"2026-08-10T21:02:18.679710Z","title":"Option-critic in cooperative multi-agent systems","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.679710Z"},"links":{"cited_paper":"/paper/1911.12825","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:8697b311b938685f5b6ad44e7767ef012cc68ca9a4dbcc81bad8eadf6e6b05ab","observation_id":"0fea0433-c780-4c95-9865-f9908bac73d3","resolution":{"observed_at":"2026-08-10T21:02:18.679710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02628","last_updated":"2022-01-07T18:44:28Z","snapshot_observed_at":"2026-08-13T17:02:48.729255Z","submitted_at":"2022-01-07T18:44:28Z","title":"Attention Option-Critic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02628","snapshot_observed_at":"2026-08-10T21:02:18.684622Z","title":"Attention option-critic","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.684622Z"},"links":{"cited_paper":"/paper/2201.02628","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:87f5106c235561591a049f128ad4ec09d91616550fdba74ebedd3faa546a4e3c","observation_id":"f5ecb7a5-0afa-4c58-a1d6-afedcb1734fd","resolution":{"observed_at":"2026-08-10T21:02:18.684622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.296180Z","title":"Dynamic planning in open-ended dialogue using reinforcement learning, 2022","venue":null,"work_id":"1f2e7fb5-e4a9-4e57-bd53-762864c7ec76","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.694553Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:ea055dade5d08df5d804ea49a9a4345cf44f1348c07514b4d533d8570f968103","observation_id":"95d6cceb-71fc-4029-b7cc-d00353e345d1","resolution":{"observed_at":"2026-08-10T21:02:19.303210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.271396Z","title":"Handbook on agent-oriented design processes","venue":null,"work_id":"0ee21d84-8742-4e2c-bf51-024e3b8a6545","year":2014},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.701957Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:bc49d0c94260a1ec34a79695a3b6811ccf8a295a6f900e326ba1516418551219","observation_id":"6c0a99da-a5ad-4ac9-a9e3-1e271965f52d","resolution":{"observed_at":"2026-08-10T21:02:19.277212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.252618Z","title":"Multi-agent deep reinforcement learning: a survey","venue":null,"work_id":"132e7e67-a5d8-4292-8945-c064f0047e33","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.707714Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:dc3a6a7248845ea4bfc5bdecdb260668e9d4b23c0c1b792bfcc0193c9ec8174f","observation_id":"083f9d7f-3773-4241-bcaf-0371ef7eb66f","resolution":{"observed_at":"2026-08-10T21:02:19.258403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05599","last_updated":"2022-05-13T22:27:11Z","snapshot_observed_at":"2026-08-15T03:51:56.975744Z","submitted_at":"2022-05-11T16:16:07Z","title":"Two-sided matching with firms' complementary preferences","version":2},"cited_work":{"arxiv_id":"2205.05599","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.05599","snapshot_observed_at":"2026-08-10T21:02:18.954117Z","title":"Two-sided matching with firms' complementary preferences","venue":"econ.TH","work_id":"ce160ba4-e670-44a5-9282-f93e84f69c59","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.713199Z"},"links":{"cited_paper":"/paper/2205.05599","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:ca134318766081554b76e2c1f4739485721403e0c9168d2ef1f07d745bf799f1","observation_id":"c158bcc2-96ad-413d-a973-cabd98069dd6","resolution":{"observed_at":"2026-08-10T21:02:18.959877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.228420Z","title":"Emergence of division of labour in halictine bees: contributions of social interactions and behavioural variance","venue":null,"work_id":"479d997a-cf6b-4168-b084-84092c2250d7","year":2005},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.722528Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:e562cb1aee9ec76082c48df7f9fa200d0eddd9eaf15c4b25f1b20509aa320a2b","observation_id":"b583ae01-4be9-4f64-a809-2756a559dd15","resolution":{"observed_at":"2026-08-10T21:02:19.235230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.209502Z","title":"Multi-agent deep reinforcement learning with type-based hierarchical group communication","venue":null,"work_id":"84303e5d-86f1-4312-a860-6ddee6c0d9c6","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.729786Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:1b1cf72696e26d4a29c90fba6065cdee0f1ac01caed805b57527f1c90146679a","observation_id":"83cdcd13-c859-4f58-88fb-bdaa6365972d","resolution":{"observed_at":"2026-08-10T21:02:19.215155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.184273Z","title":"Multi-agent reinforcement learning as a rehearsal for decentralized planning","venue":null,"work_id":"af623241-5209-4ee0-a2bb-2834832aaa43","year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.737992Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:4179c07b371a13d2051ed00c5c1de89e64eb873b26e853bd730cf78a9155cc7c","observation_id":"090d9cbc-c6f9-4f6b-a59b-da3d7fd0a000","resolution":{"observed_at":"2026-08-10T21:02:19.190680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s20247094","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.913467Z","title":"Reinforcement learning-based joint user pairing and power allocation in mimo-noma systems","venue":null,"work_id":"274b0ae5-fec5-4410-9ecd-1e7a99ca4fed","year":2020},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.744243Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:25b068007601586d36bfe781d0fee79764839e5813d5972a3b13b0bb52194179","observation_id":"431133cc-3620-43dd-a3e7-2becf05f7e7b","resolution":{"observed_at":"2026-08-10T21:02:18.918637Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.163168Z","title":"Role-based modeling for designing agent behavior in self-organizing multi-agent systems","venue":null,"work_id":"1f64e819-10c7-48b5-a033-cb84b0f1a375","year":2018},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.748639Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:7cc969ac8ef74eef0f1ce6ec45a7330092b7fbb7db7ccb7c6c193e5419a322fa","observation_id":"e289dd3b-78f5-4d0e-9483-30ed71682821","resolution":{"observed_at":"2026-08-10T21:02:19.168675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.146729Z","title":"Jordan, and Zhuoran Yang","venue":null,"work_id":"fd4997e0-1d7d-41d0-ba4f-6457f5fe04d7","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.754362Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:9893112e93372e383973dc2811bb2a98162419f9f1e9334206ec8f7760006fbd","observation_id":"b0aa34ba-ace1-4d61-bd3e-c2063dff96d8","resolution":{"observed_at":"2026-08-10T21:02:19.151523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.130329Z","title":"Optimal and approximate q-value functions for decentralized pomdps","venue":null,"work_id":"538fdef1-0a71-423a-83af-20affd72b332","year":2008},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.760712Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:777bd02011f901d17662ce62abe09253bb8ceeeb0a93b82f7474d1280c2f0a70","observation_id":"c1121493-a712-4bd5-9e3b-a86a99abd94b","resolution":{"observed_at":"2026-08-10T21:02:19.135232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.768939Z","title":"Hierarchical reinforcement learning: A comprehensive survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.768939Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:369541f1a37a1f972fdd38c67d87173334528436a381edfda600878303efc5b8","observation_id":"a4e77e8b-586f-4c33-a74f-83ea0aac2ac0","resolution":{"observed_at":"2026-08-10T21:02:18.768939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.776671Z","title":"Vast: Value function factorization with variable agent sub-teams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.776671Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:c2c52e6be2e2ac45c83c167425e2ea0fb8ef1a34c43fceed5d44830048843913","observation_id":"58fb5ca5-523b-4bcc-8d02-a0972aa9a9da","resolution":{"observed_at":"2026-08-10T21:02:18.776671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.095520Z","title":"Advances in neural information processing systems 17: proceedings of the 2004 conference, volume 17","venue":null,"work_id":"c53ea61e-31d4-40b2-b031-af0299f49ece","year":2004},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.784316Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:1e96216e84b62dad6dd207dbbe06931ab8add14ed54b1b23bfa02b6a9a39d9bd","observation_id":"ba9c940b-af4e-41bf-b55a-d52e52d2de95","resolution":{"observed_at":"2026-08-10T21:02:19.103251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.796890Z","title":"Sutton, Doina Precup, and Satinder Singh","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.796890Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:ee6f4f0aeb14c007e5d5bc901213d9845822150e0dee7963b3b497a4d8d912fd","observation_id":"986987ca-1a48-4a50-810a-63112b531ac5","resolution":{"observed_at":"2026-08-10T21:02:18.796890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.078756Z","title":"Effectiveness of gamified team competition as mhealth intervention for medical interns: a cluster micro-randomized trial","venue":null,"work_id":"859dee95-9193-4b35-aad8-4f3af192abe8","year":2023},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.802360Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:b96f51eb149d086dab24499fae0fe0286fac4b5df6f6412c843d8f47c1afb54a","observation_id":"c42a5f96-d91a-4728-b5e7-398ca9a73480","resolution":{"observed_at":"2026-08-10T21:02:19.084218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.065949Z","title":"Beaulieu, and Y","venue":null,"work_id":"bf7ba663-e51c-4a7d-8f47-132b175019d6","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.808135Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:cad156115d6282a52659449de1e2a409483a1327106c018ca6e1375d37a83626","observation_id":"25a0eddb-fe5e-48dd-b9dd-891f822cd454","resolution":{"observed_at":"2026-08-10T21:02:19.069932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.049538Z","title":"Adaptive dynamic bipartite graph matching: A reinforcement learning approach","venue":null,"work_id":"daf3d7ba-b4ac-4c62-bf8a-ac20c75db20c","year":2019},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.813132Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:8fa5c107ef6b8ce0027ccd0c3e54b958867f72fcfbbcebfc183620fa5be0302f","observation_id":"d7f37294-37b6-44e2-a88e-e1eb4c05c8e9","resolution":{"observed_at":"2026-08-10T21:02:19.055682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.031947Z","title":"Hierarchical dominance structure and social organization in african elephants, loxodonta africana","venue":null,"work_id":"194414f1-c932-4c95-a862-bb2bbb9b714d","year":2007},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.821021Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:723d661aa792cae54c6cef74093af935fb90a8d4dfd6d861ff4e34a30208464d","observation_id":"aa678bbc-d480-441f-a8c5-4eff6275f472","resolution":{"observed_at":"2026-08-10T21:02:19.036585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.017950Z","title":"Large-scale order dispatch in on-demand ride-hailing platforms: A learning and planning approach","venue":null,"work_id":"ffed70d0-d3a4-4cf2-a571-7a4f02b53347","year":2018},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.826218Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:7179722e5ba7e3bdb8965576d1ba634eb192c2f939f79ce382260a4f2410ad6d","observation_id":"e7e48205-37c8-4852-b131-6c3c71240ba8","resolution":{"observed_at":"2026-08-10T21:02:19.022090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06114","last_updated":"2018-04-14T18:54:19Z","snapshot_observed_at":"2026-08-14T21:12:24.518115Z","submitted_at":"2017-03-10T21:02:53Z","title":"Deep Sets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06114","snapshot_observed_at":"2026-08-10T21:02:18.831276Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.831276Z"},"links":{"cited_paper":"/paper/1703.06114","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:cedceda893a47ecea6663b046c45520f854c1f9f2371d326f24022917696ae22","observation_id":"8e214a0b-6254-44c9-a47d-0ce9e1dca286","resolution":{"observed_at":"2026-08-10T21:02:18.831276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.eswa.2016.07.047","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.886570Z","title":"Reinforcement learning based local search for grouping problems","venue":null,"work_id":"cedbb85f-fcc9-44f0-90ad-b7cdca182061","year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.838862Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:9913e2dbea01e62dee91fb61400e2f061200c2e7bbdf222837c71beca3746dc4","observation_id":"f0d3cc4c-a014-4406-b5e2-c81ee647b00b","resolution":{"observed_at":"2026-08-10T21:02:18.895206Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T16:42:39.406127Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":15},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2501.06554."}