{"as_of":"2026-08-17T04:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f02f43e23e72bf9759b25d6b68acbfb4f230761b2f7db14cd5cd6cf688de261","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:03:05.962079Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06690/citation-record","integrity":"/paper/2507.06690/integrity","json":"/paper/2507.06690/citation-record.json","paper":"/paper/2507.06690"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:08.367011Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning,","venue":null,"work_id":"0138e404-a8ff-4fe2-b0b4-c79d0df42144","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.534330Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:326ef92034a726453688cf7937e7194e7e61d969bd3d1aebc7e0f880f3615860","observation_id":"252f60b8-1fe1-4be1-afa2-f95abcbc39b1","resolution":{"observed_at":"2026-08-06T19:03:08.484394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:08.131499Z","title":"On reinforcement learning for full-length game of starcraft,","venue":null,"work_id":"a28dea1c-66ac-49fb-8930-0ad65561e13b","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.605901Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:4f9e202498e2d81ddaccf8478ac577b0bd6fae4e361f22c88adb3540d7f95f42","observation_id":"9c579910-42c5-4dcb-bd06-f9964716d599","resolution":{"observed_at":"2026-08-06T19:03:08.251972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.807615Z","title":"Distributed multi-robot collision avoidance via deep reinforcement learning for navigation in complex scenarios,","venue":null,"work_id":"2a70ce5d-e169-4095-8b73-c399e74dbe83","year":2020},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.728996Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:cf9d4a0f37e4ac488af2e1e026f6ba5f8fa528dfe2ced6ac97d2e75c0f96200a","observation_id":"b505fe26-b851-417d-907f-5c2e4438a29a","resolution":{"observed_at":"2026-08-06T19:03:07.964508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.488135Z","title":"Decentralized multi-agent pursuit using deep reinforcement learning,","venue":null,"work_id":"ae738afc-d830-492d-b205-dffe4c793d9f","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.809938Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:59f3677194828521bca747708a6606f4761430545fac8000e38b631c68fde0b5","observation_id":"f7ce6b66-3c4a-4a1e-8a57-d95ce4a066a4","resolution":{"observed_at":"2026-08-06T19:03:07.650127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.337982Z","title":"Multi-agent reinforcement learning for real-time dynamic production scheduling in a robot assembly cell,","venue":null,"work_id":"bd7e3b49-2781-446e-81ab-413e9f47b8d5","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.872797Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:63773d7675f14f459e4d48255db4614fcf0963ef162b9e5ea71076aa9adbfa28","observation_id":"1300d337-a480-49d9-ac5b-f4bb99d033a0","resolution":{"observed_at":"2026-08-06T19:03:07.385747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.138368Z","title":"Discovering generalizable multi-agent coordination skills from multi-task offline data,","venue":null,"work_id":"b9324bc0-ef37-4e83-b1db-e5a610bad212","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.876565Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:1983070cd41554d586f323b332a0468931c5c0f6e340713aaf55be69480b4e8e","observation_id":"e21435d1-df78-46f2-88bb-6615846eddc6","resolution":{"observed_at":"2026-08-06T19:03:07.241513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.879909Z","title":"A survey on multi-task learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.879909Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:0c484c978f912beedfb14dece51eaa13888e43991edf4d576339e76ce68d6629","observation_id":"88934206-2d97-43d1-97a4-38b5ddb24cf6","resolution":{"observed_at":"2026-08-06T19:03:05.879909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.930294Z","title":"Deep decentralized multi-task multi-agent reinforcement learning under partial observability,","venue":null,"work_id":"f4881479-2d3a-41ea-a548-c6d551d8a49a","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.883036Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:9de8fb9c9b244820932e7b5df656ad6484e3a027e32f565a4dc9be79d5b2583b","observation_id":"9ccefcca-daae-4762-969b-0317b75d92af","resolution":{"observed_at":"2026-08-06T19:03:07.023861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.689057Z","title":"Multi-task deep reinforcement learning with popart,","venue":null,"work_id":"52dfedfc-18b9-4395-a87e-3ead2fbbed9b","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.885914Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:db069a75a93498f1998ab8c46c2115371e4d72a51e9fcfa5a0893cfcee8252bb","observation_id":"bd2026cf-861a-4d70-af37-4aa1a7e298ab","resolution":{"observed_at":"2026-08-06T19:03:06.767905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.467409Z","title":"Conflict-averse gradient descent for multi-task learning,","venue":null,"work_id":"ced0f2f8-298d-4fa4-a7b8-ea46658a36ef","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.888630Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:5ecf1456248c63acf437ee5c3ba54dff31512e6eca8ec1bd6226f1974ad38ea0","observation_id":"f5d2f05f-f7ea-483c-9a91-82a56a62d593","resolution":{"observed_at":"2026-08-06T19:03:06.554548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.284002Z","title":"A deep hierarchical approach to lifelong learning in minecraft,","venue":null,"work_id":"48785c8c-5080-4310-a7e4-7a54ecd40a9c","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.891381Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:ef25d6000a5ed7086f9a61b3253ddb46175405a46aa6f54bceab31d9a0dab36f","observation_id":"c4388519-cf7d-49a6-a38c-e7e43464a459","resolution":{"observed_at":"2026-08-06T19:03:06.365683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.894191Z","title":"Lifelong federated reinforcement learning: A learning architecture for navigation in cloud robotic systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.894191Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:961f5339ab4c66706f22f1196571ec65548ef110346c5025d0f9fa0358dcfd58","observation_id":"46e9d9c0-630e-4ec8-aa60-1d37941056a6","resolution":{"observed_at":"2026-08-06T19:03:05.894191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.228328Z","title":"Actor-mimic: Deep multitask and transfer reinforcement learning,","venue":null,"work_id":"800db6aa-b2cd-4467-90bb-a9958dcbc164","year":2016},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.897163Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:3605338d1bad1d4c05baa0aa5318f3052bb98a356a80495dfb8c18572cad48ba","observation_id":"6f5ef603-9d1a-40b4-94dd-4992e70e09fa","resolution":{"observed_at":"2026-08-06T19:03:06.245842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-14T22:22:10.851051Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-06T19:03:05.900462Z","title":"Policy distillation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.900462Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:0fd522691ecd1d872f59fb4bf14ebb7ad2c4265c7315be105c83e5013d65c3b3","observation_id":"6cc39fae-9194-40fd-a050-f19f2947ea7f","resolution":{"observed_at":"2026-08-06T19:03:05.900462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.204603Z","title":"Knowledge transfer in multi- task deep reinforcement learning for continuous control,","venue":null,"work_id":"69970aaa-66e6-4889-9707-687be44dc2ad","year":2020},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.903630Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:a5f39f1f0f969bf4d7ad4a81a3be88f90a4c9c4f61119158516e0b4d30340d81","observation_id":"21adc34f-7156-4849-ae5c-59f6d0d500c7","resolution":{"observed_at":"2026-08-06T19:03:06.210239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.193937Z","title":"PaCo: Parameter- compositional multi-task reinforcement learning,","venue":null,"work_id":"5bc265ab-b479-49fe-b10d-3abd31d762c7","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.906559Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:b976b2a7d0fd7b248e5b983db5b400697265443be8d139b6818d62af491ecf93","observation_id":"04616aa6-11fd-4a9b-990b-614872a5085d","resolution":{"observed_at":"2026-08-06T19:03:06.197830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.909654Z","title":"Hierarchical rein- forcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.909654Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:ee65d9bea9d51381d3a27da444eeed4e18c75f668cae64ed1e4e24968ad5fe39","observation_id":"c5ec42af-e861-4049-85b9-d5d05cb87349","resolution":{"observed_at":"2026-08-06T19:03:05.909654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.177771Z","title":"Planning-augmented hierarchical reinforcement learning,","venue":null,"work_id":"ef1973c8-a5e8-4316-91f0-6267c436a6d8","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.912205Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:8e1d65727b609905fb6a3c4a40bab04a2d64b5f18d49fa8a88afea81dbc6a12b","observation_id":"35ec6148-e99a-41a5-9301-94c05c5dd0d4","resolution":{"observed_at":"2026-08-06T19:03:06.181379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.168291Z","title":"Learning functionally decomposed hierarchies for continuous control tasks with path planning,","venue":null,"work_id":"4f59ae1c-512d-4710-b529-a6cab35420cf","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.914752Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:7a8ea73f3dd93a8ddc2eb5efb1020e257113ee0ae152031a9b7695d6abbfa80c","observation_id":"82d39d2d-6a1f-4842-b403-b25b513976c4","resolution":{"observed_at":"2026-08-06T19:03:06.171281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.159443Z","title":"Modular multitask reinforcement learning with policy sketches,","venue":null,"work_id":"cf68f1a3-6006-48ae-8e2e-4f07dfbcb49a","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.917778Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:e1f4b588129bf3fac9674a5ebc83b321ea96438638b4e89a4bc66b23489a3b3e","observation_id":"b9f9c718-bba9-469d-b8de-5c89581545c4","resolution":{"observed_at":"2026-08-06T19:03:06.162471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.148302Z","title":"Adaptive and explainable deployment of navigation skills via hierarchical deep reinforcement learning,","venue":null,"work_id":"00c9b8c2-8fbf-4c16-9352-9cdeef8029f8","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.920980Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:c445742845480324c1347193ba6bd466a6773a363d5490a65db02a971f64e619","observation_id":"cdcc9149-0ef4-4c00-9e4d-85fdd25461e1","resolution":{"observed_at":"2026-08-06T19:03:06.152218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.138908Z","title":"Initial task allocation in multi-human multi-robot teams: An attention-enhanced hierarchical reinforcement learning approach,","venue":null,"work_id":"d45e75e9-71a3-4c4d-ae5b-e3938ae245d6","year":2024},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.923894Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:5c6743e11735fee7ddfbbd3ef52aaf7f40b629194a5af5425866fc921b9bf6f6","observation_id":"4e9920d0-9fed-4b76-a208-ad1474bfd0e4","resolution":{"observed_at":"2026-08-06T19:03:06.142236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.129554Z","title":"Multi-agent reinforcement learn- ing: A selective overview of theories and algorithms,","venue":null,"work_id":"a60369d7-168b-4ade-9d16-29709a094b43","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.926615Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:2573765cbebd78335b9d4d0b7ec7895b0bf748d7099ce4d5e6e2d72bb5daeaec","observation_id":"1edcfe7d-a896-471a-84a4-12cad4a70f37","resolution":{"observed_at":"2026-08-06T19:03:06.132701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06015","last_updated":"2025-02-26T18:10:09Z","snapshot_observed_at":"2026-08-16T14:44:23.342753Z","submitted_at":"2023-11-10T11:59:41Z","title":"Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph","version":2},"cited_work":{"arxiv_id":"2311.06015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.06015","snapshot_observed_at":"2026-08-06T19:03:05.990521Z","title":"Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph","venue":"cs.RO","work_id":"7a7a08c8-3089-47a4-b082-734a03e01f84","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.929189Z"},"links":{"cited_paper":"/paper/2311.06015","citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:095113032116b8bd5428e342cef6a210c59501bf6e98264b1b7bfd644233f230","observation_id":"5574b747-85bd-4782-afc2-742335021aed","resolution":{"observed_at":"2026-08-06T19:03:05.995998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.119666Z","title":"A survey on knowledge graphs: Representation, acquisition, and applications,","venue":null,"work_id":"ff3094c7-c103-4884-b83f-20345e31cf81","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.932202Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:ba86c996c5c331ecff73ebb7dcbb13eb9591fdab0c8658c8e703c649c9acf556","observation_id":"7a6df168-86e9-42df-ad05-27ac0d6fbdb6","resolution":{"observed_at":"2026-08-06T19:03:06.123142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.109934Z","title":"Knowledge graph embedding by translating on hyperplanes,","venue":null,"work_id":"0cf6b524-97b1-4806-b489-47e08eb6955c","year":2014},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.935300Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:c61d26c4e493d1fb7eb02dd3c01b508a87763256c201b2ec8ba56c6b38779a01","observation_id":"f1282c2f-a01d-4543-9c67-d4d26f77969b","resolution":{"observed_at":"2026-08-06T19:03:06.113652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.099362Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":"4099f05f-081c-47c3-a30f-af09043149ec","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.938113Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:ecb730afe847f1313e444257ff30ae75126fdbd161116c41a2e249c8698efed6","observation_id":"9831b267-ce1f-41ef-84a9-72cdda9010bd","resolution":{"observed_at":"2026-08-06T19:03:06.103325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.088275Z","title":"Knowledge graph embedding: A survey of approaches and applications,","venue":null,"work_id":"726c291f-a4db-4368-8726-c05860d6cb02","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.941010Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:acacff044247c88d814773f981ff9cf0ced81f975fc17e34c4bc011c7be7efab","observation_id":"071e1d2b-fdb8-431a-9051-102954303fa6","resolution":{"observed_at":"2026-08-06T19:03:06.092375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.077766Z","title":"A novel framework of knowledge transfer system for construction projects based on knowledge graph and transfer learning,","venue":null,"work_id":"8c4030f1-596d-4342-9b19-b3736a478a67","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.944067Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:11ed41ba8440d3438089cab7f7e67634471438534c6f6041f8c77533b5f14216","observation_id":"2e125195-9350-4a33-b2f8-608feac96a36","resolution":{"observed_at":"2026-08-06T19:03:06.081657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.065307Z","title":"Translating embeddings for modeling multi-relational data,","venue":null,"work_id":"da984092-e5cb-4b11-9474-f51e069af2b4","year":2013},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.946820Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:4ff499f48e33a78dd9696a264c120e01c752c14c5141aee74606f95e7222811e","observation_id":"3493bc8d-13ae-457a-a76c-81260e0bfa8c","resolution":{"observed_at":"2026-08-06T19:03:06.070410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.055247Z","title":"Predator–prey survival pressure is sufficient to evolve swarming behaviors,","venue":null,"work_id":"72ba3d0a-fade-4cb8-b502-27a366f23fa8","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.949700Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:68cebb97c1ed70ecd69e97e5ea8d968cc506dc5287944a1e0e2c6a49411abc15","observation_id":"7a468652-4212-4a50-a0d2-de0863743944","resolution":{"observed_at":"2026-08-06T19:03:06.058427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.044744Z","title":"Swarm robotics: Past, present, and future [point of view],","venue":null,"work_id":"a10cd000-6f0f-473c-86e8-49376ce114c6","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.953075Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:87ef43b3046f1947dc008fcf7f738671333609eb54f9c5397152d8cabdea7371","observation_id":"62708566-44f1-495f-bf94-1ab5611aec30","resolution":{"observed_at":"2026-08-06T19:03:06.048801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.033994Z","title":"Optimized flocking of autonomous drones in confined environments,","venue":null,"work_id":"a6dc0bfc-ab53-4d66-a620-ee0f3e425305","year":2018},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.956426Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:cebef4aef1e165606fcaa6ef76ac3e4a59820464845fbd1c253206507cd2aa42","observation_id":"f4a1252e-d8ed-4ce8-b15d-8d29bf1b37f3","resolution":{"observed_at":"2026-08-06T19:03:06.038164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.024540Z","title":"The surprising effectiveness of PPO in cooperative multi- agent games,","venue":null,"work_id":"edf05f6a-a2a4-4cef-b049-52fdabf36052","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.959208Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:197000187046ee9d0f274fcfc7793eb0e5ae95c7e2e1669a44c050cf1a6c0f65","observation_id":"fb31f28d-f774-422e-a668-72812642e2ef","resolution":{"observed_at":"2026-08-06T19:03:06.027692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.014125Z","title":"Omnibot: A scalable vision-based robot swarm platform,","venue":null,"work_id":"beba4a32-11fa-4bf1-9137-88a565f9dbad","year":2024},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.962079Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:443664eabb3d13c38feb7e140b9abbc711a51633b80f424c5fbc91e7305bea65","observation_id":"0ce90dfe-bb68-483d-9fd2-6b175e4555e3","resolution":{"observed_at":"2026-08-06T19:03:06.017977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T21:15:33.460537Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.06690."}