{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:7DGPR6DZFTNYDMGIKKEHZ3M3PH","short_pith_number":"pith:7DGPR6DZ","schema_version":"1.0","canonical_sha256":"f8ccf8f8792cdb81b0c852887ced9b79c8a8a0509d7edd08e41efed5fd9dc0b8","source":{"kind":"arxiv","id":"2310.08746","version":1},"attestation_state":"computed","paper":{"title":"Robustness to Multi-Modal Environment Uncertainty in MARL using Curriculum Learning","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Aakriti Agrawal, Furong Huang, Rohith Aralikatti, Yanchao Sun","submitted_at":"2023-10-12T22:19:36Z","abstract_excerpt":"Multi-agent reinforcement learning (MARL) plays a pivotal role in tackling real-world challenges. However, the seamless transition of trained policies from simulations to real-world requires it to be robust to various environmental uncertainties. Existing works focus on finding Nash Equilibrium or the optimal policy under uncertainty in one environment variable (i.e. action, state or reward). This is because a multi-agent system itself is highly complex and unstationary. However, in real-world situation uncertainty can occur in multiple environment variables simultaneously. This work is the fi"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2310.08746","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2023-10-12T22:19:36Z","cross_cats_sorted":[],"title_canon_sha256":"cd061c2c8c836d462c606b835a65587e128a52e6e987d87165cbae6b9049d358","abstract_canon_sha256":"f31fe7f3a99d911a5c4586ac13e5ec54bb7dd7a7621ba28300e35c43566ec381"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T07:00:34.250857Z","signature_b64":"zRuXJ1lCW1Qu5fl9Tr4xjhjinXY3xvJPXW6wqDoC194VwGKi+p1Fz8iA15yDoRIlbbG3oXbqluW0FPDhKrXUDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"f8ccf8f8792cdb81b0c852887ced9b79c8a8a0509d7edd08e41efed5fd9dc0b8","last_reissued_at":"2026-07-05T07:00:34.250352Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T07:00:34.250352Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Robustness to Multi-Modal Environment Uncertainty in MARL using Curriculum Learning","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Aakriti Agrawal, Furong Huang, Rohith Aralikatti, Yanchao Sun","submitted_at":"2023-10-12T22:19:36Z","abstract_excerpt":"Multi-agent reinforcement learning (MARL) plays a pivotal role in tackling real-world challenges. However, the seamless transition of trained policies from simulations to real-world requires it to be robust to various environmental uncertainties. Existing works focus on finding Nash Equilibrium or the optimal policy under uncertainty in one environment variable (i.e. action, state or reward). This is because a multi-agent system itself is highly complex and unstationary. However, in real-world situation uncertainty can occur in multiple environment variables simultaneously. This work is the fi"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2310.08746","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2310.08746/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2310.08746","created_at":"2026-07-05T07:00:34.250421+00:00"},{"alias_kind":"arxiv_version","alias_value":"2310.08746v1","created_at":"2026-07-05T07:00:34.250421+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2310.08746","created_at":"2026-07-05T07:00:34.250421+00:00"},{"alias_kind":"pith_short_12","alias_value":"7DGPR6DZFTNY","created_at":"2026-07-05T07:00:34.250421+00:00"},{"alias_kind":"pith_short_16","alias_value":"7DGPR6DZFTNYDMGI","created_at":"2026-07-05T07:00:34.250421+00:00"},{"alias_kind":"pith_short_8","alias_value":"7DGPR6DZ","created_at":"2026-07-05T07:00:34.250421+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH","json":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH.json","graph_json":"https://pith.science/api/pith-number/7DGPR6DZFTNYDMGIKKEHZ3M3PH/graph.json","events_json":"https://pith.science/api/pith-number/7DGPR6DZFTNYDMGIKKEHZ3M3PH/events.json","paper":"https://pith.science/paper/7DGPR6DZ"},"agent_actions":{"view_html":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH","download_json":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH.json","view_paper":"https://pith.science/paper/7DGPR6DZ","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2310.08746&json=true","fetch_graph":"https://pith.science/api/pith-number/7DGPR6DZFTNYDMGIKKEHZ3M3PH/graph.json","fetch_events":"https://pith.science/api/pith-number/7DGPR6DZFTNYDMGIKKEHZ3M3PH/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH/action/timestamp_anchor","attest_storage":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH/action/storage_attestation","attest_author":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH/action/author_attestation","sign_citation":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH/action/citation_signature","submit_replication":"https://pith.science/pith/7DGPR6DZFTNYDMGIKKEHZ3M3PH/action/replication_record"}},"created_at":"2026-07-05T07:00:34.250421+00:00","updated_at":"2026-07-05T07:00:34.250421+00:00"}