{"as_of":"2026-08-10T16:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c29ded61ef1a60ac8f2f53edec5b7401860c1a984ece5129442375dd3a812278","coverage":[{"denominator":116,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T22:14:20.499842Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23434/citation-record","integrity":"/paper/2607.23434/integrity","json":"/paper/2607.23434/citation-record.json","paper":"/paper/2607.23434"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-30T22:14:20.134855Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.134855Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:06e050051d026b9679e3701d21f11c4f349580f74616d3c6561dd84635a2ebed","observation_id":"49acf4ec-07c2-414c-89b7-af15c8f862cd","resolution":{"observed_at":"2026-07-30T22:14:20.134855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.141587Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.141587Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:ca699d75e2429bbac87935cfabb104770cd488246f9e891f5a47edeeba580cce","observation_id":"7146915c-26c0-4f5b-8099-a2f19d16ede0","resolution":{"observed_at":"2026-07-30T22:14:20.141587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.145487Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.145487Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:b9a79fc09e8a554909d39f894ce05fa954b9ffa8bf2da700b7a8a0369823cd1a","observation_id":"b5620605-15c6-49d5-8439-c0e347f76dbd","resolution":{"observed_at":"2026-07-30T22:14:20.145487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.149515Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.149515Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7ea0fbc5e461d99e7ccfd3e0da179227ed75302943ad5bfd1340f74f56a220c5","observation_id":"29309a8c-b2ad-4f0c-b857-8c9b7144939f","resolution":{"observed_at":"2026-07-30T22:14:20.149515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.153283Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.153283Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:ef1c64b8174eab9a27a6d28fa4ebe664357cfde1d32b0823bb05b47900e36a86","observation_id":"69975c02-9aa0-4d81-8c47-56b6c62fdd25","resolution":{"observed_at":"2026-07-30T22:14:20.153283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.157032Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.157032Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e67d1bb7468fd643f7949d8038adcaad87a26c82a4a01b2035ff41e2b33b5f96","observation_id":"ee7d29b1-3f6c-4c97-97be-204d4d140c9b","resolution":{"observed_at":"2026-07-30T22:14:20.157032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.160877Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.160877Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d23296038603554aacd3fb9f1d6682475878be3ce698e5843d44af2fc68c5007","observation_id":"3e2e31e5-b8f7-4882-8091-9f4be20fe67a","resolution":{"observed_at":"2026-07-30T22:14:20.160877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.164766Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.164766Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e688c0bc56af64dd6e78f40721e2c90fd191f8c7cdc99659f6fee8d7eea19104","observation_id":"10e5943a-6a5a-4974-92c6-4e5a1778f9dd","resolution":{"observed_at":"2026-07-30T22:14:20.164766Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.169453Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.169453Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:5b584224ada0ec51cb1bc68e31b9b6229a8742d53aaa7970cecd3a0453283f60","observation_id":"87bbf1fe-e19a-400b-8baf-b3c68ff6abe1","resolution":{"observed_at":"2026-07-30T22:14:20.169453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.173068Z","title":"Proceedings of the Nineteenth International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.173068Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:19e8ed33649c3eeaa658359a5003da18fc97d075cbd69b51b517adf0370b1c15","observation_id":"f439e2b8-24c0-40c4-b374-9b20ea275df1","resolution":{"observed_at":"2026-07-30T22:14:20.173068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.177065Z","title":"Manufacturing & Service Operations Management , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.177065Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:a8c8db36f4f0b0f9e2711edefa0b10435b3289fc88b47c064b2c581ccd167173","observation_id":"346c216b-31f6-47e6-a2a7-7eb2c9b2b26f","resolution":{"observed_at":"2026-07-30T22:14:20.177065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.181191Z","title":"Linear convergence of gradient and proximal-gradient methods under the polyak-","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.181191Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:5c4f16879f01e5ba5f6d8fd1bf84cd5b45bda9fc9c45e571cf50633c70123084","observation_id":"46a490f0-5348-49ed-b4e0-fb0964c9a40b","resolution":{"observed_at":"2026-07-30T22:14:20.181191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.184992Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.184992Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:756940733d11620c8b5327c790bcb5f81f0a85c4e2b709f3057412ebe3a2e282","observation_id":"2095cccc-c247-4902-b7cf-dee26c7e87ab","resolution":{"observed_at":"2026-07-30T22:14:20.184992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.188949Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.188949Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:3438d2bac8b3e32a5727e22ea7e24fcebfa29b32431e31235e3dd1d8640b8cd9","observation_id":"099a401f-8e85-475e-bf87-aa1853f035d3","resolution":{"observed_at":"2026-07-30T22:14:20.188949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.192775Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.192775Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:eab4a21f64cadaa98f97b099cbf785e725749e3338afac2be2e4d7288443000c","observation_id":"f6a88a3c-1f71-46b0-b514-7a56c5d93017","resolution":{"observed_at":"2026-07-30T22:14:20.192775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.196681Z","title":"MIT Sloan Management Review , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.196681Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:38d23ac747af79753258a70d73680b13c7f78bf45b6921b3d4a995ad9502cb9a","observation_id":"315834f6-04ab-4a58-b957-5147ea57365e","resolution":{"observed_at":"2026-07-30T22:14:20.196681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.200563Z","title":", author=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.200563Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:857f17ec41583450f5123d10063977400c479fa35c472fac4d2fc54f7bc73ee3","observation_id":"59b7b025-ac21-4718-96c0-b6cb01183709","resolution":{"observed_at":"2026-07-30T22:14:20.200563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.204292Z","title":"Annals of Operations Research , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.204292Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7b9278983885f667f5e780b7cd2f13d91355458b0ce11eadfcd6f4d837a2ba0e","observation_id":"c6bd9013-2599-4377-ad2d-a6fe7ebe58fd","resolution":{"observed_at":"2026-07-30T22:14:20.204292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.207998Z","title":"Manufacturing & Service Operations Management , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.207998Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:afe991bba98f7a7594c515aad25f14dc94746a462dd92877b7aaac319872d762","observation_id":"b7a63a8f-0354-4595-8196-ed3f92a66195","resolution":{"observed_at":"2026-07-30T22:14:20.207998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18049","last_updated":"2026-07-24T02:28:17Z","snapshot_observed_at":"2026-08-10T00:49:00.143856Z","submitted_at":"2025-01-29T23:23:54Z","title":"Online Pricing and Allocation with Demand Learning and Fulfillment Cost","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18049","snapshot_observed_at":"2026-07-30T22:14:20.211629Z","title":"arXiv preprint arXiv:2501.18049 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.211629Z"},"links":{"cited_paper":"/paper/2501.18049","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:3cdca3a13b1e565a191a163ea6b9e837924f9a5812301e062c74f8b5b2939fe7","observation_id":"32f6203d-4932-4598-8ae2-09498f3b2736","resolution":{"observed_at":"2026-07-30T22:14:20.211629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.215656Z","title":"Expert Systems with Applications , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.215656Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:0e20a0d124153d39a52054f5286de060057a4dd1ead0da749a8ae94448d87157","observation_id":"71b5794b-e42e-4032-ae5b-c92719e6bc37","resolution":{"observed_at":"2026-07-30T22:14:20.215656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21109","last_updated":"2024-10-28T15:12:04Z","snapshot_observed_at":"2026-08-10T02:12:42.061579Z","submitted_at":"2024-10-28T15:12:04Z","title":"Dual-Agent Deep Reinforcement Learning for Dynamic Pricing and Replenishment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21109","snapshot_observed_at":"2026-07-30T22:14:20.219276Z","title":"arXiv preprint arXiv:2410.21109 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.219276Z"},"links":{"cited_paper":"/paper/2410.21109","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:32e9287aeda7d6018626d83f3a6bf66c817c0e8966ca3c18d3821b99eaee8160","observation_id":"f0f52f61-45e3-4c3e-9510-1e8e6a44f77c","resolution":{"observed_at":"2026-07-30T22:14:20.219276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.222982Z","title":"Production and Operations Management , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.222982Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7f929321206818d3917044507b45d735dce2792ebb5ffa10ec53a6901657c10e","observation_id":"20788c48-c27f-4b84-8d47-148df03c7dc9","resolution":{"observed_at":"2026-07-30T22:14:20.222982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.226872Z","title":"Sensors (Basel, Switzerland) , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.226872Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:589d2744a3722f09053aa9f56bd559754c28b9f35d6ac93eb331625fb5c62806","observation_id":"632815a0-9a77-4f08-b1ca-f06f2564ffe4","resolution":{"observed_at":"2026-07-30T22:14:20.226872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00318","last_updated":"2024-03-01T06:40:02Z","snapshot_observed_at":"2026-08-05T11:20:47.556220Z","submitted_at":"2024-03-01T06:40:02Z","title":"Deep Reinforcement Learning for Solving Management Problems: Towards A Large Management Mode","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00318","snapshot_observed_at":"2026-07-30T22:14:20.230883Z","title":"arXiv preprint arXiv:2403.00318 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.230883Z"},"links":{"cited_paper":"/paper/2403.00318","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:b2d8a0d29a69ae1c61f787191e05a4490bc24a18a3742f869da67077d228fe8c","observation_id":"93a81b12-577c-4334-b780-3ecb9735b379","resolution":{"observed_at":"2026-07-30T22:14:20.230883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.234681Z","title":"arXiv preprint arXiv:2504.09831 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.234681Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:03a3247fcaf7d9df041350925f55837fc2adc03c9b7a4d04b2bc696adb4de333","observation_id":"a49705de-0c2a-4eae-918f-29449d9a3e00","resolution":{"observed_at":"2026-07-30T22:14:20.234681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01649","last_updated":"2023-08-03T09:31:45Z","snapshot_observed_at":"2026-08-10T02:42:52.630206Z","submitted_at":"2023-08-03T09:31:45Z","title":"MARLIM: Multi-Agent Reinforcement Learning for Inventory Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01649","snapshot_observed_at":"2026-07-30T22:14:20.238164Z","title":"arXiv preprint arXiv:2308.01649 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.238164Z"},"links":{"cited_paper":"/paper/2308.01649","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e4d99c4975b3658dfb06af2da8bc9cab4d0fb7f6e253c0369c35950be3205d1a","observation_id":"1e9dbf4e-33bb-4670-ab08-cdc56641426a","resolution":{"observed_at":"2026-07-30T22:14:20.238164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.242039Z","title":"2021 IEEE 45th Annual Computers, Software, and Applications Conference (COMPSAC) , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.242039Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:c8d972084350126a7d88ea1dbf469f15f73dd51a4ae5d723519f9811ae387047","observation_id":"31fcaba5-a6c6-4294-9302-d511764d83b7","resolution":{"observed_at":"2026-07-30T22:14:20.242039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.245620Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.245620Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:5757cd2d2b072c7762870d1f0fa7639bf1a5d1148425b8651403fbae416433cb","observation_id":"aeb5b2ab-1996-472b-9c9f-9f4245309b41","resolution":{"observed_at":"2026-07-30T22:14:20.245620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08631","last_updated":"2024-11-13T14:17:26Z","snapshot_observed_at":"2026-08-02T00:17:21.946337Z","submitted_at":"2024-11-13T14:17:26Z","title":"Deep Generative Demand Learning for Newsvendor and Pricing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08631","snapshot_observed_at":"2026-07-30T22:14:20.248987Z","title":"arXiv preprint arXiv:2411.08631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.248987Z"},"links":{"cited_paper":"/paper/2411.08631","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:9a4d0aab64425c5395951e05149aa8c5ea15eb6d73fcc80da64580f64579c47b","observation_id":"7eded0b3-e422-4f5f-bb62-458467b9caac","resolution":{"observed_at":"2026-07-30T22:14:20.248987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.252872Z","title":"Manufacturing & Service Operations Management , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.252872Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:95ed28f51b3f8cc3b806b980d3d49c63d54ea9283cb4f234584a9c94c83e48df","observation_id":"5cb2488b-3f92-44b1-b171-fae4afca4176","resolution":{"observed_at":"2026-07-30T22:14:20.252872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.256381Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.256381Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:5140a6fd38f7b85d4ec1ee890cec2e1ce65f78337fe7799a9b5900334c6f8d24","observation_id":"73819c71-fcd5-455a-9810-618f810560f6","resolution":{"observed_at":"2026-07-30T22:14:20.256381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02022","last_updated":"2024-12-31T03:16:54Z","snapshot_observed_at":"2026-08-10T01:03:15.939872Z","submitted_at":"2023-04-04T09:25:34Z","title":"Online Joint Assortment-Inventory Optimization under MNL Choices","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02022","snapshot_observed_at":"2026-07-30T22:14:20.259963Z","title":"arXiv preprint arXiv:2304.02022 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.259963Z"},"links":{"cited_paper":"/paper/2304.02022","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e522b43aa8f03aeebe311b3b2a95a4c3d6836c6ffe471840ac45b1ffef61da7f","observation_id":"09afe809-28a1-4720-99b5-33a2b677bcae","resolution":{"observed_at":"2026-07-30T22:14:20.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.263754Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.263754Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:1d0f55d0762b950c98c812890ae738f1d777cff9391c560f86d77eb434d52c80","observation_id":"3c06bcdc-40ed-4ae1-8269-8007572d6f7f","resolution":{"observed_at":"2026-07-30T22:14:20.263754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.267170Z","title":"Operations Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.267170Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:c720c1f3b0a9d9dfddabe37f66a0cee7d3ced99da7c9421c4fd0433e08ebcb8d","observation_id":"03e21a8e-09e7-4887-b0d5-11904aee07fe","resolution":{"observed_at":"2026-07-30T22:14:20.267170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.270468Z","title":"arXiv preprint arXiv:2501.15338 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.270468Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:51ba06248a32e9a7b9be9aa971fbdcba22d25a466f191e4aa075d5ec6c979bbe","observation_id":"0cb840ce-f662-4bcd-b882-7729b0754aa6","resolution":{"observed_at":"2026-07-30T22:14:20.270468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02324","last_updated":"2025-04-03T06:56:08Z","snapshot_observed_at":"2026-08-07T16:12:26.913618Z","submitted_at":"2025-04-03T06:56:08Z","title":"Dynamic Assortment Selection and Pricing with Censored Preference Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02324","snapshot_observed_at":"2026-07-30T22:14:20.273941Z","title":"arXiv preprint arXiv:2504.02324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.273941Z"},"links":{"cited_paper":"/paper/2504.02324","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:55766a23968025da3f37970e9ecbd9d2cf3675fe72118ee80603e0ae597a3729","observation_id":"847763e9-00e0-438c-b84f-210ad82525cc","resolution":{"observed_at":"2026-07-30T22:14:20.273941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.277604Z","title":"International Transactions in Operational Research , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.277604Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:ccf7dc50c9cd33ab52bff957c9356fec04428df5415b40d241bc7e35a674019f","observation_id":"7195f0fe-1ac6-45cb-99ae-0ef823daf709","resolution":{"observed_at":"2026-07-30T22:14:20.277604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.281094Z","title":"IIE Transactions , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.281094Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7897acee5ef0918ed1017b0cd25022da4333f00d2b372b18c4568efb3cc8f819","observation_id":"80fdec27-3624-4b78-b2df-fb14348d1bcd","resolution":{"observed_at":"2026-07-30T22:14:20.281094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.284932Z","title":"1998 , publisher=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.284932Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:9211456bbb84f7932d7086b339055e65c39b5f99acaa00a0035136178f4684de","observation_id":"003634be-c890-412a-84da-9a66f8fc3052","resolution":{"observed_at":"2026-07-30T22:14:20.284932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.288779Z","title":"2020 , publisher=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.288779Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:841671ddd85be3a715186a8cd24f17c80bec710bedf0d36e9f0674a12ec6ff0f","observation_id":"678d1e5a-25a1-4f83-b3c4-173b9a14f6fd","resolution":{"observed_at":"2026-07-30T22:14:20.288779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-07-30T22:14:20.292269Z","title":"arXiv preprint arXiv:1909.08593 , year=","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.292269Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:6ac46830a2b05ec7a41dd53396cc73023523b3b88a19301fa0c66f79f6b26a61","observation_id":"5b9edbab-29d7-420b-8982-2440118dfe52","resolution":{"observed_at":"2026-07-30T22:14:20.292269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.296116Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.296116Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:8b34d6350348a4f7c78df10a080c2349063923bdf00eb1446f37916d841d5f86","observation_id":"378ab4ee-0ac8-41c0-88b7-d2f1839afeb3","resolution":{"observed_at":"2026-07-30T22:14:20.296116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.299489Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.299489Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:c3e2aae17036f8b6711fd10ae95b477a1d9046bbd9c69c08d9bb248865a1f0a7","observation_id":"ccc46e69-998c-4ae6-ba81-5b37ecccccfa","resolution":{"observed_at":"2026-07-30T22:14:20.299489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.303003Z","title":"Discrete Event Dynamic Systems , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.303003Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:6e90bcbeae8bfd483369038f47388053df0883f11cd917eac977c4a7ee702f39","observation_id":"2bec7e89-894a-423a-8671-01e25051921a","resolution":{"observed_at":"2026-07-30T22:14:20.303003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.306630Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.306630Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:60d5111043bcb7274aadd341555ed4a857189b458f3246d8feeeeecfd0d5aacf","observation_id":"07e2cc4d-3b08-4299-8fae-000dad9be46e","resolution":{"observed_at":"2026-07-30T22:14:20.306630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.310153Z","title":"ACM Computing Surveys (CSUR) , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.310153Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:ceb8382e29a1e8c7298c6bf8a9d653f534c4433cbc4fc84f74e5b97ae0ada3ed","observation_id":"a72b08fe-dd63-49f8-b7c3-83cd8885c7d8","resolution":{"observed_at":"2026-07-30T22:14:20.310153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.313661Z","title":"International Journal of Production Research , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.313661Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:ce33b5c50a62892c76c758aedecb121a57df7fccd81433b048ff1216df0e72d4","observation_id":"4aed0284-e9ab-472b-8d4f-b2067344f51f","resolution":{"observed_at":"2026-07-30T22:14:20.313661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.317441Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.317441Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:6ad21a7107f577ed837df035f4ca6165f20ca91829ec7d88a85dcccf4dae4261","observation_id":"8381dc87-26e0-4fa2-9c60-7a5b40f47d4e","resolution":{"observed_at":"2026-07-30T22:14:20.317441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.321158Z","title":"Journal of Operations Management , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.321158Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:81f2f292229bb5f0d11a4b090a4a5c1745494d33107bdde2fa55b768116f7e59","observation_id":"01269394-1dde-49cc-a0d1-098c63ad8148","resolution":{"observed_at":"2026-07-30T22:14:20.321158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.324501Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.324501Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d57dabd1436099755ae7736971aed35d05bab786296f1b3f929d547eefba0861","observation_id":"57b8259e-6cb7-4199-b602-24579fd0c810","resolution":{"observed_at":"2026-07-30T22:14:20.324501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.328026Z","title":"International Journal of Logistics: Research and Applications , volume=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.328026Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:0b3be7c1b94fd19a917c5c499a6196741cd1e96206b333b96f2a96014a224577","observation_id":"fbbdddb2-201f-4d44-b248-8bdba88c8b59","resolution":{"observed_at":"2026-07-30T22:14:20.328026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.331482Z","title":"Operations Research , volume=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.331482Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:4667dee728ac173ae9ae5e40a2194fab166c9f97964b3b6e75176197c7439bda","observation_id":"e1933f5c-ce8e-4b06-89c4-c0c517aa0d78","resolution":{"observed_at":"2026-07-30T22:14:20.331482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.334938Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.334938Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:1b469f0c7a4a2df7f23d8f57c1bef8e6f336ed0f151eb112c5a0f5a45c777a5c","observation_id":"9bb1b679-6bc3-488e-80ad-3c208a9cb0ac","resolution":{"observed_at":"2026-07-30T22:14:20.334938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.338727Z","title":"European journal of operational research , volume=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.338727Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d35c196d52df5dd99177224ce8b1c2dfefcedc4e38df666083f96125bbe5d2c5","observation_id":"b0b8eff9-d966-47dc-9bff-77a1965bf362","resolution":{"observed_at":"2026-07-30T22:14:20.338727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.342279Z","title":"ICML , volume=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.342279Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:770f9ba43a9be378354eb4a6fc19758fb6946ef49f71fb406369463e9b8ed83f","observation_id":"18be5104-3020-46e8-a21a-f13eb54f3d88","resolution":{"observed_at":"2026-07-30T22:14:20.342279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.346208Z","title":"11th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2012) , pages=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.346208Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:acf219ac11b9ca0995bfef18838dddc8b59ab9082d2c219617e0598e33186a6a","observation_id":"6a83e311-a3e6-43c7-9ec4-1802ba5623e6","resolution":{"observed_at":"2026-07-30T22:14:20.346208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.349764Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.349764Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:5baee785c01066c58f8fa5fdd5d3c8181bf37fd5cb3849ab4b92821a7e522017","observation_id":"230296b3-addf-43ed-9a5d-4b6a26c54c46","resolution":{"observed_at":"2026-07-30T22:14:20.349764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-30T22:14:20.353304Z","title":"arXiv preprint arXiv:1606.06565 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.353304Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:af3e9aa511289bbe5d2ef37c37c6631418886ac3c2394eacf143ba8ff840130e","observation_id":"68805eec-e907-4f7f-bbce-b784166bbaff","resolution":{"observed_at":"2026-07-30T22:14:20.353304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.357194Z","title":"Synthese , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.357194Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:cd064109c0549f6d0d4142c6073fc6649fdd1c3988703235cfcbda8cb407877f","observation_id":"5f82a425-2908-425b-ba3f-24a1471b88fe","resolution":{"observed_at":"2026-07-30T22:14:20.357194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.360655Z","title":"2021 , publisher=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.360655Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:dff71344218f8a664bc75014026432185561fe5379e951ec1b61af1af1e16eb0","observation_id":"6992b26a-caca-4a1c-8386-e19a990e1c48","resolution":{"observed_at":"2026-07-30T22:14:20.360655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07843","last_updated":"2024-08-12T02:40:24Z","snapshot_observed_at":"2026-08-05T02:03:41.066235Z","submitted_at":"2023-08-15T15:43:12Z","title":"Dyadic Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07843","snapshot_observed_at":"2026-07-30T22:14:20.364088Z","title":"arXiv preprint arXiv:2308.07843 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.364088Z"},"links":{"cited_paper":"/paper/2308.07843","citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:18aed21c2020a771eebe2d40f6b902a19bd0c9bc9a6d18784a426b30da794223","observation_id":"1881106e-8ba1-43cb-bbb6-6912e60fd418","resolution":{"observed_at":"2026-07-30T22:14:20.364088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.367894Z","title":"Algorithms , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.367894Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:a104d9b5598caf76e4e15c7976bb421546fcb16ac009113ba8ffde2c6ad57b6a","observation_id":"d8e280bf-2fa4-4796-a5b8-602cb1648561","resolution":{"observed_at":"2026-07-30T22:14:20.367894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.371330Z","title":"Proceedings of the ACM on interactive, mobile, wearable and ubiquitous technologies , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.371330Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:b3f039cad8eb9de75bfbab9bba01ee9f51cab7241e344c7138c8fffe64bd00b1","observation_id":"edc8256d-89c0-4ffa-b6c5-381ef22585a6","resolution":{"observed_at":"2026-07-30T22:14:20.371330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.375253Z","title":"Handbooks in Operations Research and Management Science , volume=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.375253Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:b4ca76ef0d05b9960d4ba116d735967813b52c267a20494b0e97bc7880f0454b","observation_id":"86a824d1-58d8-4afd-8e12-c96ee97c91c1","resolution":{"observed_at":"2026-07-30T22:14:20.375253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.379148Z","title":"The Roots of Logistics , pages=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.379148Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:4cc7eb89fb81e81523a395c45d06b3f5d5d5908c9805014524e116f37f10daff","observation_id":"319c1546-b4ae-4cde-902a-bd9906beb9e1","resolution":{"observed_at":"2026-07-30T22:14:20.379148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.382655Z","title":"Operations Research , volume=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.382655Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:1974996bf29b8022236ee0ab7cb09acd5ce3e664b98ee901b73097ca0f6323bb","observation_id":"bb9d71a1-8dd9-4ffd-8ddc-4ade20d03799","resolution":{"observed_at":"2026-07-30T22:14:20.382655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.386086Z","title":"International Journal of Production Research , volume=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.386086Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:c5751791c799593dd6c165c93a0efcf55bb5a2d6ed216a0fe98256474718883e","observation_id":"63d1c5cf-c588-4cc1-98db-9f9e8b7f2d5c","resolution":{"observed_at":"2026-07-30T22:14:20.386086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.389520Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.389520Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7be71768497c41376a86bfec2cd802bbcad34b462523f3e4e6dc67caf7aa08d9","observation_id":"2c33bf29-0257-4cb0-baae-3d34b0935e79","resolution":{"observed_at":"2026-07-30T22:14:20.389520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.393019Z","title":"MIT Sloan Management Review , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.393019Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d4c68ae95f496063f650908076cb3f78d3b60169c8f1e0f750e638e41d5786dd","observation_id":"2b32069c-0f43-45de-9439-af9e4b2e1776","resolution":{"observed_at":"2026-07-30T22:14:20.393019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.396549Z","title":"Production and Operations Management , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.396549Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:66b2f5327801f85446a5ee82279ce60e3a5f7f35b5573d2f7a547c8524c536f3","observation_id":"6f66183f-46b8-443a-89b7-43cc72e65861","resolution":{"observed_at":"2026-07-30T22:14:20.396549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.399873Z","title":"Operations Research , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.399873Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:40f7e02bd7c3cd94ac1a59e9297400908ab840a1e6fe90a498ef993f5166000f","observation_id":"bed2cf27-075f-4776-a8f6-fd9d63977196","resolution":{"observed_at":"2026-07-30T22:14:20.399873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.403555Z","title":"Electronic Commerce Research , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.403555Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:092edaeb55d0804cc3097cd5a28325a54a086b05a05984b5486aa84ef720a165","observation_id":"8de6d193-06c5-4fca-a005-8a789a4bb450","resolution":{"observed_at":"2026-07-30T22:14:20.403555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.407052Z","title":"Transportation Research Part E: Logistics and Transportation Review , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.407052Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d560c1871542ee788361321a71400334322b26ab76eca30af74699e87e252fcd","observation_id":"f9d2322b-2787-4d7b-a9ba-45c679936e6a","resolution":{"observed_at":"2026-07-30T22:14:20.407052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.410633Z","title":"International Journal of Production Economics , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.410633Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:510fc6a9e65efd9d651d8f24dbeef51666267a1aa43aae9b2a617b863ae89b7d","observation_id":"ce0dc897-290d-4092-8a75-bbf8f9dfc338","resolution":{"observed_at":"2026-07-30T22:14:20.410633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.414466Z","title":"2025 , publisher=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.414466Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:1c3d95998fdcc6a84d5e6d170f21193f235173e04f8ee6329b2b2885c5053124","observation_id":"3d997573-044e-40cb-87d3-37bfd15ea511","resolution":{"observed_at":"2026-07-30T22:14:20.414466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.418069Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.418069Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:97419182da8b116e31b1e368b2dc375dfa85783bb93f656349cb0c27834bd38c","observation_id":"6a2a9bdf-8ecb-4040-9fa8-934aa9265979","resolution":{"observed_at":"2026-07-30T22:14:20.418069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.421649Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.421649Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:99eae2174868c92e1559643c715b69b6c14b6c31e7579788d8d10b99ff50132e","observation_id":"0d8274ec-c884-4510-8521-ae29aee70b43","resolution":{"observed_at":"2026-07-30T22:14:20.421649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.425020Z","title":"Manufacturing & Service Operations Management , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.425020Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:765b06b5d675389dc27317ca070d328e579494d5e510151f976692fe3f86ecf6","observation_id":"98b6fbe8-132c-40d2-bd9a-25e8987243a8","resolution":{"observed_at":"2026-07-30T22:14:20.425020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.428417Z","title":"Transportation Science , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.428417Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:aeddba899119a2b1343d6cff3265581277d1c9d3067e486fe069ff2867b79f61","observation_id":"aade1b80-acca-4340-a150-84850fdab827","resolution":{"observed_at":"2026-07-30T22:14:20.428417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.432306Z","title":"2014 , publisher=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.432306Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:bafc563bd3581aefddf2144efb09a957b965a96c4f7ae6576e3961310b841337","observation_id":"4ce596cd-13cf-4db0-9319-ba9c7f0678a1","resolution":{"observed_at":"2026-07-30T22:14:20.432306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.435843Z","title":"and Keskin, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.435843Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:c10ffc3a823d3b5da1e11d6887333ff01c07c163449096c3e4466f13d423d550","observation_id":"e69902a1-688c-42b2-843a-912a7b56f243","resolution":{"observed_at":"2026-07-30T22:14:20.435843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.439110Z","title":"and Nayga, Rodolfo M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.439110Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:d1eb896e651942c0e4ba5407d15a4a684342cb0f8c4effc2b8f7ea1cf5cc9211","observation_id":"be7e1513-6654-4edd-af58-5d50a2483b99","resolution":{"observed_at":"2026-07-30T22:14:20.439110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.442575Z","title":"Competitive Pricing for Multiple Market Segments Considering Consumers' Willingness to Pay , journal =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.442575Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:13c3c52c59327fc71cc4e57293f8fadc221715b00ee787482aaba069b6b6bf2b","observation_id":"a8e3d51d-d135-4883-85ff-7fcf2e272051","resolution":{"observed_at":"2026-07-30T22:14:20.442575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.446247Z","title":"Optimizing Inventory and Pricing for Substitute Products with Soft Supply Constraints , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.446247Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:04889b7563bce5387e28158ebb6d9df5a78840580a8b50f57351b1a4dd01fab4","observation_id":"1153d8e4-4209-41f9-86f4-f71da833939e","resolution":{"observed_at":"2026-07-30T22:14:20.446247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.449708Z","title":"International Journal of Enterprise Information Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.449708Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:3b82899d52065b66970849781418ea8eecd60752741950e441149dc822506bcc","observation_id":"3034383a-75b9-4896-ac7e-bc2e8452b04f","resolution":{"observed_at":"2026-07-30T22:14:20.449708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.453567Z","title":"and Phuong, Do Thi Thanh and Tedjakusuma, Adi Prasetyo and Eunike, Ixora Javanisa and Riantama, Dalianus , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.453567Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e35a238559706d6c7f8fd5b9d17bc34cd4e44844bd53a2aa48b3806b8baaab48","observation_id":"9cf4baa0-2c2d-4a2f-a18e-4d8ebed09f49","resolution":{"observed_at":"2026-07-30T22:14:20.453567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.457252Z","title":"European Journal of Operational Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.457252Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:2fec439ffacd26ca2c377c35c8e906c691570b6e963fe3d30be7e50330e33b8a","observation_id":"d15f9442-4d5c-4736-b4d6-058c8bdedbb4","resolution":{"observed_at":"2026-07-30T22:14:20.457252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.461148Z","title":"Heliyon , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.461148Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:2b5bf3f8831890cc307b229884de48a8b97662065f79f07a08a9a17db0de9aec","observation_id":"b3c7ac6d-7adf-4592-b051-3d572abc8fa3","resolution":{"observed_at":"2026-07-30T22:14:20.461148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.464725Z","title":"Robotics and Computer-Integrated Manufacturing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.464725Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:2e998109b4274bf42776a908a8f496185fe538853026bd49fa4329ee1e79b07d","observation_id":"6098ef59-f9a9-4d5d-b0a8-75be819406a1","resolution":{"observed_at":"2026-07-30T22:14:20.464725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.468126Z","title":"Robotics and Autonomous Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.468126Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:586f5f553249d61d9dfc9c299782bcfd72e5e78b76ef88558646420b04fd4388","observation_id":"1a11721b-1e0f-4ce3-9d94-06ff5d764340","resolution":{"observed_at":"2026-07-30T22:14:20.468126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.471586Z","title":"and Dasaklis, Thomas K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.471586Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:52824936a1f53139975849051d905cc313c2409262e5a70865c92d76e330c849","observation_id":"e3f49721-29f0-40fe-9c8d-00954177854a","resolution":{"observed_at":"2026-07-30T22:14:20.471586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.474970Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.474970Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:0753bbfe815935be20c7a2315eef484447468aaff6b08e6e82b7c693a851d169","observation_id":"8bfd05a7-23b5-476d-a181-8892cc3fec92","resolution":{"observed_at":"2026-07-30T22:14:20.474970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.478417Z","title":"IISE Transactions , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.478417Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e20a68baf44ae25e7c598325341831a4306ae6ac5de6b044783bdd40be22feb5","observation_id":"db0654d3-5f7b-4bc1-a206-eaa5cb870d7c","resolution":{"observed_at":"2026-07-30T22:14:20.478417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.481914Z","title":"Annals of Applied Sciences , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.481914Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:35c135ca413686f5b562064a2b55528b088fb0d8b7b1628790bcd9f6f1736259","observation_id":"e76f3203-87f9-40a5-908f-0b43a29c86e8","resolution":{"observed_at":"2026-07-30T22:14:20.481914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.485408Z","title":"Production and Operations Management , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.485408Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:7fa7cd0e1c8e3ef712d80b99200f3971a85f20756501decf482af13ca46423c2","observation_id":"715cd986-e175-4e6c-a13f-b3bdf981b938","resolution":{"observed_at":"2026-07-30T22:14:20.485408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.489154Z","title":"American Economic Review , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.489154Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:0ebd8e559db928de11d219f16f8c4d2edcd4f3b78ba7794511c295b412bf584e","observation_id":"98256ab4-d1dc-45f4-8568-a2ba56c70b19","resolution":{"observed_at":"2026-07-30T22:14:20.489154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.492570Z","title":"The RAND Journal of Economics , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.492570Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:8652339b7d833bc9f2f29e275d959e68b4adecd02e444d457c3ea6ad82b7906a","observation_id":"fc4738df-1f74-47a5-b984-f6219e28f831","resolution":{"observed_at":"2026-07-30T22:14:20.492570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.496139Z","title":"International journal of production research , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.496139Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:f8623ea8449d9a3143493a2931577ec757a197d5922f2a1d80fdfd460bf6560f","observation_id":"c78438e2-969e-4acc-b09e-d461303232c1","resolution":{"observed_at":"2026-07-30T22:14:20.496139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:14:20.499842Z","title":"IISE Transactions , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-07-30T22:14:20.499842Z"},"links":{"citing_paper":"/paper/2607.23434"},"observation_digest":"sha256:e8f2771cbac1b56916f59ad22ca370d04935bf5754b1e9313ad5a7515f286178","observation_id":"ea32cef8-608c-4e82-8be6-fa1d94a78b14","resolution":{"observed_at":"2026-07-30T22:14:20.499842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23434","last_updated":"2026-07-26T03:08:43Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-08T02:38:35.143189Z","submitted_at":"2026-07-26T03:08:43Z","title":"Two-Timescale Hierarchical Reinforcement Learning for Resilient Operations"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":116},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 116 outbound references and 0 inbound Pith citation observations for arXiv:2607.23434."}