{"as_of":"2026-08-11T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b98038ac64cc9f43bccaf010554b7a823a09bea9c2f1a75c7f8d473e31817d2","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:57:55.498427Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12596/citation-record","integrity":"/paper/2506.12596/integrity","json":"/paper/2506.12596/citation-record.json","paper":"/paper/2506.12596"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.930091Z","title":null,"venue":null,"work_id":"76ad0b72-59cc-4e4a-9acc-e16b8485aed1","year":2018},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.361106Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:971d155b9b3e6e2a8b831b0ca863dd965062428d24de3166b9768cde898b8a19","observation_id":"82422230-49e0-4a6a-8880-0112f8406e64","resolution":{"observed_at":"2026-08-07T00:57:55.934334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.916285Z","title":"Optimal and autonomous control using reinforcement learning: A survey,","venue":null,"work_id":"82c16f3f-d084-4010-8fa3-b6c1bfcb0155","year":2017},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.365691Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:f56622ee60300639eadd08707fd19c7cc194d133bd96f098803ed3c46c148c21","observation_id":"e1c701e1-3715-4dbf-922a-87e686d23c56","resolution":{"observed_at":"2026-08-07T00:57:55.920317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.903723Z","title":"Real- time self-learning optimization of diesel engine calibration,","venue":null,"work_id":"db2a7d98-8b4f-4b06-9a6d-20784e6611f9","year":2009},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.369730Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:057f69aeedea79fca65167b064a69dc88fcdd843f40e3767a2f266c31bf5014c","observation_id":"b3ab2b1c-667f-4398-82c4-af0583450b3a","resolution":{"observed_at":"2026-08-07T00:57:55.907711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.890583Z","title":"Convergence properties of a computational learn- ing model for unknown Markov chains,","venue":null,"work_id":"3cde675a-ec67-4a6b-823a-9d8e0470e120","year":2009},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.373634Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:9b889149de73596b132ecd31485e1b2c8eac6e28e5b02690838f5df7184cc8c7","observation_id":"d8b7b26c-cf0a-4e01-bbb6-04eae6ba27fd","resolution":{"observed_at":"2026-08-07T00:57:55.894750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.878296Z","title":"ProQuest, 2011","venue":null,"work_id":"81393f3a-00e5-434f-9b15-105dece1105e","year":2011},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.377794Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:ecc9f57fee28aca6fc2ba4695994f75cd29b7db63a3d75a01afb7bcace3b196f","observation_id":"1f6da1ac-a7f2-478f-a446-91b984f033b2","resolution":{"observed_at":"2026-08-07T00:57:55.882143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.865812Z","title":"A multi-agent deep reinforcement learning coordination framework for connected and automated vehicles at merging roadways,","venue":null,"work_id":"d53f1954-131c-4bd8-ac8e-7bf066bbd918","year":2022},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.381668Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:fceb392fa1d54beb0abd3c5551f7fbcc12d833b3ffd63a0ba4ac72eb7946f90a","observation_id":"d3ff1976-3f5f-4804-b54b-ee59115b8245","resolution":{"observed_at":"2026-08-07T00:57:55.869797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.386203Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.386203Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:d1905a88ef3f4baf77f524fdd68f27b7f9cab5a5caeb3e9fe0823643da8e76bb","observation_id":"ebf21fff-3899-4e9a-bc01-7157ff2f26ae","resolution":{"observed_at":"2026-08-07T00:57:55.386203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.389768Z","title":"Reinforcement learning-based linear quadratic regulation of continuous-time systems using dynamic output feedback,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.389768Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:5744df45bc585781692a421d48fc733403de49c3ea2d0a580c2ac07a8ef413d6","observation_id":"300101fe-0e65-4d9a-b174-57f0077f5a6a","resolution":{"observed_at":"2026-08-07T00:57:55.389768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.835678Z","title":"Jiang and Z.-P","venue":null,"work_id":"058bdcaa-73fc-408a-9efb-fbb00509dbd4","year":2017},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.393639Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:bfe687d3459e5af5de6d18d18af98270d609bd030b7bff9e1c30937445e92fd9","observation_id":"e4293cd0-acb1-4c4e-9a5a-1d76d5a26edf","resolution":{"observed_at":"2026-08-07T00:57:55.839760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.822605Z","title":"Reinforcement learning and feedback control: Using natural decision methods to design optimal adaptive controllers,","venue":null,"work_id":"784c81c7-1ee1-40c9-9ece-42fb8143eea5","year":2012},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.398434Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:414d60e5633edf9f8b2afa5a01f8a7c889a76baba90607f8d0e86520a68de321","observation_id":"09973a88-2de7-46b2-ab5f-6399cebfdb60","resolution":{"observed_at":"2026-08-07T00:57:55.826705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.809829Z","title":"A decentralized energy-optimal control framework for connected automated vehicles at signal-free intersections,","venue":null,"work_id":"a916a0dc-95a2-4773-9498-ac486f182d6b","year":2018},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.402419Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:f86bbe7152d7d2c7353445d943d590256603cea7b74eeb50ae7eec47bea96d6a","observation_id":"4227d9dd-23c2-47c7-82d1-ff8f91f7d99a","resolution":{"observed_at":"2026-08-07T00:57:55.813959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.406078Z","title":"Separation of learning and control for cyber- physical systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.406078Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:caff0a3f041e0c9b2e0da55d85e87b6bc23599451ee07f51e0fd18609031fb74","observation_id":"ca2b0500-d11e-468b-b18e-f8c3438f7a82","resolution":{"observed_at":"2026-08-07T00:57:55.406078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.409871Z","title":"Combining learning and control in linear systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.409871Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:6ea2ce0484a660a4f8223d139f5670efc96b32970c0c421c72282f20d9dced95","observation_id":"17073b28-7f97-4cd2-b509-afe96ebba5c0","resolution":{"observed_at":"2026-08-07T00:57:55.409871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.779710Z","title":"Policy gradi- ent methods for reinforcement learning with function approximation,","venue":null,"work_id":"8ea7cd65-ef3f-421c-ac03-fe105caabce0","year":1999},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.413458Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:6a7485197fa749aa0585e99ed7f8cb69f3b0e960f4eb393b176d8739f5ffd407","observation_id":"77295b92-dfb7-4b22-af76-d59b6cd14d17","resolution":{"observed_at":"2026-08-07T00:57:55.783634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.766643Z","title":"A survey of actor-critic reinforcement learning: Standard and natural policy gra- dients,","venue":null,"work_id":"366885d5-4156-4ce7-96db-acbb15f41ac5","year":2012},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.417725Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:a86153b522b3a58d916b4f5ac423023d0dc502caed5bff144cb2d2906ece59a6","observation_id":"cbd2e737-7f6c-474e-99a6-23f4acbdb018","resolution":{"observed_at":"2026-08-07T00:57:55.770817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.754002Z","title":"Trust region policy optimization,","venue":null,"work_id":"2cd7f2e4-6218-442a-bdb5-141ce8b05cf8","year":2015},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.421477Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:31ce984c9c70fde199f7235cf65a22e551cea553c467508e86e38f38118a237e","observation_id":"f557d780-a151-442b-b670-e06ee350124f","resolution":{"observed_at":"2026-08-07T00:57:55.758117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.741291Z","title":"Policy optimization provably con- verges to nash equilibria in zero-sum linear quadratic games,","venue":null,"work_id":"2eda8ad9-b8d4-42ff-a9d2-b139031c82ca","year":2019},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.425621Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:7929903b34fd92eab2859ed3d2540e794ee730ee632305438cfce4c0addc0c83","observation_id":"3b1399b3-45bd-47a0-9e47-3e9834fc623a","resolution":{"observed_at":"2026-08-07T00:57:55.745330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01626","last_updated":"2017-04-07T15:20:05Z","snapshot_observed_at":"2026-08-10T05:17:24.691576Z","submitted_at":"2016-11-05T10:49:37Z","title":"Combining policy gradient and Q-learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01626","snapshot_observed_at":"2026-08-07T00:57:55.429439Z","title":"Combining policy gradient and q-learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.429439Z"},"links":{"cited_paper":"/paper/1611.01626","citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:53562ed5f1be4ccec2949c20e4c57c45301682094e9702156d39e8c87a1520b6","observation_id":"328fca76-6e97-4472-bf4c-4bad2dbc6546","resolution":{"observed_at":"2026-08-07T00:57:55.429439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.433513Z","title":"On the sample com- plexity of the linear quadratic regulator,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.433513Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:01f8fae470748def3d202fc816723a3fb3308bde971537d5d693e042b027c1fa","observation_id":"937237a2-1a72-43aa-ae94-8082cf41dd2a","resolution":{"observed_at":"2026-08-07T00:57:55.433513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.720098Z","title":"Toward a theoretical foundation of policy optimization for learning control policies,","venue":null,"work_id":"773a5d9f-d456-4c80-8ce3-96028ca59f23","year":2023},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.437466Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:dae43bba9421114936164506e31ba31b8a6b86c1fe83b740fb791905566a5502","observation_id":"05fc4550-f16c-4d81-8a8a-86f1bb6018b8","resolution":{"observed_at":"2026-08-07T00:57:55.724037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.441571Z","title":"Global convergence of policy gradient methods for the linear quadratic regulator,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.441571Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:ab5010340d48c5c4e8093ec628e82a8c1822b74fb10072e8bb8eb06f7430fd45","observation_id":"a1b36bf2-2d4e-46c6-ae4f-5cdea9d4c8ba","resolution":{"observed_at":"2026-08-07T00:57:55.441571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.445747Z","title":"Optimizing static linear feedback: Gradient method,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.445747Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:e8a36bd3e1fce82025b81218cf4966db878f8d8c10b9dbb8721439c78297599b","observation_id":"b3a15f25-7132-437d-8288-a2ce7ab4a083","resolution":{"observed_at":"2026-08-07T00:57:55.445747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.449904Z","title":"Convergence and sample complexity of gradient methods for the model-free linear–quadratic regulator problem,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.449904Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:4cd0a0751ca90859c0695408cf35faaa7c8a3e7908dfaeb84ab0f62c22e5c762","observation_id":"3f126c5e-2784-4a51-8363-5e46c573dd32","resolution":{"observed_at":"2026-08-07T00:57:55.449904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.453534Z","title":"Global convergence of policy gradient primal–dual methods for risk-constrained LQRs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.453534Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:dcd3f96133e97bc96c800d68f9360c63c7782fa9d0f888fda291ff48ae62b7ff","observation_id":"f24c5a22-0653-4020-8004-5d136974da60","resolution":{"observed_at":"2026-08-07T00:57:55.453534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.457280Z","title":"Derivative-free methods for policy optimization: Guarantees for linear quadratic systems,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.457280Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:6faf40ff5089690389f240b8151557b371e0fb90dc4e9e470ca6de9bebff4d4d","observation_id":"dc61527c-3ae3-4f50-9410-8083306dd40b","resolution":{"observed_at":"2026-08-07T00:57:55.457280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.461277Z","title":"Distributed reinforcement learning for decentralized linear quadratic control: A derivative-free policy optimization approach,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.461277Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:f8f782b5de91e63a63181c384d108ce482cfa092f3b49fa1eacfc701fde0eff5","observation_id":"2fb86ffe-0a8b-4638-bba2-085c419a923c","resolution":{"observed_at":"2026-08-07T00:57:55.461277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.653800Z","title":"Learning-based control: A tutorial and some recent results,","venue":null,"work_id":"48545eb3-33d9-40a8-bd87-7c6182a90867","year":2020},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.465260Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:7a548456de9f861def19386d5c63d89299f7932a1d7627e12ddc66f2b30160a8","observation_id":"be7ed794-09e0-4792-a821-973dea9f9e6d","resolution":{"observed_at":"2026-08-07T00:57:55.658018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.640389Z","title":"Robust policy iteration for continuous-time linear quadratic regulation,","venue":null,"work_id":"11481a04-4265-4887-aa5a-de367ef54c47","year":2021},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.469081Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:8fccf62a74cb6d5925625c9c25e2a66bae1587698ccb9c161464d57ad612e39a","observation_id":"98d00b51-ce01-4b49-ab99-f13180a0872e","resolution":{"observed_at":"2026-08-07T00:57:55.644450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.627314Z","title":"Remarks on input to state stability of perturbed gradient flows, motivated by model-free feedback control learning,","venue":null,"work_id":"cf6cf421-7306-4de1-a068-ccb628da77ab","year":2022},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.473049Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:961ef8c7c0f7efcf57f939b299ab5b261faf8da7c37565e3ce6cab39f2e6597e","observation_id":"9f18b1a6-f6e2-4798-8e57-d01ac5f29ca7","resolution":{"observed_at":"2026-08-07T00:57:55.631509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.615035Z","title":"Small-disturbance input-to-state stability of perturbed gradient flows: Applications to LQR problem,","venue":null,"work_id":"18689628-d5aa-4f5c-93b0-54dc6eac2284","year":2024},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.476897Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:6828474e5b7c4a94b4088d52e3c3c951113b729491d5bc99d0506b038985793e","observation_id":"55af33b3-3730-4605-b502-5a3859bd692b","resolution":{"observed_at":"2026-08-07T00:57:55.618939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.602364Z","title":"Robust reinforcement learning for risk-sensitive linear quadratic gaussian control,","venue":null,"work_id":"510b2494-63e1-4237-bf34-7a9b1e99fb39","year":2024},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.480549Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:339fddbd69675d31739350746ea9195676ca7ac3cc2969e00c232adc2bed2df4","observation_id":"9d89d1c9-728f-43b6-9ef7-008c1686ce22","resolution":{"observed_at":"2026-08-07T00:57:55.606483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.589178Z","title":"Distributed zero-order algorithms for nonconvex multiagent optimization,","venue":null,"work_id":"8f264808-ca86-4b33-a542-710d415e832f","year":2020},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.484171Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:b3a834db6229a07d3d89b109021f1d3aef1e35745cd2d3099b6d99450594368b","observation_id":"79de56d4-4ead-4490-976f-b29a4a3343dc","resolution":{"observed_at":"2026-08-07T00:57:55.593165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.487760Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.487760Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:976bd937a505447bfce099c0ff61fb8876d4b37ca03ae364e141670195307ba5","observation_id":"6c5c6ba8-e470-427e-9221-2ef9046df588","resolution":{"observed_at":"2026-08-07T00:57:55.487760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.564793Z","title":"Distributed policy gradient for linear quadratic net- worked control with limited communication range,","venue":null,"work_id":"b939042b-df0d-4419-99a4-c4f6f86e2b2c","year":2024},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.491231Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:b693755b2e26299391052f1e8e0c237d264233d80686c6022fdb045bbed05ceb","observation_id":"a3232b53-0272-4492-9551-759dff052c77","resolution":{"observed_at":"2026-08-07T00:57:55.571089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.494690Z","title":"Stochastic first-and zeroth-order methods for nonconvex stochastic programming,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.494690Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:7e9d67a1e36552951bfee075dccd9db3a78e5136949b6aef34160b2935aff9bb","observation_id":"c657422c-3a12-4d0f-b07f-a8f126f5a3a2","resolution":{"observed_at":"2026-08-07T00:57:55.494690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:55.498427Z","title":"An optimal algorithm for bandit and zero-order convex optimization with two-point feedback,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:55.498427Z"},"links":{"citing_paper":"/paper/2506.12596"},"observation_digest":"sha256:1239663402e77aa11f1f4b24d334b79f7168d677eff9698683c0825a63db0aa1","observation_id":"eaea548d-12ea-4ff8-a059-ba157fa163dc","resolution":{"observed_at":"2026-08-07T00:57:55.498427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12596","last_updated":"2025-06-14T18:34:09Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-08-11T02:36:52.984761Z","submitted_at":"2025-06-14T18:34:09Z","title":"On the Robustness of Derivative-free Methods for Linear Quadratic Regulator"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.12596."}