{"as_of":"2026-08-22T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5027573712ca992ee515d42a5d0b2e681639e56f5999774266fd60724ad097ed","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:09:21.778427Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.01953/citation-record","integrity":"/paper/2505.01953/integrity","json":"/paper/2505.01953/citation-record.json","paper":"/paper/2505.01953"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.217019Z","title":"TheNeedforCollaborative CombatAircraftforDisruptiveAirWarfare,","venue":null,"work_id":"934ef69d-78a2-4425-9cc6-e94a7d03b4be","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.455679Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:5676e418c1d96016b715d60a7f18ce462a516e173aee7eb947bc038d4bb242cb","observation_id":"0f0038f1-102b-473c-a89e-5eed1b0fb06c","resolution":{"observed_at":"2026-08-16T04:09:23.223299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"article/3754980","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.476118Z","title":"Air Force exercises two Collaborative Combat Aircraft option awards,","venue":null,"work_id":"b2a06375-57d7-4a48-9269-d56d9e329fd8","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.463306Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:f9d31ef4897c32fdb0a2c98bad6d3d16f577e2548dc07170fda905a868ecba83","observation_id":"f10128af-087d-4372-98ab-08794a1cf304","resolution":{"observed_at":"2026-08-16T04:09:22.487606Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.186318Z","title":"Air Combat Evolution,","venue":null,"work_id":"318917f4-4d73-4fbe-ae9b-b1e19c409f46","year":2016},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.470918Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:20bb1df21fd3e36ea3235b7e6efecc580fb925794e6008b65db52e292f8c5cbd","observation_id":"f562781e-a396-471e-8248-f43897c9013f","resolution":{"observed_at":"2026-08-16T04:09:23.197979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.156889Z","title":"DARPA calling for AI ‘reinforcements’ to bolster US air combat capability,","venue":null,"work_id":"c9ffe528-03f2-48f3-95f0-3413e3060636","year":2022},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.490204Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:c438801557164a6a02332b2fb77c212f63346fc84bb5d0e0cf910a63a4673290","observation_id":"9a504b23-1775-4616-bf5a-4939e726ce8f","resolution":{"observed_at":"2026-08-16T04:09:23.164456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"article/3728795","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.367631Z","title":"F-16s arrive to be modified for autonomous testing,","venue":null,"work_id":"f97c4faf-ad39-45e9-be5c-4f64a5200879","year":2016},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.500371Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:e80570150d12cb2fd4b889cebe5b62971af41127cadc6499c9b6c44c2b0abda6","observation_id":"4ed5b6fa-6044-4e64-8b36-96490fd02c7e","resolution":{"observed_at":"2026-08-16T04:09:22.376416Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.128418Z","title":"Airsim: High-fidelity visual and physical simulation for autonomous vehicles","venue":null,"work_id":"cb0fae85-b95f-4b59-b723-f4b78d1364eb","year":2017},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.507049Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:47b5df2354e9af273542ddd377c7d47cc631228a1d91a219c20b33508fa54220","observation_id":"8034119e-30e8-4741-9e58-9a3eef5c9222","resolution":{"observed_at":"2026-08-16T04:09:23.137579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.103833Z","title":"Learning to fly—a gym environment with pybullet physics for reinforcement learning of multiagent,","venue":null,"work_id":"b4d77f40-4af7-41b8-8b75-28a1e7b9ecb5","year":2021},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.514118Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:070c2a40353dec631fad2735727e4bf2c3c64ad5ecfa82397b58f209b7d80d82","observation_id":"155c66cf-61eb-46ac-a72f-4809ef85b78a","resolution":{"observed_at":"2026-08-16T04:09:23.112460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.079441Z","title":"DCS World,","venue":null,"work_id":"66bf4f9d-b0aa-4468-90c3-2ec272d6aec7","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.519675Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:7e1d0317be5d4a0aea1405a0a846c5d3570b229b4bd2b73129944a6369bd249f","observation_id":"efc5e096-2c00-4024-9e30-e8dad284be4b","resolution":{"observed_at":"2026-08-16T04:09:23.087159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.056474Z","title":"Flight Simulator X,","venue":null,"work_id":"80f05a09-4caf-4480-853a-55533853cad6","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.526400Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:28fda9d8c88d66c0da8e2b23a80a9c7b715d9bb6d4ba244d0a440a4062be6f51","observation_id":"54f76f36-b310-4b7e-a7c1-68647f0bcbee","resolution":{"observed_at":"2026-08-16T04:09:23.065125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.026787Z","title":null,"venue":null,"work_id":"33555e0c-e2b6-403d-8261-2ec3d6f7d6d9","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.537755Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:3903d0c6a664da6d5ce09c5b3be2d2c495b784d8aa71c3f2055a0d525c715230","observation_id":"87f57c17-64a0-4f78-8559-03394acad6dc","resolution":{"observed_at":"2026-08-16T04:09:23.033812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07282","last_updated":"2022-10-13T18:18:09Z","snapshot_observed_at":"2026-08-16T16:24:22.179763Z","submitted_at":"2022-10-13T18:18:09Z","title":"Harfang3D Dog-Fight Sandbox: A Reinforcement Learning Research Platform for the Customized Control Tasks of Fighter Aircrafts","version":1},"cited_work":{"arxiv_id":"2210.07282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.07282","snapshot_observed_at":"2026-08-16T04:09:22.281492Z","title":"Harfang3D Dog-Fight Sandbox: A Reinforcement Learning Research Platform for the Customized Control Tasks of Fighter Aircrafts","venue":"cs.RO","work_id":"2d8d5b01-22d8-42d9-bf31-e5cb67c18f73","year":2022},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.547557Z"},"links":{"cited_paper":"/paper/2210.07282","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:7fa25b3ab9ed61cc3eb9754b34fa07b666c5f7d86cbc0b4f0d18524f5f5c6fb4","observation_id":"c83abcec-c933-468d-8fc0-e7be842b7578","resolution":{"observed_at":"2026-08-16T04:09:22.287784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.00541","last_updated":"2022-12-24T00:50:53Z","snapshot_observed_at":"2026-08-21T07:40:47.024782Z","submitted_at":"2022-12-01T14:47:47Z","title":"Predictive Sampling: Real-time Behaviour Synthesis with MuJoCo","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.00541","snapshot_observed_at":"2026-08-16T04:09:21.555580Z","title":"Predictive Sampling: Real-time Behaviour Synthesis with MuJoCo ,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.555580Z"},"links":{"cited_paper":"/paper/2212.00541","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:b73288173b895af602625e1344f7f6233543b0eaef913ed864a3c73fa24327e0","observation_id":"336fcc71-0bfb-4853-8f1a-1f20769b6de2","resolution":{"observed_at":"2026-08-16T04:09:21.555580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.4708","last_updated":"2013-06-21T18:07:06Z","snapshot_observed_at":"2026-08-20T02:06:05.602175Z","submitted_at":"2012-07-19T15:33:25Z","title":"The Arcade Learning Environment: An Evaluation Platform for General Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.4708","snapshot_observed_at":"2026-08-16T04:09:21.562180Z","title":"The Arcade Learning Environment: An Evaluation Platform for General Agents,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.562180Z"},"links":{"cited_paper":"/paper/1207.4708","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:eb0b398d78da5a891984d2816a1ab78bb19683f3fb793e4b06970f2cdd7dc897","observation_id":"5fa0aae1-8084-4440-aa52-716165dc267c","resolution":{"observed_at":"2026-08-16T04:09:21.562180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02341","last_updated":"2019-07-14T17:49:51Z","snapshot_observed_at":"2026-08-14T17:47:44.939866Z","submitted_at":"2018-12-06T04:29:29Z","title":"Quantifying Generalization in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02341","snapshot_observed_at":"2026-08-16T04:09:21.569818Z","title":"Quantifying Generalization in Reinforcement Learning ,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.569818Z"},"links":{"cited_paper":"/paper/1812.02341","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:8fa9754391b6304938fe57619b233880aa031c14d4eae937b4c6ba0860d5041a","observation_id":"191cbe3a-f65c-4ff7-a7a0-1b98c8bf84bf","resolution":{"observed_at":"2026-08-16T04:09:21.569818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:23.004965Z","title":null,"venue":null,"work_id":"7cba1899-89b7-4bcc-bc19-7a0e26fd8a95","year":1951},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.577545Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:32939514af9b98182660217d3753e82bab2806e90246b7baf38ead44d61763e2","observation_id":"9f75c843-b7f0-463f-9e7e-e5af3276b424","resolution":{"observed_at":"2026-08-16T04:09:23.011082Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.977705Z","title":"Rule-based air combat simulation,","venue":null,"work_id":"aa62f122-0a24-45e7-8e6a-0a6865d22b62","year":1988},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.583368Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:b8a9b1f70307dd812b27f2ce174f317aa959cd0f56dfb255c9d4e19458c35e6d","observation_id":"ae142e93-82aa-43b9-bb5c-8c2e7a2df7cd","resolution":{"observed_at":"2026-08-16T04:09:22.985056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.953565Z","title":"Air-combat strategy using approximate dynamic programming,","venue":null,"work_id":"50ee3531-80a1-444d-bfb6-2b091e1195e3","year":2010},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.588890Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:b188bc67873ac35d494f1a550721fc04ad7555fe39ce984ad83e818f043481e7","observation_id":"a8d5bb67-2273-4a77-a3b3-f488fc0a8920","resolution":{"observed_at":"2026-08-16T04:09:22.960600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.928502Z","title":"SecAF Kendall experiences VISTA of future flight test at Edwards AFB,","venue":null,"work_id":"374402d6-70e6-4006-9788-3eee09e0ce9a","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.595202Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:2640141436f904fa5d0d51402cdd4d007da1bf64db69f7c54d9d5c139d0b9ef3","observation_id":"3fbde8d4-5340-4155-bed5-9952d29a4c19","resolution":{"observed_at":"2026-08-16T04:09:22.935617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.907332Z","title":"The New VISTA Simulation System Design and Implementation,","venue":null,"work_id":"544aa553-714d-48bf-8532-ff2a0359078b","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.600576Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:e22aead6eef26bb755c6ab4e4374a7608bade4e2535d7811cc693e2d27b3808b","observation_id":"9cff4a70-9741-491e-a3ec-7bc3cef2f1ec","resolution":{"observed_at":"2026-08-16T04:09:22.915125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.886138Z","title":"Revealing the Dark Side of the F-16 - FLCS,","venue":null,"work_id":"40b3e171-fb8d-444e-a83e-7087d4298ec5","year":null},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.606824Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:bc1451c1915bca04d3f193f7716fa5dda51fcb792b2048d469d998f0177f07ed","observation_id":"454dd41e-6c19-485b-b7a7-637d7ba3e26f","resolution":{"observed_at":"2026-08-16T04:09:22.894573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.868887Z","title":"Fly by Wire Flight Control Systems,","venue":null,"work_id":"039ddb53-ca0b-441b-8de0-fdd60501443b","year":1968},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.613685Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:89c8529be77843f5d147c2695cafad5289632afbff19b5bab1438191153f77ea","observation_id":"72878af8-c1e3-487e-92b8-c9dfadee80ce","resolution":{"observed_at":"2026-08-16T04:09:22.873620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.850598Z","title":"Verification Challenges in F-16 Ground Collision Avoidance and Other Automated Maneuvers,","venue":null,"work_id":"1f69df24-23d7-4a37-a3dd-3b5eece17447","year":2018},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.619339Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:2b14265934fca62a70055ecc6322ffb088dc4c44c089b6cfb94cc7763b1228d7","observation_id":"c4024589-1a83-4726-8e02-8809c2d287b3","resolution":{"observed_at":"2026-08-16T04:09:22.856904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.831297Z","title":null,"venue":null,"work_id":"474aa243-30b2-4db1-9c89-35cf08486e0e","year":2015},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.625922Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:fccd426cacb7149114d975f135df2dda55f5331854ffa897a44e18ff7a597bd4","observation_id":"74f05d19-ac25-429e-a731-5d031307c313","resolution":{"observed_at":"2026-08-16T04:09:22.837993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.805869Z","title":"W.,A Dictionary of Aviation, Osprey Publishing, 2016","venue":null,"work_id":"5797ca5c-375a-4d85-8cda-938bbe6aa3e1","year":2016},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.632810Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:974bf6a11d2f21b16c1877d2856bf3a2d7431ecca56298071995d986dc1db221","observation_id":"bb806378-9d60-45d6-82d7-ba0223e410ce","resolution":{"observed_at":"2026-08-16T04:09:22.813635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.779249Z","title":"PID/First-Order Control Design for a Bank of F-16 Longitudinal Dynamic Systems,","venue":null,"work_id":"c823b625-9d63-4628-a7a9-f7933fab2b0d","year":2020},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.639407Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:3088cb7ca7fc5b36b6550f172f780c8392b0e943f1248c1041d1f84237025da0","observation_id":"2418f057-e85d-45c4-9e6e-332844dde3be","resolution":{"observed_at":"2026-08-16T04:09:22.787618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.741933Z","title":"USAF Finishes Flight Tests of F-16 Autonomous Gun System ,","venue":null,"work_id":"e5f2c4e6-c200-496d-899e-34c18706ee86","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.648187Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:da4e6faf217b0e44310327d1a55832d1080e97f097a46b27a3ad8c059a0326c9","observation_id":"163fd82e-28bf-42d7-ab7f-b90c167b77d2","resolution":{"observed_at":"2026-08-16T04:09:22.747770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:21.654890Z","title":"A survey of air combat behavior modeling using machine learning ,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.654890Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:84b6c1191aacdc54a6fed9f64a5a15925e55a22965db3750b13737a70f8f23f9","observation_id":"c7f73beb-92e6-4a39-8df3-4c63b1abf37b","resolution":{"observed_at":"2026-08-16T04:09:21.654890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.721437Z","title":"Imitation learning for modelling air combat behaviour,","venue":null,"work_id":"f66d6524-c9d2-4ea3-b73d-0e9df82dee1c","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.661105Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:90f577e8290dc93fc9db45a8105d0eeb5c3caa2017d9d70010216ee18590802c","observation_id":"683030c3-1844-47df-9d1b-e2d7b398352d","resolution":{"observed_at":"2026-08-16T04:09:22.726737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.699175Z","title":"Robust flight navigation out of distribution with liquid neural networks,","venue":null,"work_id":"a03453b2-91f8-4c04-91e9-6d234f632bf0","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.667306Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:e1f2e210623f400e062b2d6d954972845efad7d019aec9299c82f3f66a1473a0","observation_id":"38ecd24c-bc85-400f-ab0c-cfbc4c0a3ea9","resolution":{"observed_at":"2026-08-16T04:09:22.704842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00990","last_updated":"2026-07-20T15:44:29Z","snapshot_observed_at":"2026-08-16T18:27:21.936455Z","submitted_at":"2021-05-03T16:40:00Z","title":"Hierarchical Reinforcement Learning for Air Combat at DARPA's AlphaDogfight Trials","version":3},"cited_work":{"arxiv_id":"2105.00990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.00990","snapshot_observed_at":"2026-08-16T04:09:22.093042Z","title":"Hierarchical Reinforcement Learning for Air Combat at DARPA's AlphaDogfight Trials","venue":"cs.LG","work_id":"55cc6982-6013-4198-ae69-2fa2b526bba4","year":2021},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.672589Z"},"links":{"cited_paper":"/paper/2105.00990","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:2529f8d59f14a890f053a3fbcf2f5d61f7bf46c23f29a0c3c056d5df026a3603","observation_id":"cb5fd33f-6095-4410-afed-70e631459a7b","resolution":{"observed_at":"2026-08-16T04:09:22.101765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.678989Z","title":"Viper Shield All Digital Electronic Warfare Suite,","venue":null,"work_id":"bdd164bb-f1bc-45eb-8deb-2c00ba6a8353","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.680095Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:8ffcb09a2de6650d30a31d83546d8a3a116ce5780f5dac2dadfe86ca874b8b59","observation_id":"fb04894c-80eb-4bef-bc15-e1d5b3d4bd7b","resolution":{"observed_at":"2026-08-16T04:09:22.685114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1002845","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.060330Z","title":"Resolving Range and Velocity Ambiguity Effectively and Efficiently with GPU,","venue":null,"work_id":"8819d2d3-a9ea-464d-b7da-7941872e0905","year":2021},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.686833Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:70f913ae0a9c43d8f8d4c93d9907c2df53db14608decaaf62faf7c625c3b2b2d","observation_id":"ace7fae5-9c13-4849-9386-9f9b02c4e6bf","resolution":{"observed_at":"2026-08-16T04:09:22.069502Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.653122Z","title":"The Development and Use of an Inertial Navigation System as a DP Position Reference Sensor (IPRS),","venue":null,"work_id":"8f599443-ca32-4cef-8a17-29b9da5a9907","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.692708Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:34e2f25f7d272522f5d769ac01482a6e7a7825e7a5ab9e8416287eb9dd817245","observation_id":"c5c04b3a-df9d-4c74-93e6-42aab4511f7d","resolution":{"observed_at":"2026-08-16T04:09:22.661773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.634083Z","title":"Great Power Competition: Implications for Defense—Issues for Congress,","venue":null,"work_id":"9a691e6a-8a96-4552-a96a-822ff25d0231","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.700592Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:d49de6ad16790f2f125cb41c47cfc312a9f7d7667462f3c421da02ac6318a402","observation_id":"3a23d594-48d1-4074-b38e-fc6cac2345ef","resolution":{"observed_at":"2026-08-16T04:09:22.639874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09889","last_updated":"2023-02-02T19:14:30Z","snapshot_observed_at":"2026-08-16T16:51:43.107229Z","submitted_at":"2022-06-20T16:51:44Z","title":"Nocturne: a scalable driving benchmark for bringing multi-agent learning one step closer to the real world","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09889","snapshot_observed_at":"2026-08-16T04:09:21.707697Z","title":"Nocturne: a scalable driving benchmark for bringing multi-agent learning one step closer to the real world,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.707697Z"},"links":{"cited_paper":"/paper/2206.09889","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:1a6182ac08ededfa3a3e3f4bdb294c89cc919829936f042165725cb9da00c8e4","observation_id":"e18bb222-a6a9-4daa-bad2-9690a043755e","resolution":{"observed_at":"2026-08-16T04:09:21.707697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.615659Z","title":"Pentagon secures 500M for first tranche of Replicator systems,","venue":null,"work_id":"ed62e697-acab-4a96-b3a2-366a381e7f0f","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.714458Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:e1695d930158e688b7b3b9046c4af85485fb355d13efc39fa6af6f3f91092fc7","observation_id":"579e2a5d-2041-4513-952f-ff1f4535c8a0","resolution":{"observed_at":"2026-08-16T04:09:22.621112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.595153Z","title":"Viper Shield All Digital Electronic Warfare Suite,","venue":null,"work_id":"61ab47c6-50e0-4121-8be0-9dcb77ad6fd0","year":2024},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.725229Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:6cb681adcf9b1028dd936583f412ad3b6a67ad4a8a5ffb3a8b6334c41c675f65","observation_id":"296949a0-1328-44f4-8607-a1284a559907","resolution":{"observed_at":"2026-08-16T04:09:22.601309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.572427Z","title":"R.,Introduction to Aircraft Flight Mechanics: Performance, Static Stability, Dynamic Stability, Classic, AIAA Education Series, 2016","venue":null,"work_id":"1ac9d668-218f-4fb0-ba2b-78932168c635","year":2016},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.733446Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:2e09ba514c29a0701bedc27e481390abcd399acecd39d9a26ce404bb220634a8","observation_id":"5352108d-9cbc-4b1a-8e8d-96f5bfdfd98f","resolution":{"observed_at":"2026-08-16T04:09:22.578633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05085","last_updated":"2022-11-09T18:17:16Z","snapshot_observed_at":"2026-08-16T16:17:24.333056Z","submitted_at":"2022-11-09T18:17:16Z","title":"Automated Learning: An Implementation of The A* Search Algorithm over The Random Base Functions","version":1},"cited_work":{"arxiv_id":"2211.05085","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.05085","snapshot_observed_at":"2026-08-16T04:09:21.833647Z","title":"Automated Learning: An Implementation of The A* Search Algorithm over The Random Base Functions","venue":"physics.data-an","work_id":"edb79e28-a0d5-4b77-94de-f266d0cec4c6","year":2022},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.758015Z"},"links":{"cited_paper":"/paper/2211.05085","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:a5959eb0837e566e4fd5eefa657232ace2ea877dfbf9e4797e5884e50dbb9dce","observation_id":"123fae42-8e7f-40ac-8405-8ce4207dca64","resolution":{"observed_at":"2026-08-16T04:09:21.841904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.550871Z","title":"Gigastep - One Billion Steps per Second Multi-agent Reinforcement Learning,","venue":null,"work_id":"7866d0de-5bc0-4369-9d7a-f30ec15385f8","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.766852Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:5c78a65fb7f566b77a3afe654ae4e842c1e38eb753c324cb1ef16c9d145fe55f","observation_id":"de946f24-3be1-43e6-8a0f-7b0876a14ae2","resolution":{"observed_at":"2026-08-16T04:09:22.558907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.527483Z","title":"LOYAL WINGMAN, FLOCKING, AND SWARMING: NEW MODELS OF DIS- TRIBUTED AIRPOWER,","venue":null,"work_id":"7e9c4d7d-6ddb-48bc-9d09-56c923f227a8","year":2018},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.772933Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:4425359857ca195f94f29a94b452217085f88acba3c0eeb98db6d3b37243f8ed","observation_id":"5d449e15-4ce1-4df9-bf48-e34e0751ccf5","resolution":{"observed_at":"2026-08-16T04:09:22.533955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:09:22.501736Z","title":"DARPA Tiles Together a Vision of Mosaic Warfare,","venue":null,"work_id":"81e6281a-3324-4a7d-af64-686d03cd1c51","year":2023},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.778427Z"},"links":{"citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:d0a85ed882973c136df6035f7434a8b0d20fc45b1322d83499d85a5afbe633e3","observation_id":"977411ec-c9b8-4e56-aad1-67e925954585","resolution":{"observed_at":"2026-08-16T04:09:22.508260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04439","last_updated":"2020-12-14T22:23:52Z","snapshot_observed_at":"2026-08-21T17:11:10.224890Z","submitted_at":"2020-06-08T09:53:35Z","title":"Liquid Time-constant Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04439","snapshot_observed_at":"2026-08-16T04:09:21.483490Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.483490Z"},"links":{"cited_paper":"/paper/2006.04439","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:3df8c647ec5e3169a5ee6f53b8ecb51a5eb040bf9a6d50b52d1d90fff39fd2ce","observation_id":"3bb2e378-e311-4c9b-b834-5c05a4ece309","resolution":{"observed_at":"2026-08-16T04:09:21.483490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09286","last_updated":"2024-04-02T17:18:19Z","snapshot_observed_at":"2026-08-16T14:26:45.143694Z","submitted_at":"2024-01-17T15:40:11Z","title":"Deployable Reinforcement Learning with Variable Control Rate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09286","snapshot_observed_at":"2026-08-16T04:09:21.748731Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:09:21.748731Z"},"links":{"cited_paper":"/paper/2401.09286","citing_paper":"/paper/2505.01953"},"observation_digest":"sha256:b191e15331649990a9ff4597e6567a2095c7335e1cc4aeb2f8ca056294424275","observation_id":"88c56777-fadb-46bb-a61a-cbd67d8fa189","resolution":{"observed_at":"2026-08-16T04:09:21.748731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.01953","last_updated":"2025-05-04T01:09:15Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T22:48:02.187313Z","submitted_at":"2025-05-04T01:09:15Z","title":"Training Environment for High Performance Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":6,"verified_fuzzy":28},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2505.01953."}