{"as_of":"2026-08-11T12:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de62f1fa4b26a6baf921cedca5e46db58dcd93691de2b28bafa8859e77fdc99f","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T00:41:10.793158Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.05526/citation-record","integrity":"/paper/2606.05526/integrity","json":"/paper/2606.05526/citation-record.json","paper":"/paper/2606.05526"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"The development from adaptive to cognitive radar resource man- agement,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:73e7c69703522a9fd1017b6f564424b9f5ac1a25a081841955e810ccdbd9f628","observation_id":"5b10f87d-8f32-4d5e-809a-eda3a33dd16e","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Scheduling for a multifunction phased array radar system,","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:908790576b42a5b1e6cbd1b38c48ad77dab28092433c2ddeaae25dbddfa41cac","observation_id":"e33cdcaa-9c8b-4186-8c6d-0e7604084f28","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Resource management for a rotating multi-function radar,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:9f274aa57c58956b493e145f1a20f21b69d660965b5158eecbc1be73d8ad8602","observation_id":"6eb77fca-dd91-434f-8452-03fa14adfc9d","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Game-theoretic power allocation and the nash equilib- rium analysis for a multistatic mimo radar network,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:219d839bbbd2eb9b30f9192018d338d57a24901398ad8640abe19e71099c0bfc","observation_id":"b3e75156-f688-4361-8b7b-5ab11f39eb3f","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Intelligent m3r radar time resources man- agement: Advanced cognition, agility & autonomy capabilities,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:5a38f166987397bfe7fbe061998947a312db4ec3d17fb92527d1092f702ac5dc","observation_id":"6bedf49f-9679-412a-98e2-d2ed5ea409e1","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Joint power and time allo- cation algorithm in multi-radar system for cooperative target detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:e010b46db6371b51486edd9371d71b2c4d3a99b5892b3b149247b9a5925e0f4a","observation_id":"5feba52c-a403-460d-b8a5-85b055bcfe09","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Scheduling multifunction radar for search and tracking,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:6d94ccd00ead1c6f877d743e5077a5ab3dcd0f93a1d1913cf99e136a05de232a","observation_id":"c834d56e-8ed8-41b5-b705-bc71b090ff88","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Optimal balancing of multi-function radar budget for multi-target tracking using lagrangian relaxation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:dc089785435a8cba405a786a6886fc9c0ded976570d5ec5f3bc1c3ca24ce8df3","observation_id":"61b610b6-259d-4384-b3eb-6680b9b33ae6","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Optimal threat- based radar resource management for multitarget joint tracking and classification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:4214f1a28283c1584098a1fe5f2cf217a4e61427f1fc05b6e47e4991cbd00946","observation_id":"9a7e4495-e9ee-4582-884e-e3e07affec5e","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.4708","last_updated":"2013-06-21T18:07:06Z","snapshot_observed_at":"2026-08-11T00:52:46.808243Z","submitted_at":"2012-07-19T15:33:25Z","title":"The Arcade Learning Environment: An Evaluation Platform for General Agents","version":2},"cited_work":{"arxiv_id":"1207.4708","doi":null,"metadata_source":"pith","pith_arxiv_id":"1207.4708","snapshot_observed_at":"2026-07-02T21:27:23.804843Z","title":"The Arcade Learning Environment: An Evaluation Platform for General Agents","venue":"cs.AI","work_id":"fc6c1d23-5d11-4f81-b969-129abe7a8067","year":2012},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"cited_paper":"/paper/1207.4708","citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:ff10ebf5d59a110665c50f171d93b21cedb48a70940bf38858aa86fb3f612617","observation_id":"3ab21fd1-50bb-46db-aab6-f61bfee7e6be","resolution":{"observed_at":"2026-07-02T14:07:03.489591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Deep reinforcement learning control for radar detection and tracking in congested spectral environ- ments,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:0d60b65f7da3fd3034eb582ca558fb905e041441b8e9e6bb33f1714a2b4a2256","observation_id":"357db8ca-29a0-420c-a633-c660e0436f2d","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Scene-adaptive radar tracking with deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:8d0b505e77162fed9d4aa25b1c407d6fb28a824919033402ed92af6929f1160f","observation_id":"5ab7fc97-47bf-4e10-a375-1024a6dfc04d","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Quality of service based radar resource management using deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:fa93cb506b00999e50f718ca0a6c51d6f9efbe368c5947ed61587ff00c42f264","observation_id":"c9430f5e-ef80-4cf1-8821-58be24df315c","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Re- inforcement learning for adaptable bandwidth tracking radars,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:95e0e19b7390170eea511c85574b904bdf7b91cf9f88e12ef8906aefb23e0566","observation_id":"d33cd04c-d4b6-4f9d-8266-e7b5022cd261","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Deep reinforcement learning- based radar network target assignment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:f6c3a19e5dd9fc6b8c99aa3104356ff60eb57808434748b8a07cfc355c59500f","observation_id":"cadcf538-da82-4f7c-94f4-2e71190ac39e","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-07T08:33:38.128537Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":"1805.11074","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-07-04T11:39:46.348956Z","title":"Reward Constrained Policy Optimization","venue":"cs.LG","work_id":"c4fdaea7-11ae-432a-8a0c-0b650e87b855","year":2018},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:f50bb8cfe8650cee1dd4f97347aa85d4f5635187de9406f75ea513e02e2398f0","observation_id":"81ccda70-b9f1-4a00-a980-74ee669a93ce","resolution":{"observed_at":"2026-07-02T14:07:03.482200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Trust region policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:15b696da9edc72460ca24e940edcc0b6017fb20371209152436454dc23244052","observation_id":"a377cc05-2c6f-47b0-bcbe-8ab28546b86d","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Optlayer- practical constrained optimization for deep reinforcement learn- ing in the real world,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:06a85af979cac10a78fd55b37755704360d6a1f8930eade4af5723a83cfd3199","observation_id":"54346ced-c9ff-4c68-b724-1b6012c6d768","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Batch policy learning under constraints,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:26224bfe45142e94a91848934c4ab404e7b1e66d6b6986ef600d31d115ba5df2","observation_id":"416464b2-6199-46e6-b148-b1e9d668a66c","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.09394","last_updated":"2020-04-06T15:41:19Z","snapshot_observed_at":"2026-08-11T01:06:50.386881Z","submitted_at":"2020-01-26T03:38:43Z","title":"Lagrangian Duality for Constrained Deep Learning","version":2},"cited_work":{"arxiv_id":"2001.09394","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2001.09394","snapshot_observed_at":"2026-07-02T14:07:03.483422Z","title":"A Lagrangian dual framework for deep neural net- works with constraints,","venue":null,"work_id":"034d4aec-64b9-4ae3-a65a-5107c58ab145","year":2001},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"cited_paper":"/paper/2001.09394","citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:1a65384eea5e578449704e4120957945cba3758ef9c33c2b30db9e93e5d7b543","observation_id":"43c8c0b2-8a8f-474a-83d5-d94f2366d9fe","resolution":{"observed_at":"2026-07-02T14:07:03.484778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Con- strained deep reinforcement learning for energy sustainable multi-UA V based random access IoT networks with NOMA,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:83e327cfe837395fcc61c78e0756165bd903538bf686b1babbba1c3020668e35","observation_id":"3ac0de1f-d6d5-4408-b270-e3100ee70c38","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Learning optimal resource allocations in wireless systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:2a48aaa0ed1e8cfd4694557930fc5d420f9e3f2359d463964d5ff9662cd70bfb","observation_id":"b9bc0c72-64df-42d1-9140-479b7e9d7f2c","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Learning-based resource management in integrated sensing and communication systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:08dba04a929f43836db5f59ce4d98b7c2631e05493a52f98383429670096cef8","observation_id":"469bde41-cc93-4d84-9936-37c31d42d897","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Resource allocation for multi-target radar tracking via constrained deep reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:5403b0b9279738dc9e678ce0201399b4558132c50b471f21cf5a0efe314b0354","observation_id":"23509817-667a-4a40-bc3a-cee748858389","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Learning-based cognitive radar resource management for scan- ning and multi-target tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:8f14145fa2a617cb9815657c63012d712fc8fd2656dad5058c9af80a205f00d2","observation_id":"d2e25c58-40f2-4f15-bf51-e25a18326a56","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"A constrained POMDP formulation and algorithmic solution for radar re- source management in multi-target tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:40974cc6e8f6f16a0530e1408785cb2893656e89adbd5aa0879a8c4bd9fec001","observation_id":"6f1e322a-783a-41a0-98a1-668303d31dca","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Adaptive parameter control for phased-array track- ing,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:3ab4933fa77fb76c1580fb543a720d4bc5d6e9e4053240bfd74f686ace4bbcf4","observation_id":"cef9130f-210a-4f08-8988-644643c5daca","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:1209e9cb6decfcfa08bc0158ae8f438bf17763ca18ce5cf1195649754ddd92cc","observation_id":"a004389d-5f3b-4198-a3d5-9437894b1992","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Meikle, Modern Radar Systems","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:6a19857f0c84c0a3c6345e80435ae8d21e42f93a26c06e88a9773e80628f1554","observation_id":"fceb4039-3014-4b8b-9681-de96f72be179","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"An Introduction to the Kalman Filter,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:08f1b1603ae848e86755e7b19280d7bd815eb878a0781bd04fd1d09774a75522","observation_id":"d866d05c-6502-4e93-abef-66b08eb8f50f","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Determination of required snr values [radar detection],","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:bb4a3251560934dc543446893f150a260b3fb0ffa8f630b4e984eeea6505bd86","observation_id":"22a6cf23-a9e2-4ddd-8a63-d6ed4871d6cb","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T00:41:10.793158Z","title":"Altman, Constrained Markov Decision Processes","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:f8e1acb3e226775197354f012760d9aabc73adde09d88e69485cb36626a3e06f","observation_id":"c14e8c53-55cc-4790-8520-afb8c51fd3ce","resolution":{"observed_at":"2026-06-28T00:41:10.793158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":"1509.02971","doi":"10.1137/22m1480409","metadata_source":"pith","pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Continuous control with deep reinforcement learning","venue":"cs.LG","work_id":"41a65444-c819-4303-a1f1-b075aa86d40c","year":2015},"citing_paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T00:41:10.793158Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2606.05526"},"observation_digest":"sha256:aa687a65d65125593bf60d00ea6c2e7fc5e6fa4717a96ea5ba6865b177d3dd3c","observation_id":"5784c4ee-a0d8-4215-99a4-5dd915704895","resolution":{"observed_at":"2026-07-02T14:07:03.487230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.05526","last_updated":"2026-06-04T00:15:43Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-07T08:34:24.695894Z","submitted_at":"2026-06-04T00:15:43Z","title":"Constrained Deep Reinforcement Learning for Cognitive Radar Resource Management"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":28,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2606.05526."}