{"as_of":"2026-08-16T04:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ce9ee11567c8ac8f5b2c8d477016cec9df81026db69eb972b005b0e916b1a5a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:18:31.591620Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.08401/citation-record","integrity":"/paper/1908.08401/integrity","json":"/paper/1908.08401/citation-record.json","paper":"/paper/1908.08401"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.880078Z","title":"Heuristic search value iterati on for POMDPs,","venue":null,"work_id":"9c187664-4c1d-45d9-8302-f894cd417742","year":2004},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:30.952880Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:ad9dda7b2068ef4e1ad0dc42b399b9196fac889fa975865376a21050ffc3d8ec","observation_id":"1b972793-fb57-4db5-bab3-e2ed72bf0998","resolution":{"observed_at":"2026-08-14T12:18:33.884054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1207.1359","last_updated":"2012-07-04T12:15:09Z","snapshot_observed_at":"2026-08-15T00:54:25.093962Z","submitted_at":"2012-07-04T12:15:09Z","title":"MAA*: A Heuristic Search Algorithm for Solving Decentralized POMDPs","version":1},"cited_work":{"arxiv_id":"1207.1359","doi":null,"metadata_source":"pith","pith_arxiv_id":"1207.1359","snapshot_observed_at":"2026-08-14T12:18:31.718662Z","title":"MAA*: A Heuristic Search Algorithm for Solving Decentralized POMDPs","venue":"cs.AI","work_id":"c583723f-0a04-4ca8-977d-49ddba667e52","year":2012},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:30.999670Z"},"links":{"cited_paper":"/paper/1207.1359","citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:aac52e6a329bd9eab278507f0ab13d3f9469fdd4c4e3bef1b870c5e0cc08092f","observation_id":"b8ebc246-f6a9-437b-aa3a-cf3ff3cf0607","resolution":{"observed_at":"2026-08-14T12:18:31.808594Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.867928Z","title":"Monte-carlo planning in large P OMDPs,","venue":null,"work_id":"a2080da3-03e3-497a-a806-f5b169b6045f","year":2010},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.004311Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:361feae9cb0a7bf6bb9dc31395888c00a277f16c91bcb1491898c7a64d710a7d","observation_id":"4d303e5c-1b41-48a8-80a0-0f8c887fa2fd","resolution":{"observed_at":"2026-08-14T12:18:33.872174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.733300Z","title":"Monte carlo POMDPs,","venue":null,"work_id":"77197575-9cee-48f3-a5ec-dc5ff6e27696","year":2000},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.009823Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:c3ee46c7b929ea911e749e58b4f648975c66f665293e8cb084d9e27a88c17c6a","observation_id":"f2323576-bd8c-4cbe-8aaf-feaf115921ca","resolution":{"observed_at":"2026-08-14T12:18:33.829093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.617500Z","title":"Natural actor -critic,","venue":null,"work_id":"ce2eda4a-ef03-488c-8a2c-295dc654e97c","year":2005},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.014485Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:619f4a800fd0b8e9c651c39cfe7837fc1bdc62ab0981609b1b69aaef1769f994","observation_id":"0cb8b584-5458-441a-807b-c2b3bcb602cc","resolution":{"observed_at":"2026-08-14T12:18:33.621330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.603935Z","title":null,"venue":null,"work_id":"4fdf3ea9-c25e-42b2-a97b-cf5fa4a40575","year":1998},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.018176Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:4960b5f25aa716cf207f081a4b18aead39b6df8727f5c82257cda107f10221bd","observation_id":"0fe2d0e9-cd12-4bbd-951d-5908ff58f24a","resolution":{"observed_at":"2026-08-14T12:18:33.608284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.501317Z","title":"Deep reinforcement learning for dynamic multichannel access in wireless networks,","venue":null,"work_id":"5bfbb56a-ee38-44a6-aef0-a85702a5d4b3","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.022639Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:cd74564bca70377a7ca0cf6726a17c2a8d693cd1d573e96b8170b04b535c5589","observation_id":"d5da5475-f51e-4f35-b075-c0e0243ad8e6","resolution":{"observed_at":"2026-08-14T12:18:33.595816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.329251Z","title":"Full spectrum sharing in cogni tive radio networks toward 5G: A survey,","venue":null,"work_id":"1abfd3b7-ea90-45fa-ba42-d8b474094dc0","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.025969Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:c09f4da8e3253b919c296e1c8faedae198b16907aa9640872ec52b6155e772f7","observation_id":"e383e177-7f8c-4773-b15d-a43431b1c72d","resolution":{"observed_at":"2026-08-14T12:18:33.397010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.312123Z","title":"Decentralized co gnitive MAC for opportunistic spectrum access in ad hoc netw orks: A POMDP framework,","venue":null,"work_id":"dab665eb-2d89-44fb-99f2-11e3a50f0387","year":2007},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.029849Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:2ad9354ccf2529b5b7a68e4f95f1e2fc3d78f604b32a9d52914ce21c6d5c36c5","observation_id":"e5595a79-a782-4420-aa32-3fd8a1889c91","resolution":{"observed_at":"2026-08-14T12:18:33.316794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.294620Z","title":"A restless bandit formulation of opp ortunistic access: Indexablity and index policy,","venue":null,"work_id":"8e09a3bd-c7e8-48be-89cc-60e40282ae00","year":2008},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.033572Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:6a0066422413337fcbd9484c344d9111e9fd75a6bb3576fc1c589627e07b5960","observation_id":"84d18d07-7070-4449-881f-9d6efdcf82df","resolution":{"observed_at":"2026-08-14T12:18:33.299822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:33.172455Z","title":"On myopic sensi ng for multi-channel opportunistic access: structure, opt imality, and performance,","venue":null,"work_id":"86923c2c-dbd9-42bd-af27-eba16bd4d958","year":2008},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.037125Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:d885c2efae797dda14e66cba40ff279568885a62bf2b52c25af2806dc420a407","observation_id":"e393985d-7066-471d-bd38-925f8284d025","resolution":{"observed_at":"2026-08-14T12:18:33.283231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.988971Z","title":"Optimality of myopic sensing in multichannel oppo rtunistic access,","venue":null,"work_id":"56685c3f-7755-4d5d-a299-3c19d65209bf","year":2009},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.042069Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:40a988ebe963effed1858be98569d2615e19ad6c1e25b0683b1e8e053847823d","observation_id":"37baff21-9322-48e6-9c24-1e5ffac265ea","resolution":{"observed_at":"2026-08-14T12:18:33.053265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.972717Z","title":"Oppor tunistic spectrum access in unknown dynamic environment: A game-theoretic stochastic learning solution,","venue":null,"work_id":"de438a44-4f39-42a2-bd76-f2f5c70b6c83","year":2012},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.046060Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:87a71583b2d8626d307643636a08c89395b9b02b61dc335afe00a502c20d9c28","observation_id":"810463cb-db1d-4671-9cad-112f9c7b4604","resolution":{"observed_at":"2026-08-14T12:18:32.976681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.958222Z","title":"Stochastic ga me-theoretic spectrum access in distributed and dynamic en vironment,","venue":null,"work_id":"842b378e-10b1-4a4a-8765-e9e991fca403","year":2015},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.076584Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:fce11f0e910ef4aec885bfc2d509fc4fb9e11cc3004615cef36f28b60d053218","observation_id":"eb12247f-4d2d-4904-bd67-924771b41e44","resolution":{"observed_at":"2026-08-14T12:18:32.962349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.918288Z","title":"Optimally probing cha nnel in opportunistic spectrum access,","venue":null,"work_id":"dcefe84a-2eda-4ea7-af7b-5e39fff8f3fb","year":2017},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.153115Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:7559881cb82979bcd169292daabe2b7142a19ca4f707407f1a36011319ff1657","observation_id":"0914dfc4-8d27-4066-8d01-6b7eb36ef91f","resolution":{"observed_at":"2026-08-14T12:18:32.949352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.767777Z","title":"Human-level control through deep reinforcement learnin g,","venue":null,"work_id":"40604143-ece0-4ecc-8831-5d676aebe85f","year":2015},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.211870Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:26e5d6eca318dee19a23b731c92174531d418c6400287f4e82f5db2f76305622","observation_id":"205be30d-167f-4755-b234-01eda8bac9ac","resolution":{"observed_at":"2026-08-14T12:18:32.877666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.755792Z","title":"Mastering the game of go without human knowledge,","venue":null,"work_id":"ea43de45-4e99-46a5-929b-b125cfbbf50c","year":2017},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.217434Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:f424c315e9b8881d4ac4399d47edadab191d7dffa583625fc4e79b2c81dccfd1","observation_id":"062340f9-938f-4c53-9dee-6cc503586946","resolution":{"observed_at":"2026-08-14T12:18:32.759798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07862","last_updated":"2018-10-18T01:47:19Z","snapshot_observed_at":"2026-08-14T18:12:54.313604Z","submitted_at":"2018-10-18T01:47:19Z","title":"Applications of Deep Reinforcement Learning in Communications and Networking: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07862","snapshot_observed_at":"2026-08-14T12:18:31.221616Z","title":"Applications of deep reinforcement l earning in communications and networking: A survey,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.221616Z"},"links":{"cited_paper":"/paper/1810.07862","citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:f3a287db864c692eb1a1194d2b29199ce4da4df862bcc5c2847c3d0e59ac2783","observation_id":"631267c1-0cfc-41f3-9aca-6e2c2199a8c8","resolution":{"observed_at":"2026-08-14T12:18:31.221616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.04311","last_updated":"2019-01-30T12:54:32Z","snapshot_observed_at":"2026-08-14T19:37:06.741405Z","submitted_at":"2018-03-12T15:30:04Z","title":"Deep Learning in Mobile and Wireless Networking: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.04311","snapshot_observed_at":"2026-08-14T12:18:31.225829Z","title":"Deep learning in mo bile and wireless networking: A survey,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.225829Z"},"links":{"cited_paper":"/paper/1803.04311","citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:305db3967da9d037293d41ec3d12f1f69cf5a4e5d1e8766e25172715da78bc1f","observation_id":"d14ad593-80df-4412-9520-7eff368cf9b2","resolution":{"observed_at":"2026-08-14T12:18:31.225829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.741962Z","title":"Reinforcem ent learning-based NOMA power allocation in the presence of smart jamming,","venue":null,"work_id":"f0cf9785-2bdc-4675-a94e-043067d33b39","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.230661Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:fb2114afc89ee1b468c65b825c83cb6b97081210e8b41f456f9bab35e0831e1a","observation_id":"4edfe897-adf8-4095-a6ff-8a21e06ec124","resolution":{"observed_at":"2026-08-14T12:18:32.746517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.617999Z","title":"Re inforcement learning for energy harvesting decode-and-fo rward two-hop communications,","venue":null,"work_id":"763d9828-c081-41ad-bd4f-a5fcbf27e8bd","year":2017},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.235079Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:fcbc12dd319e44cbcfaa71bdc0a1d670f0ff520f815448a11ab9808cf9f4ba8f","observation_id":"0ebf822e-23ce-4f69-8668-c4cbf2c1b0d4","resolution":{"observed_at":"2026-08-14T12:18:32.692341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.543206Z","title":"Deep q-learning based dynamic resource allocation for self-powe red ultra-dense networks,","venue":null,"work_id":"13cda907-bcd3-4875-87d6-4156e24b2ea6","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.238774Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:7915a414bec5d7404051aa90a016c174bc462aea6f62c3b415c514857557951f","observation_id":"cb04ee7b-33cd-493c-a1d6-1a6230562646","resolution":{"observed_at":"2026-08-14T12:18:32.548323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.530571Z","title":"A reinforcement learning- based resource allocation scheme for cloud robotics,","venue":null,"work_id":"b1e53acf-f2e0-4337-9a54-da9fc3382ece","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.242621Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:bead23faa45168c16ce6777dde5c49278c800aeee5fcc107879e87705181cee5","observation_id":"bea19510-a6c5-4a84-95ef-b14cf9b496aa","resolution":{"observed_at":"2026-08-14T12:18:32.534405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.518751Z","title":"Deep reinforcement learning for reso urce allocation in v2v communications,","venue":null,"work_id":"7cdc53f2-c7e3-45cc-9d67-3a11072d62d4","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.246281Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:2219c30ccfc8058b54490e8045b9d9d0a0e712e90bf84ff323c2c9e6713dbe53","observation_id":"c41436ce-0159-457d-abe4-e5b9c1237507","resolution":{"observed_at":"2026-08-14T12:18:32.523266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.396066Z","title":"User scheduling and resource allocation in hetnets with hybrid energy supply: A n actor-critic reinforcement learning approach,","venue":null,"work_id":"c671481a-20f3-49cc-9305-5966df682fae","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.249801Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:c42a8f2748de06a0145c522bafa304c9a33e07c2e2cdd146786557d2ebf01627","observation_id":"23977c01-ce6b-43d3-9662-522319646191","resolution":{"observed_at":"2026-08-14T12:18:32.455523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.04582","last_updated":"2019-01-15T22:01:22Z","snapshot_observed_at":"2026-08-14T19:10:40.160730Z","submitted_at":"2018-05-27T15:04:58Z","title":"Reinforcement Learning-based Resource Allocation in Fog RAN for IoT with Heterogeneous Latency Requirements","version":2},"cited_work":{"arxiv_id":"1806.04582","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.04582","snapshot_observed_at":"2026-08-14T12:18:31.625332Z","title":"Reinforcement Learning-based Resource Allocation in Fog RAN for IoT with Heterogeneous Latency Requirements","venue":"cs.NI","work_id":"82513801-63fc-49f6-a741-a81b13be21f9","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.301431Z"},"links":{"cited_paper":"/paper/1806.04582","citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:3cbc3e01cc73713f4f7e4fee51d3176e3d076395da1a13e1fae08f01991f19a3","observation_id":"312efc86-ff35-4fd9-b6bb-247cc4292a19","resolution":{"observed_at":"2026-08-14T12:18:31.647423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.348559Z","title":"Deep-reinforcement lear ning multiple access for heterogeneous wireless networks,","venue":null,"work_id":"fe9f5a93-0672-49e6-a471-9b8ec504edd9","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.367386Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:0107e2b2754beb5255d6380be60730a6966c0d18a9992b66fb6448b693af2898","observation_id":"ecda291c-2a52-4940-9aa3-226efb9b131d","resolution":{"observed_at":"2026-08-14T12:18:32.387746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.303412Z","title":"Online learning for multi-channel opportunistic access over unknown Marko vian channels,","venue":null,"work_id":"9d221933-8551-47f0-9ff1-b4c2b59b0060","year":2014},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.438691Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:50afb67b7e066bd451dba91cd605f360d38fa9c6d66f83440616719be77cb06f","observation_id":"9eff475d-c9cb-40c4-bdc5-48a0b1652c25","resolution":{"observed_at":"2026-08-14T12:18:32.321004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.284957Z","title":"Model free dynam ic sensing order selection for imperfect sensing multichan nel cognitive radio networks: A Q-learning approach,","venue":null,"work_id":"ec1aacda-fac1-4c5d-959f-4af064ce932c","year":2014},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.442305Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:594edbee1e964d09c8d87b34694c7e7affb4d9644ffffa2486e8a93a7cd2478d","observation_id":"4fdd4e1c-0a9f-457b-9dd7-3efd1917bc0b","resolution":{"observed_at":"2026-08-14T12:18:32.291222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.133440Z","title":"Deep multi-user reinforcem ent learning for distributed dynamic spectrum access,","venue":null,"work_id":"bf60e377-d063-473a-90c0-59776aa91b51","year":2019},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.446059Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:6d510c70ef1a12be53fbae9ed1c869d4e6f9aab01e6d605dd08eafb5494f0d37","observation_id":"065bccbe-cba5-4522-8ad5-43dfb1d7e6e5","resolution":{"observed_at":"2026-08-14T12:18:32.261692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:32.116788Z","title":"Deep reinforcement learning based dynamic channel allocation algorithm in multibeam sa tellite systems,","venue":null,"work_id":"561f12fa-b1fa-4db7-84d1-7b35804c99ce","year":2018},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.449797Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:bd33f0fb10285896dc3c4b8d4049ba2242814ffdad8d4646f06b71f161ac5d56","observation_id":"d8cbea98-03d9-433d-b1c4-0fc8dd7bfbfa","resolution":{"observed_at":"2026-08-14T12:18:32.122295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:31.996653Z","title":"Multiagent Q-learning for aloha-like spectrum access in cognitive radio systems,","venue":null,"work_id":"ce2e8c42-bf9e-4efe-8f4b-51aec84ad7f5","year":2010},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.506481Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:5c79ae40d4d38dd08e78020768905843f2446a4d7ed22c25e39eca06ebfc8b22","observation_id":"dfbc972d-6b7f-4b3e-a794-d6b0d1e4fadc","resolution":{"observed_at":"2026-08-14T12:18:32.055431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:31.918774Z","title":"Distribu ted reinforcement learning based MAC protocols for autonom ous cognitive secondary users,","venue":null,"work_id":"6a90cded-a6c8-458a-b4eb-9846a0e88687","year":2011},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.583430Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:848ff6ad3514080030250c619295f4893c53c2254aea86d90973c0b6be07a062","observation_id":"7d03cdf7-7976-4f34-af95-60a3a0212dd7","resolution":{"observed_at":"2026-08-14T12:18:31.949948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:31.905284Z","title":"Enhancing network performance in distributed cognitive radio networ ks using single- agent and multi-agent reinforcement learning,","venue":null,"work_id":"b62c0727-3ad4-49ee-8ad1-f89ef2066316","year":2010},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.587730Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:9ada2534f4211543690126c7764da0616626970b4aa75544836016bb419d9c0e","observation_id":"d0d2a0f6-ef47-4eef-a486-95c9e90daf12","resolution":{"observed_at":"2026-08-14T12:18:31.909927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:18:31.893173Z","title":"Indexability of restless bandit pro blems and optimality of Whittle index for dynamic multichan nel access,","venue":null,"work_id":"fa977ebd-54e8-439d-8359-ae4275901ff8","year":2010},"citing_paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T12:18:31.591620Z"},"links":{"citing_paper":"/paper/1908.08401"},"observation_digest":"sha256:add0108cfc9df8777b8257e2780c21b816c7cc38961cbbaed48c148ec6ed7099","observation_id":"f07c9ec6-f283-40b0-95ed-e223f473a08d","resolution":{"observed_at":"2026-08-14T12:18:31.896764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.08401","last_updated":"2019-08-20T20:19:35Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T03:34:29.366273Z","submitted_at":"2019-08-20T20:19:35Z","title":"A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:1908.08401."}