{"as_of":"2026-08-11T11:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0aec1c2608eb2856baae4f55e05623d10e01f75c365d83d77a8583d7a6aa028d","coverage":[{"denominator":217,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T16:14:25.741686Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.05208/citation-record","integrity":"/paper/2606.05208/integrity","json":"/paper/2606.05208/citation-record.json","paper":"/paper/2606.05208"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Deep reinforcement learning for autonomous driving: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4edc44aeb4b7514c9caf491dce503c223027ca82739fe5c69ad56506ab14c3d8","observation_id":"7d870129-0218-4762-a44a-4d17fba4054d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Rein- forcement learning for mobile robotics exploration: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:41fe1fb48edcaab0b67721ab08b73ea89d5583a84c13c8e60304422c5e24d721","observation_id":"08f8049b-6452-4660-9c12-91caf434e8aa","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Reinforcement learning based recommender systems: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:b1d126912ed9d39e7f7ad1c260d6fdda0e3baa58cda6883386a5a35825443d76","observation_id":"67b7a6f8-f267-4b08-b339-723e1a38e9db","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.00574","last_updated":"2021-05-25T19:41:40Z","snapshot_observed_at":"2026-07-06T11:14:50.038790Z","submitted_at":"2021-05-25T19:41:40Z","title":"Deep Reinforcement Learning for Radio Resource Allocation and Management in Next Generation Heterogeneous Wireless Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2106.00574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.00574","snapshot_observed_at":"2026-07-02T11:16:53.548980Z","title":"Deep reinforcement learning for radio resource allocation and man- agement in next generation heterogeneous wireless networks: A sur- vey","venue":null,"work_id":"236038cf-541b-4d43-b0a8-c3f4c24ee247","year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2106.00574","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:72a4c6d9a568227009b5b64c711cbdd2ee99f60dd78e643fdb94ca2b385f51b7","observation_id":"3f43c991-ea26-4f37-9ee0-66fd88b71ded","resolution":{"observed_at":"2026-06-29T16:23:39.732835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Multi-agent deep reinforcement learning-based task scheduling and resource sharing for o-ran-empowered multi-uav-assisted wireless sensor networks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:e8b6f098339442267a531244c4876c7abcb7477fa3fc7071649be69926eb0c70","observation_id":"17cf61ae-0307-4423-90ca-18fa5e92b729","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Toward autonomous multi-uav wireless network: A survey of reinforcement learning-based approaches,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:c5b108453ce3a3cb3d72f58201a86378ce222508e9baf875e73766c54583ed50","observation_id":"50ea32f9-df4c-4aa4-9638-b35163eb1b2d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Applications of deep reinforcement learning in communications and networking: A survey,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:b8e79de89f2dcadb8a3281b962cd192364c6501854a31782e3f019ff6dd0d559","observation_id":"6a768d39-fee5-406c-85b6-e48e05ce170b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05979","last_updated":"2023-07-12T07:51:12Z","snapshot_observed_at":"2026-07-06T15:53:07.429379Z","submitted_at":"2023-07-12T07:51:12Z","title":"Transformers in Reinforcement Learning: A Survey","version":1},"cited_work":{"arxiv_id":"2307.05979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.05979","snapshot_observed_at":"2026-07-04T16:29:57.129451Z","title":"Transformers in reinforcement learning: a survey,","venue":null,"work_id":"e77e2a9f-08ca-44dc-b45f-8fabc85cb13d","year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2307.05979","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:eb1b3a90d945163d620dc8c12c731aa364fe1c8c99d9af0d67337a196af0aa60","observation_id":"ebb56082-8c9f-4604-8eb6-e849e78c91fa","resolution":{"observed_at":"2026-06-29T16:23:39.735772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09481","last_updated":"2024-11-19T16:55:55Z","snapshot_observed_at":"2026-08-07T03:30:45.524834Z","submitted_at":"2022-02-19T00:30:52Z","title":"TransDreamer: Reinforcement Learning with Transformer World Models","version":2},"cited_work":{"arxiv_id":"2202.09481","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.09481","snapshot_observed_at":"2026-07-04T17:29:59.391915Z","title":"Transdreamer: Reinforcement learning with transformer world models","venue":null,"work_id":"69ab157c-da44-4997-a4fc-04e2dfce66cc","year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2202.09481","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:6c461313bbefa73fec13f31293bf9e50d51d1d7ff81ebe3d19143c9f1ee0af84","observation_id":"f41b02b6-c3cd-41b8-8ac6-cdeaaa07d806","resolution":{"observed_at":"2026-06-29T16:23:39.738438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01078","last_updated":"2022-11-10T15:04:36Z","snapshot_observed_at":"2026-07-06T13:16:50.653039Z","submitted_at":"2022-06-02T15:04:18Z","title":"Deep Transformer Q-Networks for Partially Observable Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2206.01078","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.01078","snapshot_observed_at":"2026-06-29T16:23:39.711207Z","title":"Deep transformer q-networks for partially observable reinforcement learning","venue":null,"work_id":"bfbb01d9-c667-46d5-b9b0-5bf121a2a2d3","year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2206.01078","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4bd02ae1c6b2a3bd2e53ee45736a3819bfe113d60f117a001e740bc30416614b","observation_id":"562bb0a1-d161-408a-bbcb-ca67aa7b062c","resolution":{"observed_at":"2026-06-29T16:23:39.712638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7a7a371819e681be702da15be0df94e40a227e95109067c1e235a575e020def8","observation_id":"e646655e-5673-4183-a489-4d04cb88f517","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Autonomous link control in digital twin aided mobile network: From virtual channel generation to intelligent power allocation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:3c296e300e6df41f8a700b75a76fa2b3d949853b1c9e56c7be8ed7da650eb622","observation_id":"556c1359-9650-4c55-bbbc-b09025b3556d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Dsaf-former: Drl based sub-channel assignment framework using transformer in mmwave iabn,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:177958d1a3327d7805797cc8ec4c3ed06168ec5f4d1a74f1b65b53a30b87f383","observation_id":"f7092d56-25eb-44e3-980b-c95a28d6d682","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Tpto: A transformer-ppo based task offloading solution for edge computing environments,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:09c033c03fc22be5745ba705d35476e38ce3833881d8ef029bcede916b0d8fb0","observation_id":"8a29e616-e35f-4e14-bc7c-8461924b5c4e","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Transformer- based distributed task offloading and resource management in cloud- edge computing networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:0d635a9dc5e993a7221af74c777367f23d69059a8e28346c63f11a2ae02879eb","observation_id":"da1164df-4c6d-4ece-9341-47b87b89fa3c","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"From perception to action: Transformer-enhanced deep reinforcement learning for autonomous robot navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7e8242a4d4e55393856ca8525d73efc5fb86846791258d07e634df0edd979176","observation_id":"4c8fbba6-f6b2-4f3c-b728-dc4fd85f0c56","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Transformer based collaborative reinforcement learning for fluid antenna system (fas)-enabled 3d uav positioning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:a0dd3cbe7dfda1a34926a5040ea09b6064d6687f212b6df40a861538f0bafa6d","observation_id":"7fceb54d-b094-46f9-9cc3-876329f0e1ef","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Anti-jamming task schedul- ing in mec-o-ran with hierarchical drl and transformer-based control,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:a22e8798de79ee387a4537ec80c1ad2fd89e3cedc3cbf258697981ccfcd3fd73","observation_id":"6e512cc2-7c6e-4260-84be-d9d7871ffc9d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Radar: Robust drl-based resource allocation against adversarial attacks in intelligent o-ran,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d7c905e849c94ffc0a8a86f9951ffc7532d6d28df9dc0ae45e6010fc5eaa1d52","observation_id":"e7a9edbc-5ac9-4915-8e7c-029f1694d5ea","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Enhancing iot intelligence: A transformer-based reinforcement learn- ing methodology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:11c55d5c56494593edaa284a2e9a6a87ea12720ee966b04a2c6d4ba521974533","observation_id":"28eb6e5a-05b4-4f3f-bb06-1f17ff36eb09","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A comparison of neural networks for wireless channel prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7bf11aac23d3cdc17b7649efd8a6ffc15b002eb33d0814cae4d94be72ea7cde1","observation_id":"80f1fc13-c974-4cc6-8bb0-1fcd22cc2b1b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18196","last_updated":"2025-02-25T13:37:20Z","snapshot_observed_at":"2026-08-09T03:28:27.153249Z","submitted_at":"2025-02-25T13:37:20Z","title":"Machine Learning for Future Wireless Communications: Channel Prediction Perspectives","version":1},"cited_work":{"arxiv_id":"2502.18196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.18196","snapshot_observed_at":"2026-06-29T16:23:39.708231Z","title":"Machine learning for future wire- less communications: Channel prediction perspectives,","venue":null,"work_id":"db24f285-a742-4985-a36a-52f52e6c4c46","year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2502.18196","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:6b0e81640e4b0b8fd98e7f989ad727baa42ddf38de087b690bcb2cae62758a46","observation_id":"95c9a08e-93e9-4c1f-b8ea-50313e73207b","resolution":{"observed_at":"2026-06-29T16:23:39.710221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Generative ai for deep reinforcement learning: Framework, analysis, and use cases,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:e572698143119929997bf9f36c18e1aa41953cf6f6c9eb209d8cb672f25b5e57","observation_id":"3ab9c59f-e940-42b1-a340-8f737e1013ad","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Dueling network architectures for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:51db577108abcf3e21b02d11825ce6999258bd3ae2dbb49a65f55871c480544f","observation_id":"420919c3-45ab-4084-b512-283e4b2e0428","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"On transforming reinforcement learning with transformers: The development trajectory,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d5605fc2f67385e0851873e37357097ede69f4aeb45225473a9c3ab6b806bd6a","observation_id":"6bb696fa-f553-4ca3-b8b5-cd57c6d37b0b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Mastering atari, go, chess and shogi by planning with a learned model,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:a3e4893330f8eaf8139c7856e1534bc20149202464ae8482aaaf94c017074d79","observation_id":"edf768ec-2ca8-46b5-b905-e1afa8f22ad6","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":"2010.02193","doi":"10.48550/arxiv.2010.02193","metadata_source":"pith","pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Atari with Discrete World Models","venue":"cs.LG","work_id":"154f6f5f-bb34-456d-8107-45d5b51433ce","year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4e756d71ef8072646d72fbf31243404065939c9d7817a6247169100c82842b8c","observation_id":"f67cddb9-f7d9-4962-b7e6-67d704a49824","resolution":{"observed_at":"2026-06-29T16:23:39.714861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15332","last_updated":"2021-03-29T05:00:14Z","snapshot_observed_at":"2026-08-09T06:03:53.204030Z","submitted_at":"2021-03-29T05:00:14Z","title":"Measuring Sample Efficiency and Generalization in Reinforcement Learning Benchmarks: NeurIPS 2020 Procgen Benchmark","version":1},"cited_work":{"arxiv_id":"2103.15332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.15332","snapshot_observed_at":"2026-06-29T16:23:39.716028Z","title":"Measuring sample efficiency and generalization in reinforce- ment learning benchmarks: Neurips 2020 procgen benchmark,","venue":null,"work_id":"88023309-7fb8-4bd9-b63a-7edca0b67357","year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2103.15332","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:b5d2a4a0c4638ccad065631219974753382583f45ee98f952bd04cee9e66ce8e","observation_id":"7a7ddf85-b503-47e7-bb6b-12bb98d22fed","resolution":{"observed_at":"2026-06-29T16:23:39.717455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-10T00:11:40.769751Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2301.03044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-06-29T16:23:39.723318Z","title":"A survey on trans- formers in reinforcement learning","venue":null,"work_id":"11b791e0-1cc2-4325-8f99-910476e40766","year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:b894358159ddad563cb2c3aba133e8a5ac8acdee37a1e2f819ce1801b59a356a","observation_id":"0ff01b6a-2f5f-4d95-aa4f-2abd7c9efed6","resolution":{"observed_at":"2026-06-29T16:23:39.724737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":"1509.02971","doi":"10.1137/22m1480409","metadata_source":"pith","pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Continuous control with deep reinforcement learning","venue":"cs.LG","work_id":"41a65444-c819-4303-a1f1-b075aa86d40c","year":2015},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d7b3fcd39f566f471383932c0bc8d9f42de821b704cdaa4544948400781852ac","observation_id":"db4e7e05-64bb-45ce-b735-6e8e3f28e6ec","resolution":{"observed_at":"2026-06-29T16:23:39.719869Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:95a0ab10d37076c187e8bc46c048716eae9b686af4295477e5a22f8a5245c7de","observation_id":"b7bd1106-b548-46e4-9132-e35b8996894a","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":"2005.01643","doi":"10.1613/jair.1.17526","metadata_source":"pith","pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","venue":"cs.LG","work_id":"597b6f46-d60f-451f-8f34-7d32876a9014","year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:c24e12dfee021cc51f781ff93f825effc9ea58a7e845fa6e5bd9d8523c7bb293","observation_id":"63e37dda-9ab0-4be9-b740-c1b717015654","resolution":{"observed_at":"2026-06-29T16:23:39.722267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Diaformer: Automatic diagnosis via symptoms sequence generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:585c22719e28e23783020e65bbb1f0dafea426f906df5016c993ab53c983badc","observation_id":"a75dbdd4-4ab3-4d4b-a738-8a90af1c58b9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Addressing optimism bias in sequence modeling for reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:df7da63a3a648de663c29e6d5fe8ac41df253e8abc04d48c78e0cf698b0d8478","observation_id":"c9a7983d-2949-4222-9f7e-4ed7943a25c5","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Iris: Implicit reinforcement without interaction at scale for learning control from offline robot manipulation data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:61db188b1c770bd79309c09e36baaef748d4a92627b232d60492fec284282bc8","observation_id":"441af3c2-6888-4b4a-abd3-c331a56f9a2c","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:3c8b6b74f923cd731abeee26b4d874cb62f16c5ae76916189014f6f58ffacab1","observation_id":"ea788ae4-9c1f-4ed8-b3ce-04adae7fd541","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":"1607.06450","doi":"10.1007/978-3-319-32025-0","metadata_source":"pith","pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Layer Normalization","venue":"stat.ML","work_id":"20a2d720-0046-4c7c-bcd6-327ec8143f69","year":2016},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d2a394190df927f2548cca8a18c076cef06b39ae84cc659aff18bd5e976b5bce","observation_id":"d609b868-7661-44f2-bdd9-1e11c6e15106","resolution":{"observed_at":"2026-06-29T16:23:39.730171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08375","last_updated":"2026-04-14T12:21:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-22T14:30:17Z","title":"Deep Learning using Rectified Linear Units (ReLU)","version":3},"cited_work":{"arxiv_id":"1803.08375","doi":"10.48550/arxiv.1803.08375","metadata_source":"pith","pith_arxiv_id":"1803.08375","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Deep Learning using Rectified Linear Units (ReLU)","venue":"cs.NE","work_id":"1348fc83-94e6-4a01-b6c2-0568c6def951","year":2018},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1803.08375","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:2aaf1ac002b20a7c55cccc1c9e5a71e9186481c755eb78e087c89f150dc5a167","observation_id":"b4b7382e-23ac-4204-8649-9eded74f4fa0","resolution":{"observed_at":"2026-06-29T16:23:39.707140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:51:08.672514+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:51:08.672514+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Gaussian error linear units (gelus),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:297adb87f1be3a50f09fee43809cb4d6a875e94555d1969298217be674b21b7a","observation_id":"56050d35-e429-443b-bff6-4fe166cd141b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A survey of transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:2b2f642c7c7e044ae3564d36216d39aeb67f784683a829c821f71bc6bbfab8cd","observation_id":"07db0b6b-6906-45b2-a73d-4a67832f08cb","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":"1904.10509","doi":"10.48550/arxiv.1904.10509","metadata_source":"pith","pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Generating Long Sequences with Sparse Transformers","venue":"cs.LG","work_id":"c5b81688-45ee-4a9a-b095-e6290f45cb6c","year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d98aa017a5dc1eff418b4505f1adfbbe2136d42bcf080d2f9c67728533e438c1","observation_id":"f472dd1f-a4b3-478e-8267-e46bacadb100","resolution":{"observed_at":"2026-06-29T16:23:39.702111Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.71041+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.71041+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d939cd88b766d599206dd16ad7e984093b914f145a95c9d02df21365363539e0","observation_id":"da2128ca-dc41-4708-9e83-5875cb9b310f","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Rethinking attention with performers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f3f71a92fe1bd8fbbee47f6b8f346c0fe74dd62e98e82d2eb9f19063c8c3f2f9","observation_id":"57c86318-25fb-49b2-8708-54831877018b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Linear transformers are secretly fast weight programmers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:df1360181eb7cc39d36cbd432e2176b157f1cf56490fd3d252cabd83e1b2bf8a","observation_id":"b5c52514-c1a2-411a-8035-1d7c660c0bd1","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Generating wikipedia by summarizing long sequences,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:61732a15816b84a164df5b60b4109ca06d72de0949d1233290d8c2ec0d5c97f7","observation_id":"94b184a8-c89a-40e4-9192-5919771eb0cc","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Fast transformers with clustered attention,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f80b292ab9262f740b440face098eaeaa8d0c1a195f9e8ddf5c80b416c4c10b0","observation_id":"808c184e-4d5a-41cd-8b09-7fb1234be718","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Poolingformer: Long document modeling with pooling attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:56ce72ab3fd58504bd2a60fe09751335792aae749c542f65e5a7de185ca046ad","observation_id":"aeb09d74-829c-4432-84fe-427fd0178d4a","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Compressed self-attention for deep metric learning with low-rank approximation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f6f1347de229fbe2617338ff516381d1b379a5e7046b8a75a031714d82a506a2","observation_id":"142c71e2-2cfb-4192-8477-1b3ccb13eb5a","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Nyströmformer: A nyström-based algorithm for approximat- ing self-attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:3a7e50c82fb6106c0401aec9452456224971bd8d4adc8d71542d55aa2c7a3371","observation_id":"959faee1-5743-49b0-94f6-efe5735a6e55","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03555","last_updated":"2020-10-01T00:41:49Z","snapshot_observed_at":"2026-07-06T09:26:25.974216Z","submitted_at":"2020-06-05T17:09:16Z","title":"Masked Language Modeling for Proteins via Linearly Scalable Long-Context Transformers","version":3},"cited_work":{"arxiv_id":"2006.03555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.03555","snapshot_observed_at":"2026-06-29T16:23:39.725857Z","title":"Masked language modeling for pro- teins via linearly scalable long-context transformers","venue":null,"work_id":"1ae4a004-a1e1-42d3-9134-9ae77c0f598b","year":2006},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2006.03555","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:5faf88385151ce0b65ee7cde1c22dca6f45a72ccbcf34f65e27ec4a93fe0b39a","observation_id":"395f069b-cc21-4dd3-b7df-cb2f3099d119","resolution":{"observed_at":"2026-06-29T16:23:39.727332Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d692bdd00d6daecd5f581abaf611658bf2c141bfb5d9e6427b8e2fbaca2c524b","observation_id":"9258abde-3540-46b6-b660-eff67c975fad","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Rethinking positional encoding in language pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:ff4b77a8c7d5960a0a6550408909e4903161994d330ea67efa6d8a557b046fc9","observation_id":"ed904d24-0a51-4769-ba5e-ce367e300c14","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Modeling localness for self-attention networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:0b871099c58236ab71b718fdb4795b21252e10a36641cffb7456065a19a23918","observation_id":"5821b75d-d39c-4bc9-9b08-36dc7da553f8","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Multi-head attention with disagreement regularization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:62392e40bac05b1a60c1da7cc6ef91815165cd447405efd616da51428642cb88","observation_id":"05a48586-2637-448a-9a5a-48a7f1517775","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Revealing the dark secrets of bert,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:6b3341ae93559a0bbb28fddba1ac0a8f8afc33f5cf0adbc03bed1d008c76d946","observation_id":"14eac31e-7ba1-45bc-b036-a65addd09953","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Adaptive attention span in transformers,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7cf22eca9e481c68669a1d35c9a4d7eeb0139109dcf05c8dd295c8efe39d6e8c","observation_id":"021f1d2e-b0eb-4ee1-b752-f3a4fec24f20","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Multi-scale self- attention for text classification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4af5d7eba7cb1e3ad01fc233dee9d51ee80ab3a53245f03fc1011925a71e8d1d","observation_id":"87ca6a71-3720-4d2d-a5d3-139efe7d07cf","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Information aggregation for multi-head attention with routing-by-agreement,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:1ca2c1a101053dbbb9177c62e4ba3aa98da2c3bec08335d7afefa2862f0d5e5a","observation_id":"ed46d916-c7d5-4dae-b041-9f1f18ce9c47","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Improving multi-head attention with capsule networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:753104848007686afc6a94c50ce5c8a9952520420978f60dc289af82deb830f0","observation_id":"0c3c1fe0-439f-4bbe-8a97-111b6e25e884","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"An image is worth16×16words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:668af27e5ef2315a475583ccbf8beeffb2d27255e2b1cb54263607eef7447766","observation_id":"93865a0c-f7f9-4632-8670-f8925a24a9aa","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:08390b43ee0f6f6bcfb1d42693a170044439a755c0fb5af44133e84fabf06404","observation_id":"adc4af6d-88f1-4d7f-b2d5-4564b7ef3f59","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:6c9d6bd9d008c9c7a1c47567e683f5ff19faa9f4a601c26075ffadcdb5e21223","observation_id":"6b4938b7-c3cb-4b0c-a8d3-6ee3ef9afef9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7fac2c6805b9a9e5820915a55bd15150d535847f4ce5890df2c6ab50af2b0ffe","observation_id":"f06bfb90-f69d-423f-a78f-70a3efec1d0b","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Graph Attention Networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:1500a5c5a3d060a6d85160378d484126ca3f5935f3785d2cb8eeda744964f247","observation_id":"7e6aa815-b160-491e-a807-13b1156921bc","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Graph transformer networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f55acc381a9da47c002706fc52547378fc2138d3c69b7668cf29df9b3ee79ef2","observation_id":"8e23d962-14e3-4bf0-a765-56767d542fb8","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Heterogeneous graph trans- former,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:3cbc9f35d1c61d24672f00b8fa9ba03c7e49d3d860a1d0be39d69ad6e0e27395","observation_id":"9b914787-9391-4d3e-8a10-515cb49cf219","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Do transformers really perform badly for graph representation?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:97818a1b9b30f85aeeffdc71eac45030a0731833d6540e554b677da959951a7a","observation_id":"e89b2ec4-0235-4452-bf6c-7a95e791cac9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:294fd77e6f3b6a5233a36966aeac0d9ad47d8ea2b00a05ad9c763f4d6cf6285b","observation_id":"9f20c66a-ed5c-4cbf-bab2-8b9ad589a96d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Multimodal Learning With Transformers: A Survey ,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:ed966b0036c887e4dadc7bd7c231467757ac5ceb8658c3321a03e4917d96ab71","observation_id":"b105432b-d728-47fe-820c-6ebbccb0ffc0","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15241","last_updated":"2022-10-15T07:31:27Z","snapshot_observed_at":"2026-07-06T13:15:32.315247Z","submitted_at":"2022-05-30T16:55:38Z","title":"Multi-Game Decision Transformers","version":2},"cited_work":{"arxiv_id":"2205.15241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.15241","snapshot_observed_at":"2026-07-02T11:06:52.485222Z","title":"arXiv preprint arXiv:2205.15241 , year=","venue":null,"work_id":"a7d6953b-7d83-4904-865b-213ffc71b8ae","year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2205.15241","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:db5217684e688e3aa1e2a416d4414021b9e7af558b59a610f066b2ca8c947f26","observation_id":"87c69a93-2d29-4e6c-8c1c-7c2e2cac6786","resolution":{"observed_at":"2026-06-29T16:23:39.696810Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Q-learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:2ca8706a6707e4c3c83b7aeb9d5c717b0bf579c8daa1fb2f842ffcb07e88971e","observation_id":"da68f8d1-8f2c-448b-8ebb-2ae8a4cbccc4","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1312.5602","doi":"10.48550/arxiv.1312.5602","metadata_source":"pith","pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Playing Atari with Deep Reinforcement Learning","venue":"cs.LG","work_id":"736a8ddf-e365-4940-ad58-4699fddedb86","year":2013},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4b34ac7f9e98e777ce4b2a633550ae868a622a8ed0079398b9f584a45d537871","observation_id":"f9a12101-a104-46a2-89f4-e6eb67ad9c40","resolution":{"observed_at":"2026-06-29T16:23:39.691766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:44f2eb0c64362cb25811b547751eff5572dd641d7f36385e3a13bdf563a653c3","observation_id":"6974318b-34ae-40aa-b230-4925afdb2bce","resolution":{"observed_at":"2026-06-29T16:23:39.699057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Monotonic value function factorisation for deep multi- agent reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:2037eaf1c8a99d14198e074f246ce8b04eeefbc421200173b72b29225eec4612","observation_id":"62fafd7f-1328-4279-9e15-5a9cb828af25","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05334","last_updated":"2023-01-13T00:07:08Z","snapshot_observed_at":"2026-08-10T00:58:13.982438Z","submitted_at":"2023-01-13T00:07:08Z","title":"TransfQMix: Transformers for Leveraging the Graph Structure of Multi-Agent Reinforcement Learning Problems","version":1},"cited_work":{"arxiv_id":"2301.05334","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.05334","snapshot_observed_at":"2026-06-29T16:23:39.682751Z","title":"Transfqmix: Transformers for leveraging the graph structure of multi-agent reinforcement learning problems","venue":null,"work_id":"42385b2d-d775-42f2-8375-8c7e7ccf3061","year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2301.05334","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d242b4104d0ebd6f4b42d1fcefa309a29ca580f847b672af0952be413631f561","observation_id":"0b624126-07e8-46a3-a810-02aabf12244e","resolution":{"observed_at":"2026-06-29T16:23:39.684176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A transformer-based thermal surrogate model for cooling control in data centers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:c26f18f90e5b52cb83b8438d2735e83eeb73d729a7e8effd5f42ea89b697e5b9","observation_id":"c4d5fdd7-675a-49b3-b362-76bc9aa37dd7","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Trandrl: A transformer-driven deep reinforcement learning enabled prescriptive maintenance framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:08630f59024d7f018af6b47a80b87f44340a7bd7f883479381992bf336ca122c","observation_id":"e44a7c9e-7c17-4f56-80a1-0eac2af49f18","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A deep reinforcement learning with transformer integration for directed acyclic graph scheduling in edge networks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:4f6fceff0152b625c105fc2019666c6d93c87394e0874bcbeea61e8e732f90d8","observation_id":"7c92a0bf-5364-4a36-aec7-e9f61d211f77","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Robust downlink data transmission in leo satellite-terrestrial networks: A rate- splitting multiple access approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:1510130133d56fb50aea051e1394bfe5a23b7d8106187a707392161f26f29ddc","observation_id":"f66685c1-072a-408b-aeee-3903fe89cc57","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Learning-based task-centric multi-user semantic communication solu- tion for vehicle networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:8a552f693590a6ce58273dfbd46329a680da497e606e1b625ece69fb38196bc0","observation_id":"f0faa658-2ccb-4fe8-8011-6579c0f99142","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Decision transformer: Rein- forcement learning via sequence modeling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:7d5c49d5d58b158e3c70c7ab7e5c444d4eec6e872cb965e083fb7545c51808cc","observation_id":"b52ec843-ce08-4226-b00a-0202c356c854","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05507","last_updated":"2019-11-13T14:36:01Z","snapshot_observed_at":"2026-08-10T02:15:37.272323Z","submitted_at":"2019-11-13T14:36:01Z","title":"Compressive Transformers for Long-Range Sequence Modelling","version":1},"cited_work":{"arxiv_id":"1911.05507","doi":"10.48550/arxiv.1911.05507","metadata_source":"pith","pith_arxiv_id":"1911.05507","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Compressive Transformers for Long-Range Sequence Modelling","venue":"cs.LG","work_id":"70572d78-130b-4a13-908f-0702dcf423df","year":2019},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/1911.05507","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:5f6a45dae4803c79b32474b8128f75de000ad8380afedd44d23f5bc1d22e01d7","observation_id":"125aa08e-2c4c-40ba-ba37-434fb90e72e5","resolution":{"observed_at":"2026-06-29T16:23:39.681605Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05431","last_updated":"2022-02-22T14:49:56Z","snapshot_observed_at":"2026-08-08T16:14:23.756888Z","submitted_at":"2021-07-12T13:54:18Z","title":"CoBERL: Contrastive BERT for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2107.05431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05431","snapshot_observed_at":"2026-06-29T16:23:39.685374Z","title":"Coberl: Contrastive bert for reinforcement learning,","venue":null,"work_id":"c92eeebc-695e-4a64-aa09-d6fc68bc8d6f","year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2107.05431","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:eb5e6fc3b77d744c73b015486c8cedbe59891023370bc5b1d8a9379d7046231b","observation_id":"ee2d9762-7382-400d-ac59-a03ad8cc8a9d","resolution":{"observed_at":"2026-06-29T16:23:39.686900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"You can’t count on luck: Why decision transformers and rvs fail in stochastic environments,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:81f16ba1dee6a94bd4a15bc6ebcc8385294b1497176f154cccb3c95ee6b05495","observation_id":"e9f8b8c3-6ae2-4cad-a4f5-22d04657c986","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Q-learning deci- sion transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d262e7e663075409fbe43f15e815d0623b43951ab15870ad0d96cfb5d3717e15","observation_id":"7b39cf9e-8edd-45b2-bbd8-3fe94cffe2ec","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Offline reinforcement learning as one big sequence modeling problem,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:50b2f61d09758edca2ca08bddf1cf2bd7779c24d49e011e64dd0787591e1171a","observation_id":"d810b71b-a910-43ef-9ea3-516e65c3bf54","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Bandwidth reservation for time-critical vehicular applications: A multi-operator environment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:aec7b5eb9ce4a216b8251d4e0c02545c34fa6736fabe26f7e8d9a14688009fe6","observation_id":"e93e82d0-57bd-4425-aaae-7c80c8741a2d","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Transformer- based packet scheduling under strict delay and buffer constraints,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:40d941815a6bec61cf2e75c65b48da196870d9c11ea6fa4e94cdb3c0b8147aea","observation_id":"aa87b7e4-9c8d-4a38-91ab-436f17ceee6f","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Mgco: Mobility-aware generative computation offloading in edge-cloud sys- tems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f60b216591ac83e50360cc6950432e60fb453c21819d95cffa1432e4bfc151fe","observation_id":"5bee482e-b174-4b5c-918b-4aefd810e39e","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Handover-free multi-connectivity mobility management for downlink fd-ran: A hierarchical drl based approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:8290f49184884242a65949db07da8c51a1968d45bccf71b90a3c5627bbcdba7d","observation_id":"c3e2f3e7-754b-4e2a-9683-52a302edf0d9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Hybrid model-aided learning for 5g-ntn handover in high-mobility platforms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:0a97d6552e1aa9d80fd2b97c464f10f4cbb13c0d111364c010068e1074cbf473","observation_id":"1163c6f7-7db3-4fd7-a253-29402cc79e94","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A transformer-embedded reinforce- ment learning for computing power scheduling in data centers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:8bfb4ce197313e8b6e446fe0bd60cd91cadd3da7fa3bf29bf3f89d949a0a7986","observation_id":"99689004-7a80-4ff7-a034-f45ff6bdc10f","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Application of a ppo-based scheduling algorithm with multi-dimensional attention mechanisms in satellite edge computing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:eb59d06f0f7c839cca36e8a7fc5d6d411534255487ba293df1da1e1bdfbf8e2c","observation_id":"8c23ebc6-1463-4bb0-8dad-123fec402a07","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Agentformer: Agent- aware transformers for socio-temporal multi-agent forecasting,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:ca7a906585e98c5779c0c7495c1fd6e880402dec19e54349caa260ed68a41b0b","observation_id":"3beaabe7-e3d7-444f-9778-5633bfd0bd77","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Cooperative dnn partitioning in energy-harvesting and mec-enabled uav networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:d1c834567a8da141ef05158124d3b95b64db5180aed6629f4f40b98ced9890aa","observation_id":"ccca36a9-d35b-4fe4-8763-6c37f88a133f","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Enhanced reinforcement learning based multi-node cooperative deployment strat- egy for uav monitoring,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:90be1632204842027a7f2ca4027f8071f45550feb57a0cd1e014ceecd6e60c35","observation_id":"b0caa71b-8fbe-4370-807c-2aec67d387f9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"A hierarchical conflict resolution framework with graph transformer-based reinforcement learning for heterogeneous uav networks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:cc27015f872e25e229bdf14096e0e375568bf9538691380ed2523b43319a6b9a","observation_id":"52e3a56d-a174-4353-a6a8-969b902a131a","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Distributed generative reinforce- ment learning for stable service function chain orchestration in highly dynamic uav swarm networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:384d4b34c1d49b492497db55631410ea064fdddabd29601cb89f4a7df3cb80af","observation_id":"65ada829-abad-4b79-b476-ac2984fb2c05","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Attention-enhanced prompt decision transformers for aav-assisted communications with aoi,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:09afdd322afa3381cd987bd2626bac7da88a5c1d407bad62f1e2cff827290bc2","observation_id":"07399278-bb29-4cd7-aa06-ffe6870692c9","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T16:14:25.741686Z","title":"Efficient reductions for imitation learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:f26b86de0e8c9202572d913713efc894d07c20ac826e56b61bf041f20e414369","observation_id":"c3f27322-f542-474a-9f16-0e82e1726f08","resolution":{"observed_at":"2026-06-29T16:14:25.741686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","latest_version":1,"primary_category":"eess.SP","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":80,"verified_exact":19,"verified_fuzzy":0},"total_outbound_references":217},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 217 outbound references and 0 inbound Pith citation observations for arXiv:2606.05208."}