{"as_of":"2026-08-15T14:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4eb0aff829afa9a66291e090fc3fb5c3ed513c6703a9c118705853162af0bc54","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:44:09.069227Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18111/citation-record","integrity":"/paper/2507.18111/integrity","json":"/paper/2507.18111/citation-record.json","paper":"/paper/2507.18111"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:04.724107Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:04.724107Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:110caaff69fed4eae962656e9a0f710c359f29f14c8b68a79defdad6a922d7ca","observation_id":"b4ffba47-3831-4068-80c2-c7e8e5d418fe","resolution":{"observed_at":"2026-08-06T14:44:04.724107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.795311Z","title":"Federated deep reinforcement learning for open ran slicing in 6g networks","venue":null,"work_id":"11ce28b5-f080-4b43-9398-f1169001309f","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:04.853810Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:d1d85aba655861bdaf823f390a318dd13d6eec61802c192448fd46f69ab085b3","observation_id":"a7835e38-4d1f-4c4a-9625-cee7df34c41a","resolution":{"observed_at":"2026-08-06T14:44:09.799288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.779029Z","title":"Energy saving and traffic steering use case and testing by o-ran ric xapp/rapp multi-vendor interoperability","venue":null,"work_id":"3e0c14b6-b0bd-423f-a217-534eed8ef0fe","year":2024},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.107804Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:5866dd683dddec63c6526d9d9858d39eb8a59ca0d93d856e925616d6bd65e0f8","observation_id":"804cdbfa-37a4-43f7-a53c-89dc2fcbe06d","resolution":{"observed_at":"2026-08-06T14:44:09.784565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.764419Z","title":"A., Ksentini, A., and Bouaziz, M","venue":null,"work_id":"83f70077-81df-47ff-bc97-acd3507826e8","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.139145Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:a5c18fc6ee67209bf9a75fb8966112623204c62df2c4e3b927548b0431375921","observation_id":"0aaee55c-71dd-4b81-bfad-4f09dbff082d","resolution":{"observed_at":"2026-08-06T14:44:09.768496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.748607Z","title":"Scope: An open and softwarized prototyping platform for nextg systems","venue":null,"work_id":"3d78e571-311f-4424-bbfe-90453c584df9","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.215451Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:77ab71c72dce514d06e2aea42e8e4fe78677170a670fe055793de071935fc62a","observation_id":"21471594-5e8e-49b4-aafe-bf721f932e3a","resolution":{"observed_at":"2026-08-06T14:44:09.752806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.734431Z","title":"Intelligence and learning in o-ran for data-driven nextg cellular networks","venue":null,"work_id":"df5fc62c-923a-433b-b5eb-110917eba99e","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.371790Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:9387434ae9862db30f686d5ec38bc03628fe7501375eaf2f3e4bb46e52cd4baf","observation_id":"331bdcc8-7ffe-4573-9050-cc812c16b3ab","resolution":{"observed_at":"2026-08-06T14:44:09.738945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.720895Z","title":"Colosseum: Large-scale wireless experimentation through hardware-in-the-loop network emulation","venue":null,"work_id":"88e9fb27-5dba-420a-8a52-658f2213cb09","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.515789Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:1e536fb312c6a21820185229634f3e6eac47b90eb82517421019d97b47f2bc22","observation_id":"8e38afd4-7bec-4592-b68f-09e72d817fdc","resolution":{"observed_at":"2026-08-06T14:44:09.725060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.706556Z","title":"User access control in open radio access networks: A federated deep reinforcement learning approach","venue":null,"work_id":"323b89dd-3e11-43c5-8ecd-d40304cd1a82","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.586167Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:fc0b4201b5ef0dab0439de82f0f315876f2b14a0876efc0346fc1c714e1e279b","observation_id":"dc457f42-d003-40f5-b92f-8da6582521f6","resolution":{"observed_at":"2026-08-06T14:44:09.711556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.691278Z","title":"Orchestran: Network automation through orchestrated intelligence in the open ran","venue":null,"work_id":"f8d106a7-aa87-4432-8305-5ff42635bf9d","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.718449Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:5261c7192462861826c80089f749cb9e9fec46d3b1a77d0cc32bf389a7011cec","observation_id":"5f680ae8-fa67-493c-84cc-7f55cdaeae6a","resolution":{"observed_at":"2026-08-06T14:44:09.696370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.676235Z","title":"E., Jemaa, S","venue":null,"work_id":"7e35ccd0-01b5-4ab8-b841-bd5bb6ef9009","year":2019},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.842847Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:a806785868d4014152d8e631b1c81c2596e1637c04015e27ca399ef3c168c21e","observation_id":"133fecd6-7d74-445f-822a-fc511572cdac","resolution":{"observed_at":"2026-08-06T14:44:09.680517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.661086Z","title":"Radio access network (ran) digital twins","venue":null,"work_id":"5036e847-0365-414b-bb17-ecdfd632e0f1","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:05.946180Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:64896a57fd33214a2d86e381a043689db44658ff240ceb72d78fc5f060b5724d","observation_id":"825c39b5-6074-48f1-9a65-728721ced8f0","resolution":{"observed_at":"2026-08-06T14:44:09.665391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.645638Z","title":"Dynamic sdn-based radio access network slicing with deep reinforcement learning for urllc and embb services","venue":null,"work_id":"ad8b4cc8-81c3-4c02-9d02-37177aa4aac8","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.115987Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:70afff5cd5b4d0e2e6234242cfb110350118d81010e67abc8afdb74b4461a191","observation_id":"862d8328-2d01-4cfe-83a3-ca6fbc4cd5d6","resolution":{"observed_at":"2026-08-06T14:44:09.650934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.627829Z","title":"Learning based on graph: A joint interference coordination for cluster-wise distributed mu-mimo","venue":null,"work_id":"4306a409-9c99-4def-951a-3d228983f17c","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.238765Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:94bf9040f88674902309f251e28dd2295e92d9a8fa120134936cc25b3692097b","observation_id":"5a3496cd-2bd6-4374-80d9-cb8fbd92a003","resolution":{"observed_at":"2026-08-06T14:44:09.635398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.611258Z","title":"Gan-powered deep distributional reinforcement learning for resource management in network slicing","venue":null,"work_id":"0ed63b0a-d65a-4c6b-b258-e6b4871f1aae","year":2019},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.337347Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:33e631ab012757d5921329cd09cff95a0169eaabc49eaa44b7d711c242843216","observation_id":"94167ac5-ac74-4010-801a-53230f0592fc","resolution":{"observed_at":"2026-08-06T14:44:09.616341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.596328Z","title":"Personalized cross-silo federated learning on non-iid data","venue":null,"work_id":"80b3e2b5-74c3-42a1-9d35-221cf0aeed9f","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.437039Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:58e124e0503e969d2ef195549b3a47ab18431e16f2c0b73624ea748846312b89","observation_id":"7692a33d-b293-4927-8ec3-20e827e85f48","resolution":{"observed_at":"2026-08-06T14:44:09.601149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.581147Z","title":"E., and Erol-Kantarci, M","venue":null,"work_id":"851b7ba1-502a-4945-8ba7-4c2eddf7893b","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.548601Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:7baefeb3acd8fcc8d884632390298e00ef381d4ff6469edf055285f1c8b9216b","observation_id":"12d12af9-4f6e-4c2d-b2b9-1e10b1bec42f","resolution":{"observed_at":"2026-08-06T14:44:09.586300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.567026Z","title":"and Iosifidis, G","venue":null,"work_id":"d82f28cb-5529-4182-80a2-e4e0cf670f2b","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.674726Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:1019c8829bb0325313ae2a2fbb75f7f767248b7b75b9aebaf3775e1f918b8315","observation_id":"51038bbc-477d-4d89-8f3c-ca41ccb4425d","resolution":{"observed_at":"2026-08-06T14:44:09.571249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.548393Z","title":"Generative ai in mobile networks: a survey","venue":null,"work_id":"4d148b5c-40c9-4bef-8c57-277b488f71e2","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.782704Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:8a0716ea6a1d7788ec01addfdf5c89f39ee4ec24174dd24bccfa2b67807c1457","observation_id":"70b3e45c-93e3-406e-80a2-b74b12e4b6bf","resolution":{"observed_at":"2026-08-06T14:44:09.555603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.530102Z","title":"K., Lazaridis, P","venue":null,"work_id":"4b9bd630-b16b-44bc-971a-286421924fc5","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.871537Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:28b2d34e30a6df3c38b48e9fbbefbe10a53ba4e71cd3d298a3a9b52d04c5b940","observation_id":"f9fa14d9-71fa-41aa-8316-3a42ff7e4e60","resolution":{"observed_at":"2026-08-06T14:44:09.535433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14171","last_updated":"2022-10-14T20:13:04Z","snapshot_observed_at":"2026-08-13T14:17:39.039170Z","submitted_at":"2022-09-28T15:31:06Z","title":"Programmable and Customized Intelligence for Traffic Steering in 5G Networks Using Open RAN Architectures","version":3},"cited_work":{"arxiv_id":"2209.14171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.14171","snapshot_observed_at":"2026-08-06T14:44:09.166745Z","title":"Programmable and Customized Intelligence for Traffic Steering in 5G Networks Using Open RAN Architectures","venue":"cs.NI","work_id":"79013bc4-ad07-4785-9966-7e63aebc8f5a","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:06.991978Z"},"links":{"cited_paper":"/paper/2209.14171","citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:5e0ed7e686c209aadf744bb55edca338993a543e2cb9e74cb0c70db48ce3ee77","observation_id":"e17ac07b-b57a-44b9-ace5-a69efb3f43ad","resolution":{"observed_at":"2026-08-06T14:44:09.171966Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.513831Z","title":"Session management for urllc in 5g open radio access network: A machine learning approach","venue":null,"work_id":"ac7cbddf-7344-4997-a5bf-6f8447e16bca","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.072101Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:fec6e6737aed6df8b4bfd6cfc751cd8e0f106cea187a45604b19ec750c5183f9","observation_id":"7f8dd7a3-3e20-4b25-8cba-252eb9aa111d","resolution":{"observed_at":"2026-08-06T14:44:09.518414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.499249Z","title":null,"venue":null,"work_id":"924d26b6-9271-4153-8e49-d011c97999c6","year":2017},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.174502Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:61d1a3870858800c6f2767fce712e95b774457b5249183823b7c6cbab133dd72","observation_id":"e94be4d8-78b2-4d74-846d-4c19a7d98ef4","resolution":{"observed_at":"2026-08-06T14:44:09.503678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.484875Z","title":"B., and Abou-Zeid, H","venue":null,"work_id":"7424a6c1-d1e3-4f92-9637-26f52fe16d65","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.259284Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:4c4924d234829e2e1ffb9d9aecfefb50995f6d40c47b1ac4221053c2352639be","observation_id":"5d1db9db-b9e5-4b52-9ced-6a848f58bc95","resolution":{"observed_at":"2026-08-06T14:44:09.489459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.468215Z","title":"B., Quang, P","venue":null,"work_id":"fcc571f2-ca5d-499b-b907-6befe41d6715","year":2020},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.384419Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:246266d297affd9807f5cd0463ceeb3d7f177240c5642bb9721377d50cf8f348","observation_id":"75be1895-381a-4750-9e0f-3a666c4acf49","resolution":{"observed_at":"2026-08-06T14:44:09.473882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:07.475651Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.475651Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:32b2ec8f76ed0b461cfacb69f1ee4dc703ae749fa4f11420e7149017ff84ead3","observation_id":"fa5be63d-6335-40eb-a664-36793c3cf2d0","resolution":{"observed_at":"2026-08-06T14:44:07.475651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.435333Z","title":"K., Shah-Mansouri, V., Parsaeefard, S., and L \\'o pez, O","venue":null,"work_id":"bcb03880-83aa-452b-b069-7e38112d3f5d","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.559850Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:775131d2fccd8df8a4394a3d46ad546a54e750d7dede4b9313a96224e8f8a1fd","observation_id":"4a702cd6-bff6-4ef1-bd96-3fda7b1a7d17","resolution":{"observed_at":"2026-08-06T14:44:09.441330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.419066Z","title":"M., Abou-zeid, H., and Hassanein, H","venue":null,"work_id":"300f0c53-4bff-464e-872a-ccfad8503527","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.644475Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:9c04c031dba1df4e0e323a3cae252398a0970dd100f0d509251b36c378bf9ca8","observation_id":"7fc9b5ec-810d-406d-af98-7a17b528eb51","resolution":{"observed_at":"2026-08-06T14:44:09.424164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.404082Z","title":"S., Singh, S., Banerji, R., Reed, J","venue":null,"work_id":"a3b0e5cc-3073-4517-8523-985a731b01e0","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.768609Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:0599fee53dc40b29a1978a194694cf6becc30bc221f9591b1c3bc2284b4c2cb8","observation_id":"92942bcd-f9f1-437b-8cef-b1da9e3b4d8e","resolution":{"observed_at":"2026-08-06T14:44:09.408687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.387645Z","title":"O-RAN Architecture Description 10.0","venue":null,"work_id":"b17fa2c5-ea16-4b19-a549-b5aaafc16ed6","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:07.891437Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:758272b357df39a84dbb259849c3c80a3832d3221b02fdec22eb08b21c693ddd","observation_id":"b5e170c2-0c18-4599-95b2-e0520ccb697c","resolution":{"observed_at":"2026-08-06T14:44:09.392497Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.371571Z","title":"N., Tetzlaff, T., Nassar, M., Nikopour, H., and Talwar, S","venue":null,"work_id":"8d54b56c-06de-4863-a312-ed954a6aee21","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.007335Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:f4c9a0b1cdb81a2ca3cee0da358d74a8e59aaf69b8d110e168da7bfcb3e90386","observation_id":"ad9b67c9-ec2a-4b35-a13d-e96f8a5ba364","resolution":{"observed_at":"2026-08-06T14:44:09.376636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.356656Z","title":"Understanding o-ran: Architecture, interfaces, algorithms, security, and research challenges","venue":null,"work_id":"ca401f0a-0ce1-49e6-8281-01200dfd980f","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.122967Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:628946d6a6958f3743b4a3030691ea2bbf190435f78d6a68a714b700c5c1e241","observation_id":"faa741bd-6cbe-497d-96b2-abf7096f6429","resolution":{"observed_at":"2026-08-06T14:44:09.360934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.341648Z","title":"F., Simeone, O., and Durisi, G","venue":null,"work_id":"5112b467-dc27-4910-8894-8f981c97a578","year":2018},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.232619Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:bb831491959b490fb8b5935d843163ffef3b098c82aedbaa1020718b5fe83e9c","observation_id":"639b0dd3-46b6-4a02-8e33-e6b91eca59d3","resolution":{"observed_at":"2026-08-06T14:44:09.346711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04627","last_updated":"2021-01-12T17:28:57Z","snapshot_observed_at":"2026-08-04T11:18:43.998468Z","submitted_at":"2021-01-12T17:28:57Z","title":"Queue-Learning: A Reinforcement Learning Approach for Providing Quality of Service","version":1},"cited_work":{"arxiv_id":"2101.04627","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.04627","snapshot_observed_at":"2026-08-06T14:44:09.139433Z","title":"Queue-Learning: A Reinforcement Learning Approach for Providing Quality of Service","venue":"cs.LG","work_id":"d845e537-21c4-4559-a57b-8bfc9eb89519","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.311685Z"},"links":{"cited_paper":"/paper/2101.04627","citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:f8c2b8f7e9af1df627e5dcfbadf4a31aa89dc38a4dbe960a58c09109881943d1","observation_id":"92f9d7af-04a6-4569-b7d3-4e80ab6a86c4","resolution":{"observed_at":"2026-08-06T14:44:09.146120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.327476Z","title":"S., Demir, U., Stephenson, N., Soltani, N., Shah, V","venue":null,"work_id":"cf9c9174-aa4f-4868-bd4b-bfa7bee615fa","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.420724Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:4072076170cad243d7112c3f5c13a4581702b2c3b90780e6256bc80133f5e54e","observation_id":"59a404ba-160c-4648-91f6-6fc8c0961386","resolution":{"observed_at":"2026-08-06T14:44:09.331669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.313093Z","title":"On the specialization of fdrl agents for scalable and distributed 6g ran slicing orchestration","venue":null,"work_id":"343a9cad-7028-48eb-9189-47831f916a84","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.559917Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:3fb996d4e84f28a45db2dbcbe73d87c4b9486720fb97dbb2ff95bdded2634e9b","observation_id":"04bf5e11-1bfd-49da-9709-d671049feb5d","resolution":{"observed_at":"2026-08-06T14:44:09.317706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.296539Z","title":null,"venue":null,"work_id":"9d96179c-d117-4340-8587-79b99af721d4","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.668201Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:6b14fe18fb69d95423143f13bc627a410a727adae39905c2a9985977bbc03ff3","observation_id":"69de93e1-7ae0-4748-815e-b5b581caba40","resolution":{"observed_at":"2026-08-06T14:44:09.302173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.280061Z","title":"K., and Radunovic, B","venue":null,"work_id":"c1972ccb-8fa8-403a-87bf-09698b45d74d","year":2024},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.792988Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:5e66c6eae10ddc4c5c266bc2b9c89ff4af4200b12961efedfe5f1b3e446a42f9","observation_id":"f0a0504d-f1b1-4a7c-817d-18fcd9ea69ef","resolution":{"observed_at":"2026-08-06T14:44:09.284715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.263968Z","title":"Research report on digital twin ran use cases, May 2024 b","venue":null,"work_id":"de7d7a90-3798-4254-b3e5-a0449b644b64","year":2024},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.877547Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:8450ac9415682448929d0d19e4d8c27bb6dacd472f5971a3ab2bbae62d14e613","observation_id":"8e89000d-6db3-402a-8d7e-f9c3288d5b9b","resolution":{"observed_at":"2026-08-06T14:44:09.269844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.245731Z","title":"Federated deep reinforcement learning for the distributed control of nextg wireless networks","venue":null,"work_id":"479fb0ec-d231-445e-a9ca-f0701d8ae192","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:08.997218Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:6d385bc6e2e533d768ce49d4f692fcf321c8098762cfa1e3a697e04c2e26bf96","observation_id":"fdc0d8e7-cf29-41c2-a8a7-804c220fea40","resolution":{"observed_at":"2026-08-06T14:44:09.250965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.230864Z","title":"Off-policy learning in contextual bandits for remote electrical tilt optimization","venue":null,"work_id":"9a23b467-6073-4ddb-93ff-ca24a1cf91aa","year":2022},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:09.044597Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:5bd32977366a85f083475fec3659a7cc797d70f2d3559e7624a9e5a1fda45805","observation_id":"0f1d2bd2-c7a6-4d92-854b-340e6a580114","resolution":{"observed_at":"2026-08-06T14:44:09.235445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.214300Z","title":"and Liyanage, M","venue":null,"work_id":"d88f50ee-d2f5-4e4d-9510-63e834607097","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:09.049533Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:fbbe48ffebbd9c7b296043fd7e2164983581ca0bad2b06ab25514ccc1a0a9b52","observation_id":"fa464990-ded6-4646-a556-eabb8db6b8a8","resolution":{"observed_at":"2026-08-06T14:44:09.219338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.198611Z","title":"Dynamic ran slicing for service-oriented vehicular networks via constrained learning","venue":null,"work_id":"2584ae40-2dd8-4504-9f7d-8adc67b77ce5","year":2020},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:09.056196Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:fdef9bfd8df165f3cc0d79b233e447270d31c03471b13d5b73673d564f751a36","observation_id":"2410e9b3-0775-4ba1-b4f5-bc675b98f794","resolution":{"observed_at":"2026-08-06T14:44:09.203303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01864","last_updated":"2023-02-03T17:08:45Z","snapshot_observed_at":"2026-08-15T08:11:31.359264Z","submitted_at":"2023-02-03T17:08:45Z","title":"Machine Learning-based Early Attack Detection Using Open RAN Intelligent Controller","version":1},"cited_work":{"arxiv_id":"2302.01864","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.01864","snapshot_observed_at":"2026-08-06T14:44:09.113439Z","title":"Machine Learning-based Early Attack Detection Using Open RAN Intelligent Controller","venue":"cs.NI","work_id":"d00973c9-fbbe-4e71-a7c7-bd25b6336b6a","year":2023},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:09.063049Z"},"links":{"cited_paper":"/paper/2302.01864","citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:23fc6157441b01c33ad9e8d938003b562699fb7ce76f5fd036333c651e71d94c","observation_id":"08361a61-e9cf-4c26-bfd9-72cd74450e8f","resolution":{"observed_at":"2026-08-06T14:44:09.121038Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:44:09.183881Z","title":"Q., Chen, J., Cao, X., and Wu, D","venue":null,"work_id":"44901341-1bd2-44d2-ae35-16f63e7c7adb","year":2021},"citing_paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T14:44:09.069227Z"},"links":{"citing_paper":"/paper/2507.18111"},"observation_digest":"sha256:ae9e6701b3b8dc61010c410cdf06fd60056759748e95b5fe8d4879478a823355","observation_id":"9c9e9a99-299b-42c5-b1ec-c25682cfcce8","resolution":{"observed_at":"2026-08-06T14:44:09.188356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18111","last_updated":"2025-07-24T05:45:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T17:02:40.155250Z","submitted_at":"2025-07-24T05:45:41Z","title":"Percentile-Based Deep Reinforcement Learning and Reward Based Personalization For Delay Aware RAN Slicing in O-RAN"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2507.18111."}