{"as_of":"2026-08-09T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15040972429d5ba704092a6321a688e831e9311e05743069d33cb14b4fdb4392","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:39:55.628235Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28826/citation-record","integrity":"/paper/2607.28826/integrity","json":"/paper/2607.28826/citation-record.json","paper":"/paper/2607.28826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:52.221635Z","title":"In: 12th International Conference on Learning Representations, ICLR 2024, May 7, 2024 - May 11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.221635Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:407a5e8d8a5bceddafece64d3cbe5acdb0c92349bf739dc35ca7c58ec6a7dd17","observation_id":"7d121184-8e86-4dbe-ab53-fc5888b650df","resolution":{"observed_at":"2026-08-03T01:39:52.221635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16021","last_updated":"2023-09-27T20:58:13Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T20:58:13Z","title":"HuntGPT: Integrating Machine Learning-Based Anomaly Detection and Explainable AI with Large Language Models (LLMs)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16021","snapshot_observed_at":"2026-08-03T01:39:52.279475Z","title":"https://doi.org/10.48550/arXiv.2309.16021, http://arxiv.org/abs/2309.16021, arXiv:2309.16021 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.279475Z"},"links":{"cited_paper":"/paper/2309.16021","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:98865c63634760628f100820b6011e5eb25bbf02b52917291da804b95a80f8c8","observation_id":"d39cebb1-e7fc-40a5-aee5-3df95b617b5f","resolution":{"observed_at":"2026-08-03T01:39:52.279475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10667","last_updated":"2020-02-26T02:24:11Z","snapshot_observed_at":"2026-08-08T04:55:46.891516Z","submitted_at":"2020-02-25T04:59:24Z","title":"CybORG: An Autonomous Cyber Operations Research Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10667","snapshot_observed_at":"2026-08-03T01:39:52.344424Z","title":"https://doi.org/10.48550/arXiv.2002.10667","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.344424Z"},"links":{"cited_paper":"/paper/2002.10667","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:bd60eb6ff258124f11b8d8dce706d7655fd2731b6c834ad4d70864d9c67435c6","observation_id":"0d71b292-118d-475d-8e7c-fc023c6edb0a","resolution":{"observed_at":"2026-08-03T01:39:52.344424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:52.425782Z","title":"In: TA-Explore: Teacher-Assisted Exploration for Facilitating Fast Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.425782Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:255cefb91844001017d7ee8948025c274355c67ef8d1e1b068eb364809f76686","observation_id":"7c3b7526-946c-45c2-aa8c-741ee503a7d6","resolution":{"observed_at":"2026-08-03T01:39:52.425782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08038","last_updated":"2026-06-17T04:01:34Z","snapshot_observed_at":"2026-08-07T17:14:23.408124Z","submitted_at":"2025-03-11T04:43:33Z","title":"Generalized Kullback-Leibler Divergence Loss","version":2},"cited_work":{"arxiv_id":"2503.08038","doi":"10.48550/arxiv.2503.08038","metadata_source":"pith","pith_arxiv_id":"2503.08038","snapshot_observed_at":"2026-08-03T06:16:11.147974Z","title":"Generalized Kullback-Leibler Divergence Loss","venue":"cs.LG","work_id":"def8121b-60b9-4891-9d8a-f9ea084a312e","year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.499535Z"},"links":{"cited_paper":"/paper/2503.08038","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:68a0406ecf2f72eaf3fb9272ce1a2f14bfbab98c5bcace7fa047b2b73b0e337c","observation_id":"9f05a1ef-c11a-4b93-9cc9-a4ff0a16c240","resolution":{"observed_at":"2026-08-03T01:43:37.632047Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:38:18.943618+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:38:18.943618+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:52.555719Z","title":"In: Chen, Y., Lin, C.W., Chen, B., Zhu, Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.555719Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:5e4c9436c7f114a7da95ea2cf235eaf7a95ffd08a03daead600e5227c52d6c62","observation_id":"95fdd10b-e299-4581-8240-2f9c58ed1c8a","resolution":{"observed_at":"2026-08-03T01:39:52.555719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.53555/m.v9i9.5842","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IJRDO -JOURNAL OF MATHEMATICS9, 1–5 (Sep 2023)","venue":"IJRDO -JOURNAL OF MATHEMATICS","work_id":"10f48e5d-db67-4457-8c58-1ccffdfdf585","year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.648428Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:7fb9eb78b970eee0b06ce5420dd77d6e6393b150dfd51eb82a295f1d721b3a42","observation_id":"2514541c-393e-4bab-8746-2a7a73aa606f","resolution":{"observed_at":"2026-08-03T01:43:37.517742Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:38:19.392642+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:38:19.392642+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07388","last_updated":"2023-09-14T02:09:36Z","snapshot_observed_at":"2026-07-06T16:18:14.063635Z","submitted_at":"2023-09-14T02:09:36Z","title":"On Autonomous Agents in a Cyber Defence Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07388","snapshot_observed_at":"2026-08-03T01:39:52.768075Z","title":"arXiv preprint arXiv:2309.07388 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.768075Z"},"links":{"cited_paper":"/paper/2309.07388","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:6a940a09f778df3f13b00c4c779722dd5cb17cb7532fd63c5ffae7f18423683a","observation_id":"808cc04f-9a36-4965-a46f-ca87d27ba5cb","resolution":{"observed_at":"2026-08-03T01:39:52.768075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:52.965086Z","title":"In: 2024 Inter- national Conference on Military Communication and Information Systems (ICM- CIS)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:52.965086Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:dbdc6869194a44b1f375debfa562f9a093e5d474bd4a997bf7f0df88a64e12de","observation_id":"078a61a9-411e-4760-8c2a-28f300f3568a","resolution":{"observed_at":"2026-08-03T01:39:52.965086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.191993Z","title":"IEEE Computer Society (Sep 2024), https://ieeexplore-ieee- org.journal.rmc.ca/document/10645591","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.191993Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:466c0a79fb97f8bd6e0b13d96c24fb6d71a99b91137a4c7e819f41f4af302806","observation_id":"8b0a9e01-7ffc-4f4e-950c-db8a9c5e8d0b","resolution":{"observed_at":"2026-08-03T01:39:53.191993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.308937Z","title":"IEEE Ac- cess12, 120292–120305 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.308937Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:b0fc6b05b1d7717340bdb8f44a897c3559ef3bdf528e1b033ef149fcbafd1c1b","observation_id":"2643bf3e-8666-4e7f-8a5c-43a63cb4a853","resolution":{"observed_at":"2026-08-03T01:39:53.308937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.466971Z","title":"In: 2023 IEEE/ACM 45th International Conference on Software Engineering (ICSE)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.466971Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:58c576c4479ea156e1ba4a35bca9aae23938aa6a782c98cb6de849a0514e2186","observation_id":"22293177-b667-4c70-8249-c45074af2d3d","resolution":{"observed_at":"2026-08-03T01:39:53.466971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07745","last_updated":"2024-09-27T07:26:27Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T16:24:14Z","title":"Deep Reinforcement Learning for Autonomous Cyber Defence: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07745","snapshot_observed_at":"2026-08-03T01:39:53.626474Z","title":"https://doi.org/10.48550/arXiv.2310.07745, http://arxiv.org/abs/2310.07745, arXiv:2310.07745 [cs]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.626474Z"},"links":{"cited_paper":"/paper/2310.07745","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:ae98cae850510a3172fcc681dfe52743a3b20fd87e741483a1d2ade923877463","observation_id":"5c6e0014-b882-4034-9065-e6d34a80fed2","resolution":{"observed_at":"2026-08-03T01:39:53.626474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.792216Z","title":"IEEE Robotics and Automation Letters3(4), 4423–4430 (Oct 2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.792216Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:51c299c25e6fc45fc0035d403ac37be405ac8fcea2c7c3c20667eed4ce469ee4","observation_id":"557633b9-fa7c-46bc-9d3e-59d175991dec","resolution":{"observed_at":"2026-08-03T01:39:53.792216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.885137Z","title":"https://doi.org/10.1007/s00521- 025-11162-0, https://doi.org/10.1007/s00521-025-11162-0","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.885137Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:a0e82b8aeca5b7d2b0ca6be7126391928d16a12c8350142a05039368ded8efac","observation_id":"eda13aea-b8e2-486e-bcfb-09b39ee17db2","resolution":{"observed_at":"2026-08-03T01:39:53.885137Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:53.996854Z","title":"In: 2025 IEEE International Conference on Fuzzy Systems (FUZZ)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:53.996854Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:1aeae6186c63e410205a3fb0623b964d908d52498a2e1ed1f49febe2bf67e207","observation_id":"88cf79e1-96dc-4784-b82c-0d2b0bc969df","resolution":{"observed_at":"2026-08-03T01:39:53.996854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T01:39:54.150659Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.150659Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:edd6d23aba23cb6dd8ea2121e61ab9044f51b782bc4f12d500121e57beaa9f89","observation_id":"9715169d-f8fc-48c6-b72b-c9857e31696a","resolution":{"observed_at":"2026-08-03T01:39:54.150659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:54.313818Z","title":"In: 2025 IEEE Inter- national Conference on Consumer Electronics (ICCE)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.313818Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:c8ce0283dca0f3fcc3fec9132edfbdaebc62596ecbf4352d5bfbca29019e0d3e","observation_id":"cf817027-79ec-4b81-9d74-503f92839049","resolution":{"observed_at":"2026-08-03T01:39:54.313818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:54.475417Z","title":"MIT Press, Cambridge, MA, 2nd edn","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.475417Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:476834def264a2bc1b99785c99168ba63e6b9e76625f2e06dc514d13f188c7b1","observation_id":"35b43d0b-90e3-4c82-871c-9c5ccbdb7eb2","resolution":{"observed_at":"2026-08-03T01:39:54.475417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:54.601928Z","title":"https://github.com/Poly-AIvsAI/LLMDistillationACO (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.601928Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:240f61f377473085ff6e9cd6c282ff44bf8d07faec11c033fa93fbab62dd1245","observation_id":"d4233e1c-ce95-46cf-abaa-738006603b03","resolution":{"observed_at":"2026-08-03T01:39:54.601928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:54.759914Z","title":"In: 2025 IEEE Annual Congress on Artificial Intelligence of Things (AIoT)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.759914Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:30e2a28ed53d1ff272f1a7e9910919f85609b2bd0ee3203e2edb7502f7759849","observation_id":"1100c980-ab73-4123-bb8f-2c29f23efa7f","resolution":{"observed_at":"2026-08-03T01:39:54.759914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19278","doi":"10.48550/arxiv.2508.19278","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.48550/arXiv.2508.19278, http://arxiv.org/abs/2508.19278, arXiv:2508.19278 [cs]","venue":"Open MIND","work_id":"09a4f0bc-141b-4f6d-8ff9-1ac1bfdab5c9","year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.870695Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:259a548777e32397429e0615f370758384a4eb42f1189013fffbc9b43a5accfa","observation_id":"3248d513-38bc-475c-ba3d-7808c20817d5","resolution":{"observed_at":"2026-08-03T01:43:37.433367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:38:19.719809+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:38:19.719809+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:54.962963Z","title":"https://doi.org/10.48550/arXiv.2509.05311, http://arxiv.org/abs/2509.05311, arXiv:2509.05311 [cs]","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:54.962963Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:d13decd0d90009e44410c0cdb95d5518ed3cadbf47a1c1cc0f8c57f045de4856","observation_id":"fe97287d-64ef-479e-93f4-32ad7225ab17","resolution":{"observed_at":"2026-08-03T01:39:54.962963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:55.068987Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:55.068987Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:da6df6f6ba9a38402e96ecb1b436d77b2b71c1450de22b1d798201bd5bc7ac4d","observation_id":"974b8e6a-1c61-499e-ac0d-189344799cf8","resolution":{"observed_at":"2026-08-03T01:39:55.068987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:39:55.230972Z","title":"IEEE Robotics and Automation Letters 10(1), 612–619 (Jan 2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:55.230972Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:852ca917db580aac296cdcda4053a280b16877cb186aad8a9ed30885112b4edf","observation_id":"43897768-aaad-4570-a530-9eff66f5fc70","resolution":{"observed_at":"2026-08-03T01:39:55.230972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/a17020060","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Algorithms17(2), 60 (Feb 2024)","venue":"Algorithms","work_id":"eb898dfa-ce38-43d7-9734-72cad4fe59d4","year":2024},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:55.351417Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:5792bcd7e5c46680cbe438ae2b23a55743cf322c9d029576549c871eb7203a1c","observation_id":"1d9ebcc0-c1a1-4648-8814-703f3ac9fb0e","resolution":{"observed_at":"2026-08-03T01:43:37.304940Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:38:19.883477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:38:19.883477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05939","last_updated":"2023-08-25T14:07:50Z","snapshot_observed_at":"2026-07-06T16:30:00.114521Z","submitted_at":"2023-08-25T14:07:50Z","title":"Learning Cyber Defence Tactics from Scratch with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05939","snapshot_observed_at":"2026-08-03T01:39:55.512107Z","title":"https://doi.org/10.48550/arXiv.2310.05939, http://arxiv.org/abs/2310.05939, arXiv:2310.05939 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:55.512107Z"},"links":{"cited_paper":"/paper/2310.05939","citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:007bd9de0d9c1a06f16e9122a78d5dd78ca0be6356a9bfac4065b8eabeeafc7e","observation_id":"aa1939bf-9ee1-4968-9d9c-87fc36336457","resolution":{"observed_at":"2026-08-03T01:39:55.512107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.20335","doi":"10.48550/arxiv.2505.20335","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.48550/arXiv.2505.20335, http://arxiv.org/abs/2505.20335, arXiv:2505.20335 [cs] version: 4 20 K","venue":"ArXiv.org","work_id":"5ae1185b-176c-43ad-acb3-2e0b99e54e08","year":2026},"citing_paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T01:39:55.628235Z"},"links":{"citing_paper":"/paper/2607.28826"},"observation_digest":"sha256:118f2bb4e6ec85e01162158e7579fc3797bd2468aac32e1d82d24eacac28f95b","observation_id":"4a5870e4-e45e-4624-8798-a91332bb8fa4","resolution":{"observed_at":"2026-08-03T01:43:37.193407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:38:20.103057+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:38:20.103057+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.28826","last_updated":"2026-07-30T20:28:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T22:32:37.791421Z","submitted_at":"2026-07-30T20:28:02Z","title":"Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2607.28826."}