{"as_of":"2026-08-22T10:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f816043b3f739d8efffaabd069953057eea65c919f6716979131ef2202410bc1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:37:33.643023Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T12:55:44.528298Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-09T12:34:10.546045Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02377","last_updated":"2025-02-04T14:57:54Z","snapshot_observed_at":"2026-08-16T01:48:54.299389Z","submitted_at":"2025-02-04T14:57:54Z","title":"A Minimax Approach to Ad Hoc Teamwork","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T12:34:10.546045Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2502.02377"},"observation_digest":"sha256:bf8ef2b45a465d5f48fc9d6bdb5632cd60444c7930c19f42be552b9dd37feffd","observation_id":"38be4d4c-4d94-425a-b9ca-ae9d9270865c","resolution":{"observed_at":"2026-08-09T12:34:10.546045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2502.03698","last_updated":"2026-04-24T15:18:05Z","snapshot_observed_at":"2026-08-16T21:29:51.517590Z","submitted_at":"2025-02-06T01:17:39Z","title":"How Vulnerable Is My Learned Policy? Universal Adversarial Perturbation Attacks On Modern Behavior Cloning Policies","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T03:31:58.944729Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2502.03698"},"observation_digest":"sha256:67b12e3acff3c87cdf5cf88572a5faf4f681526709cd465e8bb0ef10390524b9","observation_id":"fb971443-cc8b-4b56-b18e-eaf7df933a32","resolution":{"observed_at":"2026-05-23T03:32:28.041897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-07T10:31:58.552488Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-20T08:50:52.249817Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.552488Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:750289fce182fed2c4f9c470fb483d648956f824181f976326ca4dbdd9cb95e4","observation_id":"6a3ba601-d6c1-4ce7-aef7-cc5dab0bda08","resolution":{"observed_at":"2026-08-07T10:31:58.552488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-06T04:37:05.320640Z","title":"Adversarial policies: Attacking deep reinforcement learning,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2508.05677","last_updated":"2025-08-05T11:10:49Z","snapshot_observed_at":"2026-08-14T08:15:35.083952Z","submitted_at":"2025-08-05T11:10:49Z","title":"Adversarial Attacks on Reinforcement Learning-based Medical Questionnaire Systems: Input-level Perturbation Strategies and Medical Constraint Validation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:05.320640Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2508.05677"},"observation_digest":"sha256:d10ba34806b181eb1d0ff4dd8453478454f935da1eef1aaeab9d916bc337dee1","observation_id":"0a3643ad-4f4c-4b8e-8535-4ef9a2443076","resolution":{"observed_at":"2026-08-06T04:37:05.320640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-04T18:09:37.034805Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10147","last_updated":"2025-09-12T11:20:11Z","snapshot_observed_at":"2026-08-16T07:27:01.460052Z","submitted_at":"2025-09-12T11:20:11Z","title":"Virtual Agent Economies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:09:37.034805Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2509.10147"},"observation_digest":"sha256:cb844156794d91be93aa929758e8051f437c31237b19ea9ae05963013ed1173b","observation_id":"07502c7d-f9f7-4b38-8f47-52cc623fbbaa","resolution":{"observed_at":"2026-08-04T18:09:37.034805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2509.15103","last_updated":"2026-05-12T02:18:50Z","snapshot_observed_at":"2026-08-15T18:46:35.784654Z","submitted_at":"2025-09-18T16:03:50Z","title":"Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T15:50:58.208995Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2509.15103"},"observation_digest":"sha256:cfdfaa86c596d73a8e2f15d4f08469ac202f5d12cea9babd3701e6b2917af187","observation_id":"3dd19fe0-001c-4349-878b-1f6fa5494205","resolution":{"observed_at":"2026-05-18T15:51:33.866773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-03T03:15:09.929179Z","title":"Gleave, M","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.929179Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:c7249bcc9a2bb8603700be0c73095b9390cc218675321361469cbaca23dac80f","observation_id":"15c259b0-7f1e-4ef1-94e3-72f758120ec0","resolution":{"observed_at":"2026-08-03T03:15:09.929179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2604.04733","last_updated":"2026-04-24T20:17:41Z","snapshot_observed_at":"2026-08-17T00:06:44.147652Z","submitted_at":"2026-04-06T15:00:54Z","title":"Discovering Failure Modes in Vision-Language Models using RL","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:21:25.761342Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2604.04733"},"observation_digest":"sha256:b9e868baa1650d84731aba03de454e04dcb4d6adf454971eaa4b19c5c6b96e96","observation_id":"6789ed48-93f4-43ea-a882-683c59d278d5","resolution":{"observed_at":"2026-05-10T23:05:48.683079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2604.10974","last_updated":"2026-04-15T07:15:04Z","snapshot_observed_at":"2026-08-15T07:36:05.514153Z","submitted_at":"2026-04-13T04:23:54Z","title":"Robust Adversarial Policy Optimization Under Dynamics Uncertainty","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:00:33.267264Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2604.10974"},"observation_digest":"sha256:c608086d7160859031ad9fbc26af34e52129a9eb269b685da1589233321df862","observation_id":"1ba2accc-ce3a-404c-b549-d6e54d7edd8c","resolution":{"observed_at":"2026-05-11T09:26:03.547395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2605.02495","last_updated":"2026-05-25T07:21:41Z","snapshot_observed_at":"2026-08-21T01:49:18.659127Z","submitted_at":"2026-05-04T11:45:38Z","title":"Efficient Preference Poisoning Attack on Offline RLHF","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-08T19:29:25.000361Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2605.02495"},"observation_digest":"sha256:7ff296d59e946c617b510f2127143feaaf1f46b98975cf744942a463b246b53e","observation_id":"c1f4a11e-6f78-4cac-a37f-f59b89c6d772","resolution":{"observed_at":"2026-05-09T05:50:27.142672Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2605.23027","last_updated":"2026-05-21T20:50:47Z","snapshot_observed_at":"2026-08-19T10:10:21.879934Z","submitted_at":"2026-05-21T20:50:47Z","title":"PIMbot: A Self-Adaptive Attack Framework for Adversarial Manipulation of Multi-Robot Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T05:26:22.623367Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2605.23027"},"observation_digest":"sha256:979739da0133a977fb6c5e2a991c0182d3c899d8622c413a0bd306c884e23a93","observation_id":"1b7d7088-9e33-45fe-95f4-a83678eeb201","resolution":{"observed_at":"2026-05-25T05:26:38.693020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.10615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-07-01T12:55:44.528298Z","title":"Adversarial policies: Attacking deep reinforcement learning","venue":null,"work_id":"9c95df50-eb6b-486d-a836-f4cefa526555","year":1905},"citing_paper":{"arxiv_id":"2606.30807","last_updated":"2026-06-29T18:32:29Z","snapshot_observed_at":"2026-08-02T15:02:50.322784Z","submitted_at":"2026-06-29T18:32:29Z","title":"Off the Rails: Hijacking the Scoring Head in Generative End-to-End Driving Planners with Safety-Violating Adversarial Perturbations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-01T01:32:45.896103Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2606.30807"},"observation_digest":"sha256:d41ca02727fd8e463670ff928fc6e935e7aca568d67b7100462ea6fd6f1c58ac","observation_id":"56867355-8a02-4eea-830a-e9fb5cb74b2c","resolution":{"observed_at":"2026-07-01T12:55:44.530115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-02T13:17:50.484506Z","title":"Adversarial policies: Attacking deep reinforcement learning.arXiv preprint arXiv:1905.10615, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2607.20472","last_updated":"2026-05-24T05:49:14Z","snapshot_observed_at":"2026-08-18T04:16:12.355769Z","submitted_at":"2026-05-24T05:49:14Z","title":"Robust Critics: Defending LLMs Against Multi-Turn Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T13:17:50.484506Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2607.20472"},"observation_digest":"sha256:119b0514322ae98c05c7c1fd760b097f0b1271aeb4c06d89d2449edc42f860f0","observation_id":"3effdda8-2776-49c7-b4eb-8aaea1541e05","resolution":{"observed_at":"2026-08-02T13:17:50.484506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-15T14:37:33.643023Z","title":"Adversarial policies: Attacking deep reinforcement learning.arXiv preprint arXiv:1905.10615, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.06520","last_updated":"2026-08-06T19:03:49Z","snapshot_observed_at":"2026-08-19T20:55:06.223574Z","submitted_at":"2026-08-06T19:03:49Z","title":"Online Security Learning in Cooperative Multi-Agent Systems under Hidden Byzantine Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:33.643023Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2608.06520"},"observation_digest":"sha256:f8f1cd37df4acdcad7f5f6907fbd4e2dbab0e38facb878b6fc9e87399bcb7c7a","observation_id":"8f7258b4-f119-478e-9c91-1dc5ae02f1ac","resolution":{"observed_at":"2026-08-15T14:37:33.643023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1905.10615/citation-record","integrity":"/paper/1905.10615/integrity","json":"/paper/1905.10615/citation-record.json","paper":"/paper/1905.10615"},"outbound":[],"paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T16:26:39.989221Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:1905.10615."}