{"as_of":"2026-08-08T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:659601e07c05c9b5ca67605e4fc5d64e0f93e5fb4b9f338f74ec0be9fc636ed6","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:58:13.783532Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20621/citation-record","integrity":"/paper/2505.20621/integrity","json":"/paper/2505.20621/citation-record.json","paper":"/paper/2505.20621"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.345268Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.345268Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:41d072f38b186aa3769031042a54ed2b122ebdc2c751ed99fb2e125eb2f85555","observation_id":"fff5ac11-2e8f-464c-8dbe-29197c94ade4","resolution":{"observed_at":"2026-08-07T13:58:10.345268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.395338Z","title":"Brendan McMahan, Ilya Mironov, Kunal Talwar, and Li Zhang","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.395338Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2210537e078b96a88b7ad4729934acba7c4778e0df5fa9f192852717bb3bc7cf","observation_id":"e47827d9-1d46-4011-89c5-ad04c65b6f87","resolution":{"observed_at":"2026-08-07T13:58:10.395338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.963641Z","title":"Differentially private policy evaluation","venue":null,"work_id":"332ebafa-4b07-478f-a7b1-33be96f0d6c8","year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.453612Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:0049daba183613b1bac0b563ab0d528eac9c5cbc3ad3f34c026c74b0dd82b003","observation_id":"eb48bc7a-e6ce-444c-abb2-027743bdec62","resolution":{"observed_at":"2026-08-07T13:58:20.063936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09982","last_updated":"2019-10-08T15:44:43Z","snapshot_observed_at":"2026-07-06T07:55:08.790633Z","submitted_at":"2019-05-24T00:53:24Z","title":"Hypothesis Testing Interpretations and Renyi Differential Privacy","version":2},"cited_work":{"arxiv_id":"1905.09982","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.09982","snapshot_observed_at":"2026-08-07T13:58:15.838151Z","title":"Hypothesis Testing Interpretations and Renyi Differential Privacy","venue":"cs.LG","work_id":"7f6a2bda-dc29-41be-a6bd-1ef45b2b8f60","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.510887Z"},"links":{"cited_paper":"/paper/1905.09982","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1c240c6f29efa5d27d24f0c5414dbe6f73a764b225ac04c45dad61f9d241705d","observation_id":"394eb3f3-fa2e-4228-8a7e-37cd469125b4","resolution":{"observed_at":"2026-08-07T13:58:15.945700Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05776","last_updated":"2021-06-20T22:23:24Z","snapshot_observed_at":"2026-07-06T10:40:22.123573Z","submitted_at":"2021-02-10T23:31:53Z","title":"Defense Against Reward Poisoning Attacks in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2102.05776","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.05776","snapshot_observed_at":"2026-08-07T13:58:15.517872Z","title":"Defense Against Reward Poisoning Attacks in Reinforcement Learning","venue":"cs.LG","work_id":"04ec31e9-8d50-420f-9c26-67d296cb1a05","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.575392Z"},"links":{"cited_paper":"/paper/2102.05776","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:efc795821d40ad9632321c03e209f0b482529c44d7d6919d8a46fcfda82b584e","observation_id":"6658e4c2-1756-46ce-b56d-1a7ccccedc6b","resolution":{"observed_at":"2026-08-07T13:58:15.654771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.816066Z","title":"Can M achine L earning be S ecure? In Proceedings of the 2006 ACM S ymposium on I nformation, C omputer and C ommunications S ecurity , pp.\\ 16--25, 2006","venue":null,"work_id":"e1d528f3-2bb4-45a7-9480-ec7f7c30c02a","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.618171Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:286585917c21d29edf445276db76f41719b4b75aa36fab25f50f3d8545291415","observation_id":"2a541fa7-5d70-4c73-a5e8-ad70f3df3408","resolution":{"observed_at":"2026-08-07T13:58:19.889656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.706698Z","title":"A Distributional Perspective on Reinforcement Learning","venue":null,"work_id":"91704654-b269-46cf-98a4-e21eb0f41de8","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.665286Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:508bf9fccbcb88e99285bd8626dfd72fbc9f5b8f4b9a3e2462a5c65db5a23172","observation_id":"1820ff58-aef0-407f-805b-3014c478a83b","resolution":{"observed_at":"2026-08-07T13:58:19.766424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.6389","last_updated":"2013-03-25T10:16:36Z","snapshot_observed_at":"2026-07-06T02:50:47.096675Z","submitted_at":"2012-06-27T19:59:59Z","title":"Poisoning Attacks against Support Vector Machines","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.6389","snapshot_observed_at":"2026-08-07T13:58:10.743477Z","title":"Poisoning Attacks against Support Vector Machines","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.743477Z"},"links":{"cited_paper":"/paper/1206.6389","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:7ffec63aa8ae3e457a5c4b2ca227265394ae6752de968ffce9359179144ae7b8","observation_id":"3ad9621a-4b7d-4fb2-af97-580d816a663d","resolution":{"observed_at":"2026-08-07T13:58:10.743477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.475511Z","title":"Double Bubble, Toil and Trouble: Enhancing Certified Robustness Through Transitivity","venue":null,"work_id":"12dfc4e7-bd3e-4a91-bdf0-6b6ef95d9b22","year":2022},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.791538Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:83f9b0085c1e920cdd2ceec7992c102571f5afb2947bc637dad5784ad7e5b4b7","observation_id":"9c3c8726-1fb6-4669-9bca-dcf89c27e2a3","resolution":{"observed_at":"2026-08-07T13:58:19.575732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.835804Z","title":"Cullen, Paul Montague, Shijie Liu, Sarah M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.835804Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a2ebf20ea29c87a4fa0535130ed236710da028a5c551a3c4f21cdb598b55b7c9","observation_id":"0c7e1589-336b-418f-836d-fa45d714bccd","resolution":{"observed_at":"2026-08-07T13:58:10.835804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.365716Z","title":"Et T u C ertifications: R obustness C ertificates Y ield B etter A dversarial E xamples","venue":null,"work_id":"dbc3f2aa-61ff-47a6-b143-bbe7c66c4a3e","year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.893900Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:419e8e837e17fedda94b970fd0294b3dab3b2c209e5763bcf3af4959d6921311","observation_id":"c827b364-f57e-4602-a48b-4b228d703595","resolution":{"observed_at":"2026-08-07T13:58:19.431300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.163294Z","title":"Unifying pac and regret: Uniform pac bounds for episodic reinforcement learning","venue":null,"work_id":"e11ffc01-202b-430a-9eff-6b3e2587b187","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.946046Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:c3d1fe8a564ebcc1f55c9a02081cbb6b7549212ebbe9fd7936e3b98f78b49384","observation_id":"a143930a-313a-46dc-890b-aa8017a12b1c","resolution":{"observed_at":"2026-08-07T13:58:19.260158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06443","last_updated":"2019-03-15T02:31:22Z","snapshot_observed_at":"2026-08-05T15:38:13.597097Z","submitted_at":"2016-04-21T19:54:24Z","title":"Robust Estimators in High Dimensions without the Computational Intractability","version":2},"cited_work":{"arxiv_id":"1604.06443","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.06443","snapshot_observed_at":"2026-08-07T13:58:15.263383Z","title":"Robust Estimators in High Dimensions without the Computational Intractability","venue":"cs.DS","work_id":"0e479889-1982-4b20-890d-94fe4725fca7","year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.990606Z"},"links":{"cited_paper":"/paper/1604.06443","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:678bf34217cc4427e1ce9a8c69d3c72a103f1525a1778e43df387346a29489e5","observation_id":"9a0c3942-9daf-4d22-97b5-d6abf63b58c8","resolution":{"observed_at":"2026-08-07T13:58:15.329140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.884829Z","title":"Asymptotic Minimax Character of the Sample Distribution Function and of the Classical Multinomial Estimator","venue":null,"work_id":"5b8aa764-a4ea-46f9-912a-8f95f0214e51","year":1956},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.044135Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:c261d32760c23efa41547cc6e8e6e9c14db37f24de1eaa38d15c52d8a83679a4","observation_id":"1dd4274f-52da-4f4e-8360-10c4006ac579","resolution":{"observed_at":"2026-08-07T13:58:18.990864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.672998Z","title":"Calibrating Noise to Sensitivity in Private Data Analysis","venue":null,"work_id":"3ece963a-05ac-4ac4-9360-37944ccf6f03","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.103866Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:831373dce1d8c56d20fc9037401f61c28a24fad1bc98e0708db5d47c1364cd72","observation_id":"e049882e-5244-45c9-948a-2d17167dc24d","resolution":{"observed_at":"2026-08-07T13:58:18.780176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.505651Z","title":"Data Mining with Differential Privacy","venue":null,"work_id":"097c23f5-fcc4-451d-8fa4-75a8e015789c","year":2010},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.162546Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:b3bb46dceb123091a3ece35870d953b14f4e0b0bea31cdc82e9cba7e82af76a6","observation_id":"34ad001b-1bc7-4cd4-a55d-6d742f0b7403","resolution":{"observed_at":"2026-08-07T13:58:18.582555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.371998Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning , 2020","venue":null,"work_id":"2e80aa58-cf60-4ffa-aff4-96f9a092b2d2","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.237113Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:5c287529c373963e802e08ab5f8282b45825c5287768e52b628cf84a945b0fc8","observation_id":"3f26c35f-b011-4774-b079-67ebe023fc42","resolution":{"observed_at":"2026-08-07T13:58:18.447912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03014329","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.882228Z","title":"Sugli integrali multipli","venue":null,"work_id":"bc0431ba-1e52-4104-a104-ccd00d767eb1","year":1907},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.288564Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:3af690c16d200323774fa5d8af2c96bbc3f602744e051e87e02d026aa2faa6fa","observation_id":"67aa7d41-d589-405e-abf6-56ef7c52c8af","resolution":{"observed_at":"2026-08-07T13:58:13.921093Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.269837Z","title":"Local Differential Privacy for Regret Minimization in Reinforcement Learning","venue":null,"work_id":"21a5c702-8ba0-4e2a-b432-4047d487886c","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.334231Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:654a6b78ca9cc14a1223ca6500dbca1e84723dca56b58fd979fd8530213f3b7d","observation_id":"ccd6209c-2cd5-4d85-8e34-4ad93078cd26","resolution":{"observed_at":"2026-08-07T13:58:18.286662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.124170Z","title":"The optimal noise-adding mechanism in differential privacy","venue":null,"work_id":"4b1bb6d3-92fa-4a78-b554-4a7d49fc295b","year":2015},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.378442Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:09251e30b302e3d19b33278ee04850521a79dded10f13e76e77ac463e92e08c4","observation_id":"789f2d58-fd88-4457-8a2a-b55a68f3fa53","resolution":{"observed_at":"2026-08-07T13:58:18.188645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.959065Z","title":"Baffle: Hiding Backdoors in Offline Reinforcement Learning Datasets","venue":null,"work_id":"57537b8a-ab86-42d4-b05d-a21b5c0a0ec1","year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.431883Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:d8998f5b651eb300f2ff5d7d947e2e13bcf1ba29600666bae8ef8b31c4a21819","observation_id":"dc46ffc6-487f-46c0-b2d7-a1744d005eae","resolution":{"observed_at":"2026-08-07T13:58:18.019283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:11.489514Z","title":"Numerical composition of differential privacy","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.489514Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:5cbad2c71c8fcaf4ec7ba72f5813ab85747dba1fc8fececeac9e1b9d7ec5e47e","observation_id":"589a5bf1-52e0-4d17-83c5-2025d025f924","resolution":{"observed_at":"2026-08-07T13:58:11.489514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-04T09:15:33.903637Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-07T13:58:11.528104Z","title":"A Review of Safe Reinforcement Learning : Methods , Theory and Applications , May 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.528104Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2cd98eb4167c32a99de108eaf32dcccab9c9a643b154645793640115de8150b6","observation_id":"4720fc79-0604-4f11-8fca-7d0a01f03ca0","resolution":{"observed_at":"2026-08-07T13:58:11.528104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15690","last_updated":"2023-07-28T17:29:49Z","snapshot_observed_at":"2026-07-06T15:59:56.179560Z","submitted_at":"2023-07-28T17:29:49Z","title":"Benchmarking Offline Reinforcement Learning on Real-Robot Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15690","snapshot_observed_at":"2026-08-07T13:58:11.564713Z","title":"u rtler, Sebastian Blaes, Pavel Kolev, Felix Widmaier, Manuel W \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.564713Z"},"links":{"cited_paper":"/paper/2307.15690","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:9289d237f749c96513b1f00f5fe53f94db8e8b54672da85c295f61e6af621940","observation_id":"70277514-d98b-49ca-bf4b-bdab7c0f8635","resolution":{"observed_at":"2026-08-07T13:58:11.564713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.04495","last_updated":"2020-12-09T21:44:40Z","snapshot_observed_at":"2026-08-07T22:42:05.404553Z","submitted_at":"2020-08-11T03:12:42Z","title":"Intrinsic Certified Robustness of Bagging against Data Poisoning Attacks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.04495","snapshot_observed_at":"2026-08-07T13:58:11.616583Z","title":"Intrinsic Certified Robustness of Bagging against Data Poisoning Attacks","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.616583Z"},"links":{"cited_paper":"/paper/2008.04495","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1fecf33427dc579c92ae2199f1383101db5b4c4b8eaf071ef2862a91c9d778da","observation_id":"8881ad37-41d7-4bf2-9069-efc3d7cce518","resolution":{"observed_at":"2026-08-07T13:58:11.616583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.878164Z","title":"Learning to Drive in a Day","venue":null,"work_id":"ba5ef41d-52ec-4cc5-bcd4-bc263ecd5eb9","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.692610Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:0430a952c29d67535755b309fda8f13001638dc4ea516b2e84e0451caaee5009","observation_id":"b2213f9f-41f4-47f0-9dba-816f334d1396","resolution":{"observed_at":"2026-08-07T13:58:17.900856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:11.741659Z","title":"TrojDRL : Evaluation of Backdoor Attacks on Deep Reinforcement Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.741659Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:7529ed1e8ab304186fa6d170faa60ebe47791f8b53717353a0f96f3c9da6242b","observation_id":"b1c3d714-7f65-4201-b68d-a5d010f537ed","resolution":{"observed_at":"2026-08-07T13:58:11.741659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-07T13:58:11.789761Z","title":"Offline Reinforcement Learning with Implicit Q-learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.789761Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:0ed4972f9294502736cb0f06b9236c778a43ed23b8d73d55941254d261ad0d63","observation_id":"2bad0680-e924-4e5e-a51a-14a76bd0b187","resolution":{"observed_at":"2026-08-07T13:58:11.789761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.795962Z","title":"Adversarial Machine Learning-Industry Perspectives","venue":null,"work_id":"24ef0eb6-3980-423a-bd17-1f8db5737c5c","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.854978Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:dc4b72a4f89c1c6f4e4ccb3d39ac7c013c7fe2a5ab669d63a153ae3f23e6d284","observation_id":"8cafc824-7fae-4bbc-adcf-90d19db13da3","resolution":{"observed_at":"2026-08-07T13:58:17.838112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.676104Z","title":"Batch Reinforcement Learning","venue":null,"work_id":"204d1ff9-15c1-4c24-b03b-0326f6f3df4e","year":2012},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.919009Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:917f27303830089e988f2c2d0eb86fa5007f06fde546aec0176e8dc3d692d725","observation_id":"a11dddfb-1c1f-4798-affe-1d6c6c6831ef","resolution":{"observed_at":"2026-08-07T13:58:17.735382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03471","last_updated":"2019-05-29T15:17:39Z","snapshot_observed_at":"2026-07-06T06:22:40.962594Z","submitted_at":"2018-02-09T22:24:50Z","title":"Certified Robustness to Adversarial Examples with Differential Privacy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03471","snapshot_observed_at":"2026-08-07T13:58:11.963813Z","title":"Certified Robustness to Adversarial Examples with Differential Privacy","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.963813Z"},"links":{"cited_paper":"/paper/1802.03471","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:17c7e6c99c2a1625c5e85bfdae54bdabef96b50b44f550abb3139a9316a56fda","observation_id":"1ab3b5d8-01d8-485a-bafc-cc90c18c0fd6","resolution":{"observed_at":"2026-08-07T13:58:11.963813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14768","last_updated":"2021-03-18T05:50:12Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T03:16:31Z","title":"Deep Partition Aggregation: Provable Defense against General Poisoning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14768","snapshot_observed_at":"2026-08-07T13:58:12.013805Z","title":"Deep Partition Aggregation : Provable Defense against General Poisoning Attacks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.013805Z"},"links":{"cited_paper":"/paper/2006.14768","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:c79b1f4ddedc8950ac3da6e94cdb918dc6c0e05926293993577d83a53934db3d","observation_id":"71ea4002-2d91-4894-99bd-3443b068e4c5","resolution":{"observed_at":"2026-08-07T13:58:12.013805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09363","last_updated":"2021-02-23T14:03:58Z","snapshot_observed_at":"2026-07-06T09:21:36.119578Z","submitted_at":"2020-05-19T11:13:43Z","title":"Enhancing Certified Robustness via Smoothed Weighted Ensembling","version":3},"cited_work":{"arxiv_id":"2005.09363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.09363","snapshot_observed_at":"2026-08-07T13:58:14.894447Z","title":"Enhancing Certified Robustness via Smoothed Weighted Ensembling","venue":"cs.LG","work_id":"9fb32d3e-cbdc-4a9a-8528-2079f08bbf3d","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.074274Z"},"links":{"cited_paper":"/paper/2005.09363","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:fcea7c3564a78d85d32183419728236a1128cb8b366d80b7a56ae3db7b7b2138","observation_id":"e1242a9c-d548-4aec-b590-875911a1c024","resolution":{"observed_at":"2026-08-07T13:58:15.003992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.531158Z","title":"Enhancing the Antidote: Improved Pointwise Certifications Against Poisoning Attacks","venue":null,"work_id":"2f9f2de3-8e5e-4203-bdf8-9d85f8272da3","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.125904Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:88263135c995dc3b8dd36adc5a92a9ed43dc864692901c0e52c79588c2581fc1","observation_id":"ca798ca0-bc46-4a9d-a7f8-893d0f7a1bcb","resolution":{"observed_at":"2026-08-07T13:58:17.577920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08689","last_updated":"2023-11-01T03:08:01Z","snapshot_observed_at":"2026-07-06T08:38:22.401222Z","submitted_at":"2019-11-20T03:49:13Z","title":"Corruption-robust exploration in episodic reinforcement learning","version":4},"cited_work":{"arxiv_id":"1911.08689","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.08689","snapshot_observed_at":"2026-08-07T13:58:14.743958Z","title":"Corruption-robust exploration in episodic reinforcement learning","venue":"cs.LG","work_id":"b75f1b04-29d1-45ac-8fe8-a5e8adbd23c5","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.183239Z"},"links":{"cited_paper":"/paper/1911.08689","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:8bdc00f301ad16e5905b82db8e6d088fd46ade2208fc9c58870e0371f88e34a3","observation_id":"7a86f304-8b4b-49c8-b2ff-0ba0007b5722","resolution":{"observed_at":"2026-08-07T13:58:14.820244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.09860","last_updated":"2019-07-05T17:31:41Z","snapshot_observed_at":"2026-07-06T07:41:11.712588Z","submitted_at":"2019-03-23T18:20:47Z","title":"Data Poisoning against Differentially-Private Learners: Attacks and Defenses","version":2},"cited_work":{"arxiv_id":"1903.09860","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.09860","snapshot_observed_at":"2026-08-07T13:58:14.605697Z","title":"Data Poisoning against Differentially-Private Learners: Attacks and Defenses","venue":"cs.LG","work_id":"ceedba5d-86da-4e24-9191-bbe4678aa552","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.229699Z"},"links":{"cited_paper":"/paper/1903.09860","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a180d2780a4136093ebe454f483054735c8cfcaae957e1309e1eb7e41a45c990","observation_id":"8e390ef4-365d-4800-a9f7-a5a8097c92b9","resolution":{"observed_at":"2026-08-07T13:58:14.661390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06963","last_updated":"2018-02-24T00:40:30Z","snapshot_observed_at":"2026-07-06T06:04:56.966823Z","submitted_at":"2017-10-18T23:46:57Z","title":"Learning Differentially Private Recurrent Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.06963","snapshot_observed_at":"2026-08-07T13:58:12.290803Z","title":"Learning Differentially Private Recurrent Language Models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.290803Z"},"links":{"cited_paper":"/paper/1710.06963","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e7b32b3c7763f798b84ad6c8b99f7d94dc46f5370a4bf7c47bfe8d2e503f80d0","observation_id":"14e93ff9-c68b-465f-8d43-9228d5a2e3ac","resolution":{"observed_at":"2026-08-07T13:58:12.290803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07476","last_updated":"2017-08-25T23:54:30Z","snapshot_observed_at":"2026-07-06T05:31:14.242311Z","submitted_at":"2017-02-24T06:46:38Z","title":"Renyi Differential Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.07476","snapshot_observed_at":"2026-08-07T13:58:12.360881Z","title":"Renyi Differential Privacy","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.360881Z"},"links":{"cited_paper":"/paper/1702.07476","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ccfae179d54168dfdcf53c014f48d7ee356342f381c48ad7e41bf5c606b1a9b5","observation_id":"cc4baff2-2a95-4132-bf73-5079c709cd48","resolution":{"observed_at":"2026-08-07T13:58:12.360881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10530","last_updated":"2019-08-28T03:03:25Z","snapshot_observed_at":"2026-08-07T03:15:48.518041Z","submitted_at":"2019-08-28T03:03:25Z","title":"R\\'enyi Differential Privacy of the Sampled Gaussian Mechanism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10530","snapshot_observed_at":"2026-08-07T13:58:12.413237Z","title":"Renyi Differential Privacy of the Sampled Gaussian Mechanism","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.413237Z"},"links":{"cited_paper":"/paper/1908.10530","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:af79926fcfb1b34a2db6da0e5d05145150c66aa0f8c64abce42f1a6395378c52","observation_id":"49f452c2-1770-4c3d-9fdf-62e0c5b6a715","resolution":{"observed_at":"2026-08-07T13:58:12.413237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-07T13:58:12.489760Z","title":"Asynchronous Methods for Deep Reinforcement Learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.489760Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:aa6c2f49a5b3ac44fe205c7fd08f6b275682c0012b4e394f1141c739ecda9833","observation_id":"ba73ae61-cfb2-491f-9418-3d1843619463","resolution":{"observed_at":"2026-08-07T13:58:12.489760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T13:58:12.548539Z","title":"Playing Atari with Deep Reinforcement Learning , December 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.548539Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e46e5439f5f28a093643804946ea592d0fc8a261e8d793dec02f31e65a96dcc2","observation_id":"b9684f96-d061-41b7-9a02-b77d68a8a7e0","resolution":{"observed_at":"2026-08-07T13:58:12.548539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.456030Z","title":"Reinforcement Learning for Optimized Trade Execution","venue":null,"work_id":"a7d3b0fb-6de3-4b1c-a9b4-3c1aeddb7a44","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.599802Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e588b99b7720decdfb5ddbc94bbc576bd914900c3f0d3ada32be1f77ca01bcd8","observation_id":"2a3a14f8-4fd5-463b-acde-0c206d0061a6","resolution":{"observed_at":"2026-08-07T13:58:17.486822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.377127Z","title":"Online Defense Strategies for Reinforcement Learning Against Adaptive Reward Poisoning","venue":null,"work_id":"21fe92aa-c238-4f23-b2d7-2f674f90d1ad","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.656421Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:4388dff33ec23ecd16900c0ffda781206febad86990379f3cd8193d3d4e95372","observation_id":"6f60739e-802a-4b36-a12f-9909e98866bf","resolution":{"observed_at":"2026-08-07T13:58:17.413005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.07174","last_updated":"2019-08-09T10:07:01Z","snapshot_observed_at":"2026-07-06T06:00:38.265995Z","submitted_at":"2017-09-21T06:30:24Z","title":"Agile Autonomous Driving using End-to-End Deep Imitation Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.07174","snapshot_observed_at":"2026-08-07T13:58:12.769027Z","title":"Agile Autonomous Driving Using End-to-end Deep Imitation Learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.769027Z"},"links":{"cited_paper":"/paper/1709.07174","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:dfe9682f96f100dbb782587d89283ab98450d709c1869557f6b5c7edd6f443f5","observation_id":"d13364f2-5c18-48ea-bbd0-4e2bcb6bf3d3","resolution":{"observed_at":"2026-08-07T13:58:12.769027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.268769Z","title":"Deep K-NN Defense Against Clean-label Data Poisoning Attacks","venue":null,"work_id":"a8d4dfb6-6a58-4425-8eb1-6036f27947f7","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.821597Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2cfd78070a8a1372e975992cb3229fe31fe7465007dba6c4b2a4e230edd41a3c","observation_id":"7acc4916-4512-45f5-b433-824142c5c1be","resolution":{"observed_at":"2026-08-07T13:58:17.318537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:12.868504Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.868504Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2883eeaaabccca1c3a971e8ad2516f051f53551b1113c22fa22846a0791da4b4","observation_id":"b3bd390b-7a42-4411-abd6-c24270de1d24","resolution":{"observed_at":"2026-08-07T13:58:12.868504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.185092Z","title":"Provably Robust Deep Learning via Adversarially Trained Smoothed Classifiers","venue":null,"work_id":"17ed05ac-370e-4bea-9893-1f863e2d1369","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.915034Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1400c2f5683c22a268dc2da72209ed8681b9afe9d23bb1ce933955565dcd9165","observation_id":"f7d01c77-2c05-4c21-ad04-49aa98957907","resolution":{"observed_at":"2026-08-07T13:58:17.225777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:58:12.951446Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.951446Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:8a35bd7f5245a14c78b28e2b1eba2be7d37b1187ba7e3ab09590ace9399288ee","observation_id":"6a535aef-ea08-4117-8a03-ebde7c499942","resolution":{"observed_at":"2026-08-07T13:58:12.951446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.054947Z","title":"Mastering the Game of Go Without Human Knowledge","venue":null,"work_id":"ac2b3334-a4f4-4ce5-8232-35227518c4dc","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.003732Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:00fcb57d692a72a288bf4d22cfa2b489fa2d07bcda5d0afc424496e5853671b7","observation_id":"c5df22cb-82f0-483c-b1ab-09c59223baee","resolution":{"observed_at":"2026-08-07T13:58:17.124406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.924274Z","title":"Policy Gradient Methods for Reinforcement Learning with Function Approximation","venue":null,"work_id":"8a0cdb1f-174c-4df6-9473-f6ffe16f6b6d","year":1999},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.043533Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:b0d2bd5f181fdd7c385da1f0a4cbe02f47e6572306b82f10a93016e7e03f9273","observation_id":"08e662b6-0749-48a2-b188-3ec8958339b7","resolution":{"observed_at":"2026-08-07T13:58:16.970742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.094075Z","title":"Terry, Ariel Kwiatkowski, John U","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.094075Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:855595e5f1482ba47ec9d9adbcf8cc90484ab2b3d9990b306e648419ca5a1342","observation_id":"7f9b2d7a-d2e7-4daf-9166-b8c4360d77b7","resolution":{"observed_at":"2026-08-07T13:58:13.094075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.819267Z","title":"Private reinforcement learning with pac and regret guarantees","venue":null,"work_id":"05242b7f-9239-4a93-9ba8-a6cb71a5c20e","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.133977Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:b1bbb2861eab8466126c5921faca86dc5efc796c61553f4e7b4cb6e178b5ea13","observation_id":"a9eb8d4e-018f-4a2c-bc30-04b5c7a8d79b","resolution":{"observed_at":"2026-08-07T13:58:16.869511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.725872Z","title":"Supervised Reinforcement Learning with Recurrent Neural Network for Dynamic Treatment Recommendation","venue":null,"work_id":"8d07940b-1268-4671-b59d-4851faa5d0a9","year":2018},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.199802Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:4f2fcea5bf32d4894f1eea3850c34307dec9f767640439e8c7b4ad430136bcb7","observation_id":"36692d03-6505-42c3-b6d9-03a864a07656","resolution":{"observed_at":"2026-08-07T13:58:16.765612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31140","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:14.125396Z","title":"Stop-and- Go : Exploring Backdoor Attacks on Deep Reinforcement Learning -based Traffic Congestion Control Systems","venue":null,"work_id":"fcef68cd-3275-4572-a8f7-cc29c114cbf4","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.248103Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:8592d939c20b89e7523f01e2c06b57de66c0bd813d20f386981aef3262eea13a","observation_id":"7540fe80-4775-4f29-b38b-60eae47e4d60","resolution":{"observed_at":"2026-08-07T13:58:14.155163Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08398","last_updated":"2022-03-16T05:02:47Z","snapshot_observed_at":"2026-07-06T12:48:23.739370Z","submitted_at":"2022-03-16T05:02:47Z","title":"COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08398","snapshot_observed_at":"2026-08-07T13:58:13.290928Z","title":"COPA : Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks , March 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.290928Z"},"links":{"cited_paper":"/paper/2203.08398","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a71c7bb7da70387acd5bcff057ed579077f12f8fcd639ae908c22b10f8067bcd","observation_id":"ba3d32fb-2bb7-4e76-b43a-df73ff573454","resolution":{"observed_at":"2026-08-07T13:58:13.290928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.595124Z","title":"Reward Poisoning Attacks on Offline Multi-agent Reinforcement Learning","venue":null,"work_id":"cfb62e76-83cb-4e06-aff3-70b885a2b852","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.342851Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:042197d49b79f13caa02c3a8f008a6661eba0721a832e2aa8753eea08012bb57","observation_id":"5ffef097-7597-4449-a8d6-5b5d98e75068","resolution":{"observed_at":"2026-08-07T13:58:16.665669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12955","last_updated":"2024-03-09T17:46:44Z","snapshot_observed_at":"2026-07-06T16:35:48.413898Z","submitted_at":"2023-10-19T17:54:39Z","title":"Towards Robust Offline Reinforcement Learning under Diverse Data Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12955","snapshot_observed_at":"2026-08-07T13:58:13.401469Z","title":"Towards Robust Offline Reinforcement Learning under Diverse Data Corruption , March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.401469Z"},"links":{"cited_paper":"/paper/2310.12955","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2a38e102816dde429f61e6a11fd50098df5569af40d308c3cefe2b3316944a1b","observation_id":"ed62ba83-6f84-4164-82d6-76bbb48ffb17","resolution":{"observed_at":"2026-08-07T13:58:13.401469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.364922Z","title":"Corruption- Robust Offline Reinforcement Learning with General Function Approximation","venue":null,"work_id":"2765e82f-8648-4690-a05d-b582f6c5030e","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.431278Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:b30df33509d2eaa1a2324fe04d0953ee35b581682cb2a066ce17e1e2ed077aa4","observation_id":"38072f5c-ea6b-4682-933a-7422a2fc3004","resolution":{"observed_at":"2026-08-07T13:58:16.482507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12298","last_updated":"2022-08-22T20:24:50Z","snapshot_observed_at":"2026-08-06T15:46:33.397187Z","submitted_at":"2021-09-25T07:10:54Z","title":"Opacus: User-Friendly Differential Privacy Library in PyTorch","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12298","snapshot_observed_at":"2026-08-07T13:58:13.486506Z","title":"Opacus: U ser-friendly D ifferential P rivacy L ibrary in P yTorch","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.486506Z"},"links":{"cited_paper":"/paper/2109.12298","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:17a0c93113efcf2ab33a63fdfc7714ba030700674541c30f5f9e06f84f648085","observation_id":"e3968089-bdcd-4e9b-968a-9028aae86aa0","resolution":{"observed_at":"2026-08-07T13:58:13.486506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.154128Z","title":"Reinforcement Learning in Healthcare: A survey","venue":null,"work_id":"6e74537b-10ba-4fdf-bbed-e7245eb1da2e","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.537023Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ec769a69b9dd33db0f4548e2a9f0dcefc805a759f4eb2417a748a1097a90b1f4","observation_id":"e96d09a9-bedc-43f1-9864-8a61614da9e8","resolution":{"observed_at":"2026-08-07T13:58:16.261783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06630","last_updated":"2021-06-11T22:41:53Z","snapshot_observed_at":"2026-07-06T11:18:32.821345Z","submitted_at":"2021-06-11T22:41:53Z","title":"Corruption-Robust Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06630","snapshot_observed_at":"2026-08-07T13:58:13.577413Z","title":"Corruption- Robust Offline Reinforcement Learning , June 2021 a","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.577413Z"},"links":{"cited_paper":"/paper/2106.06630","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:6ec0ead48acb553fe460afa07bc1b3862ebfa435560089716df25f3c5682453a","observation_id":"fb03fb0a-7a4f-41ed-bd17-e3c4c8229bfd","resolution":{"observed_at":"2026-08-07T13:58:13.577413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05800","last_updated":"2021-06-08T16:46:54Z","snapshot_observed_at":"2026-07-06T10:40:24.954633Z","submitted_at":"2021-02-11T01:48:38Z","title":"Robust Policy Gradient against Strong Data Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05800","snapshot_observed_at":"2026-08-07T13:58:13.612803Z","title":"Robust Policy Gradient against Strong Data Corruption , June 2021 b","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.612803Z"},"links":{"cited_paper":"/paper/2102.05800","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:5ca93334c0e158ae428e6041c1639e6a019f558f69328b75ae9b5728e137221f","observation_id":"89a41442-0c24-4b8a-9c40-0b924e3174c9","resolution":{"observed_at":"2026-08-07T13:58:13.612803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.652960Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.652960Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:adb0a3ca95cd2267f9b7c6d6900859134885799b24ba3e17fbac27bbf58cdea3","observation_id":"14cb29f9-f190-415d-ba4b-f112960a727a","resolution":{"observed_at":"2026-08-07T13:58:13.652960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.720597Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.720597Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:95f632cabfd38e4cbec71563c1ce7c1eff88e1e6c7dfa91d16c931f054a7081b","observation_id":"d0afb212-4af5-448f-ad11-7350dcd94b20","resolution":{"observed_at":"2026-08-07T13:58:13.720597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11718","last_updated":"2020-01-31T09:03:23Z","snapshot_observed_at":"2026-08-04T23:08:11.058553Z","submitted_at":"2020-01-31T09:03:23Z","title":"Locally Private Distributed Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2001.11718","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.11718","snapshot_observed_at":"2026-08-07T13:58:14.355059Z","title":"Locally Private Distributed Reinforcement Learning","venue":"cs.LG","work_id":"870e4abc-a3bc-4506-9b68-eb815056b845","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.783532Z"},"links":{"cited_paper":"/paper/2001.11718","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:5cc701b582e54f71576be9fa167a89b3dfaea45d73efba299679c6dc3c71d5f0","observation_id":"e3447457-77e2-4a75-a7c8-d454236472f4","resolution":{"observed_at":"2026-08-07T13:58:14.432828Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:48:14.571565Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":28,"verified_exact":7,"verified_fuzzy":28},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2505.20621."}