{"as_of":"2026-08-10T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5774cad809341a6fe670fbca85b87f25ab7576aea680064d8fde8cc0b203dc18","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:13.861239Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:44:01.319756Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:11:15.649761Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-08-07T00:44:01.319756Z","title":"Cullen, Paul Montague, Sarah Monazam Erfani, and Benjamin IP Rubinstein","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13024","last_updated":"2025-08-11T02:15:49Z","snapshot_observed_at":"2026-08-07T01:31:42.307657Z","submitted_at":"2025-06-16T01:18:33Z","title":"Position: Certified Robustness Does Not (Yet) Imply Model Security","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T00:44:01.319756Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2506.13024"},"observation_digest":"sha256:51add822c4966cf46cce5f12c2c9d82a4b45c86e2825a3d31b39fbc4167aaa5f","observation_id":"26814004-f1fd-40ac-8dfe-eaa6b2887a79","resolution":{"observed_at":"2026-08-07T00:44:01.319756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-08-06T18:29:36.704014Z","title":"Cullen, Paul Montague, Sarah M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08270","last_updated":"2025-07-11T02:34:16Z","snapshot_observed_at":"2026-08-07T01:31:51.955348Z","submitted_at":"2025-07-11T02:34:16Z","title":"Agent Safety Alignment via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:29:36.704014Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2507.08270"},"observation_digest":"sha256:fd44add5143d929f00dae7b898b3606a63e138cede2dc1c2be6a70ed2e4a6096","observation_id":"3d8ff5a5-ea96-4e0b-91cb-22d95099f4d2","resolution":{"observed_at":"2026-08-06T18:29:36.704014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.19532","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-06-25T02:17:29.965443Z","title":"Fine-pruning: Defending against backdooring attacks on deep neural networks","venue":null,"work_id":"72a79b6e-3c7e-468e-9c45-4cbcbaffc019","year":2025},"citing_paper":{"arxiv_id":"2605.05977","last_updated":"2026-05-07T10:21:14Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T10:21:14Z","title":"BehaviorGuard: Online Backdoor Defense for Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T10:45:47.028500Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2605.05977"},"observation_digest":"sha256:eda9bdbf2e5e3d42e04e0a2baaf0d89515256e07e4d15c7ca248893540815c03","observation_id":"71bedfe3-d47f-4a69-a628-94828df796af","resolution":{"observed_at":"2026-06-25T02:17:29.965443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.19532","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19532","snapshot_observed_at":"2026-06-25T02:17:29.965443Z","title":"Fine-pruning: Defending against backdooring attacks on deep neural networks","venue":null,"work_id":"72a79b6e-3c7e-468e-9c45-4cbcbaffc019","year":2025},"citing_paper":{"arxiv_id":"2605.09638","last_updated":"2026-05-10T16:34:16Z","snapshot_observed_at":"2026-08-02T13:49:44.882700Z","submitted_at":"2026-05-10T16:34:16Z","title":"Plan2Cleanse: Test-Time Backdoor Defense via Monte-Carlo Planning in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:02.988190Z"},"links":{"cited_paper":"/paper/2505.19532","citing_paper":"/paper/2605.09638"},"observation_digest":"sha256:48332132440e7e23b0b540f9fe21a59b70a7aa0e1fca2d9f4c08b4b3c211cada","observation_id":"34f9838f-1e5f-413e-ba7a-4122c125163c","resolution":{"observed_at":"2026-06-25T02:17:29.965443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19532/citation-record","integrity":"/paper/2505.19532/integrity","json":"/paper/2505.19532/citation-record.json","paper":"/paper/2505.19532"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.903079Z","title":"Poisoning Deep Reinforcement Learning Agents with In- Distribution Triggers","venue":null,"work_id":"5bd19087-8752-4b74-a1c5-567cb0eca9b3","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.745552Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6b6067d5a853348f1e783ff050003e86cacd2616e5fc08620ec34cc4972ad0fc","observation_id":"24f0970d-618e-4102-8706-4439c8b32b7c","resolution":{"observed_at":"2026-08-07T14:16:25.052191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.573755Z","title":"Can Machine Learning be Secure? InProceedings of the 2006 ACM Symposium on Information, Computer and Communications Security, pages 16–25, 2006","venue":null,"work_id":"ba1f24e4-8152-4158-abc4-12bdb5950035","year":2006},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.815703Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:110e8ea28296b027575a2c87637c1d0279055ec3a1f7939b30bcc07c1b9bee98","observation_id":"ee685072-8c34-402e-b082-b7a4187c5205","resolution":{"observed_at":"2026-08-07T14:16:24.767945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.271969Z","title":"The Theory of Dynamic Programming","venue":null,"work_id":"6b906cdc-c064-4507-b556-2ea9b3b1b795","year":1954},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.913367Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7ecf51d05d8c0fa67152ca0a138f512744ab6dcd93027fe654b98b21e1602b1d","observation_id":"0c1b0ddf-32dc-4637-bcba-72c79c6bb8a8","resolution":{"observed_at":"2026-08-07T14:16:24.402866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.999751Z","title":"Provable Defense against Backdoor Policies in Reinforcement Learning.Advances in Neural Information Processing Systems, 35:14704–14714, 2022","venue":null,"work_id":"ef0d3845-1070-4974-8f71-f03b33662c22","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:08.991357Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:fe7c5c0ec0a9e851e28b3bb78d70482ca2423d51390685455ea568d37db23f29","observation_id":"4d8d3aa4-062a-4087-a14e-4432c50246b2","resolution":{"observed_at":"2026-08-07T14:16:24.118281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.749888Z","title":"Evasion Attacks Against Machine Learning at Test Time","venue":null,"work_id":"c5f70085-26ff-4669-b2e5-5981e4cf967a","year":2013},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.056165Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:972ac64411befc2b20a491b99cbfcc5ca6cad93b4faf514d69cb05186daa1f12","observation_id":"60c86d88-0001-4dbb-9dfe-207899ff98b0","resolution":{"observed_at":"2026-08-07T14:16:23.863576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.6389","last_updated":"2013-03-25T10:16:36Z","snapshot_observed_at":"2026-07-06T02:50:47.096675Z","submitted_at":"2012-06-27T19:59:59Z","title":"Poisoning Attacks against Support Vector Machines","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.6389","snapshot_observed_at":"2026-08-07T14:16:09.120007Z","title":"Poisoning Attacks against Support Vector Machines.arXiv:1206.6389 [cs, stat], March 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.120007Z"},"links":{"cited_paper":"/paper/1206.6389","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:68915abde3bc0921c3915fb73a75a731a5dfcb007c3da073c1da7fbead7f308e","observation_id":"1f7c4ae6-b121-41a8-a1f8-4e3e5a839b5a","resolution":{"observed_at":"2026-08-07T14:16:09.120007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.438464Z","title":"A conceptual framework for externally-influenced agents: An assisted reinforcement learning review.Journal of Ambient Intelligence and Humanized Computing, 14(4):3621–3644, 2023","venue":null,"work_id":"4e123d0b-f597-485b-b146-6f31cd878653","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.219209Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7a19f67adef4e18e033fb178c6e678be2578796f27a9dfec5e76cab1e34ddfa1","observation_id":"b98bfa1e-704b-4477-b2c3-a5bea58a8677","resolution":{"observed_at":"2026-08-07T14:16:23.564667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.136280Z","title":"Strong Data Augmentation Sanitizes Poisoning and Backdoor Attacks Without an Accuracy Tradeoff","venue":null,"work_id":"c4f18a76-e1b2-480b-b64a-0d0ab9f72e7a","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.314319Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:304e5a45d518b6cbab8d258ca230eaec7086354bc285d29ecceb674916dabfa7","observation_id":"cea9ad1c-3035-43c9-a257-4727e7a5eaf2","resolution":{"observed_at":"2026-08-07T14:16:23.296878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12066","last_updated":"2019-04-26T22:41:03Z","snapshot_observed_at":"2026-07-06T07:48:48.815834Z","submitted_at":"2019-04-26T22:41:03Z","title":"ABIDES: Towards High-Fidelity Market Simulation for AI Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12066","snapshot_observed_at":"2026-08-07T14:16:09.371334Z","title":"Abides: Towards high-fidelity market simulation for ai research.arXiv preprint arXiv:1904.12066, 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.371334Z"},"links":{"cited_paper":"/paper/1904.12066","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:403f6201c751a0eae71c972b46432a0ff191b20fb65544e575276b151f956665","observation_id":"d5950921-2832-4264-a2d5-f3a85efe7f24","resolution":{"observed_at":"2026-08-07T14:16:09.371334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11455","last_updated":"2022-11-21T13:44:13Z","snapshot_observed_at":"2026-07-06T14:21:11.376419Z","submitted_at":"2022-11-21T13:44:13Z","title":"Backdoor Attacks on Multiagent Collaborative Systems","version":1},"cited_work":{"arxiv_id":"2211.11455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.11455","snapshot_observed_at":"2026-08-07T14:16:15.407287Z","title":"Backdoor Attacks on Multiagent Collaborative Systems","venue":"cs.MA","work_id":"9e3f1300-abac-44c4-b41f-08d9bfc97834","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.462751Z"},"links":{"cited_paper":"/paper/2211.11455","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7c7bb26fd0190e38e0bf5c528563360c29ad5592571a59127a048c21f0d86387","observation_id":"7316298d-0a5b-4fea-89ad-d3a01200ca4f","resolution":{"observed_at":"2026-08-07T14:16:15.524825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.830344Z","title":"MARNet: Backdoor Attacks against Cooperative Multi-Agent Reinforcement Learning.IEEE Transactions on Dependable and Secure Computing, 2022","venue":null,"work_id":"c76ebb5c-d26e-47e6-8b9b-a5396871ab44","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.542591Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6d3e7bf8d4bec5bcb28b3725330d4ecf6909a171a3ce59d0dbb3a02f9f5c1dcf","observation_id":"228bd688-ce3d-4e83-bebd-9c51564df737","resolution":{"observed_at":"2026-08-07T14:16:22.979794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.582832Z","title":"Certified Adversarial Robustness via Random- ized Smoothing","venue":null,"work_id":"edc3b8d0-85ff-4d8a-94b3-8d1448dbc9fa","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.602938Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:f81f0413dae57a9e69d3d3d3ce3771ef3a169e9ca23559108b3d7557474aeaa4","observation_id":"84e91ac8-425c-4771-b0da-0d076d7ed0aa","resolution":{"observed_at":"2026-08-07T14:16:22.687430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.295881Z","title":"Double bubble, toil and trouble: Enhancing certified robustness through transitivity.Advances in Neural Information Processing Systems, 35:19099–19112, 2022","venue":null,"work_id":"8da030c9-f4f3-4a80-bd21-ed8f2f2b528a","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.655891Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:bbb64610dfc402582197dc73b02651fe949b941f2fdaa062ae76af9945415bc4","observation_id":"10ca9940-2439-4c6d-80e2-9620d89070f8","resolution":{"observed_at":"2026-08-07T14:16:22.416479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.152076Z","title":"Cullen, Shijie Liu, Paul Montague, Sarah M","venue":null,"work_id":"bf6ee878-f98a-45b9-b7b0-8eb59c2a8523","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.746018Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:1feaeb11aed79aa0aa0fdad338ebec5e870542755bdf8e5ac4cb693c03e8b63e","observation_id":"30f1801b-c281-4a89-8e84-da716c6ad6f4","resolution":{"observed_at":"2026-08-07T14:16:22.235882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.905904Z","title":"It’s Simplex! Disaggregating Measures to Improve Certified Robustness","venue":null,"work_id":"1116cecb-08a9-4c2e-92a0-ab97f15dbed7","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.797497Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:5cd1af0ff4452f2fb7083e2baa136bf04a6236c6c4f45a7ee193619ed563293a","observation_id":"c57c3dea-9816-4319-acd6-78e9897e0bb7","resolution":{"observed_at":"2026-08-07T14:16:22.028532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.677386Z","title":"An Automated FX Trading System using Adaptive Reinforcement Learning.Expert Systems with Applications, 30(3):543–552, 2006","venue":null,"work_id":"839aaccd-5fa9-410b-aef7-cb4cc7394a58","year":2006},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.873759Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:4eca61ba799aa83c938d344aa980486c436d98a01bde34cf76bd063a0a905b7f","observation_id":"2fbd68f7-da95-443a-94e7-81af0edc5fe0","resolution":{"observed_at":"2026-08-07T14:16:21.801447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.428424Z","title":"CARLA: An Open Urban Driving Simulator","venue":null,"work_id":"cbabbbc1-d5b9-46d3-86d2-03089736202e","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:09.939953Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:f32179412a7cc974b03e45e8d3ee6dc97bf41c6857cfa66fc764eef5bdc30c50","observation_id":"90a40535-83b9-480c-9d43-9e9baa9bbf9a","resolution":{"observed_at":"2026-08-07T14:16:21.534425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.246146Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":"407dd407-673d-407f-8bdd-e9a968e23bb6","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.019452Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:be000b7ae2380e35f7ed96c31d719a1e9433e3642ad849743dc8ad1d22d3dfd6","observation_id":"3fcd4da5-b74e-4869-8304-82d192365c6f","resolution":{"observed_at":"2026-08-07T14:16:21.315128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03141","last_updated":"2024-03-05T17:26:41Z","snapshot_observed_at":"2026-08-03T08:51:35.222920Z","submitted_at":"2024-03-05T17:26:41Z","title":"Language Guided Exploration for RL Agents in Text Environments","version":1},"cited_work":{"arxiv_id":"2403.03141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.03141","snapshot_observed_at":"2026-08-07T14:16:15.162411Z","title":"Language Guided Exploration for RL Agents in Text Environments","venue":"cs.CL","work_id":"81311ab1-cf3d-4588-be33-8e2ebb2366d4","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.180714Z"},"links":{"cited_paper":"/paper/2403.03141","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:4b8bf7d0639b4cc4b1a6f9bf71e785f0258a5f12eef5b972ee6def62629f884b","observation_id":"0e7fa66a-4ce9-48a8-8290-8f3d704957fa","resolution":{"observed_at":"2026-08-07T14:16:15.282384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06974","last_updated":"2024-11-09T18:58:35Z","snapshot_observed_at":"2026-08-10T07:56:42.292730Z","submitted_at":"2022-04-14T13:55:21Z","title":"Planting Undetectable Backdoors in Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06974","snapshot_observed_at":"2026-08-07T14:16:10.237019Z","title":"Kim, Vinod Vaikuntanathan, and Or Zamir","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.237019Z"},"links":{"cited_paper":"/paper/2204.06974","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:19564a3b4b6b65a520acf2cf6cc60a04e03a14adeffcb14d11acd091cd942106","observation_id":"8c463425-7772-4b7f-a911-6cdc02f0fcfa","resolution":{"observed_at":"2026-08-07T14:16:10.237019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.830955Z","title":"BAFFLE: Hiding Backdoors in Offline Reinforcement Learning datasets","venue":null,"work_id":"fbc5eb24-1625-4cfd-9605-d8cd934a8b8a","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.324278Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:4da9bda9a9a8c79fc586e9813deaf5a228d75d7eb0a0e630a73eef77fbbd21f7","observation_id":"71cfbef9-06ea-4ae8-abae-6f8b66386102","resolution":{"observed_at":"2026-08-07T14:16:20.927351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-07-06T05:56:16.413472Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-07T14:16:10.384895Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain.arXiv:1708.06733 [cs], March 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.384895Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:582187caddc77ed4f5d94ef5f641de50d0acc19ee70ff31b6665fd51479cdbf9","observation_id":"ebb433b1-9ce8-4b8b-9d65-76e9f3449a2f","resolution":{"observed_at":"2026-08-07T14:16:10.384895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03609","last_updated":"2023-09-14T08:15:55Z","snapshot_observed_at":"2026-07-06T12:35:27.756343Z","submitted_at":"2022-02-08T02:49:09Z","title":"PolicyCleanse: Backdoor Detection and Mitigation in Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2202.03609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03609","snapshot_observed_at":"2026-08-07T14:16:14.810190Z","title":"PolicyCleanse: Backdoor Detection and Mitigation in Reinforcement Learning","venue":"cs.LG","work_id":"bfbf29a9-ae96-498a-a73e-28c59b1ed0ee","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.446404Z"},"links":{"cited_paper":"/paper/2202.03609","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:76a22666751459e98cda47c9bfc6e1f79f8505445932cec317da695a1719d6dd","observation_id":"b8c93030-60ed-4cdc-9598-1a16f925bc06","resolution":{"observed_at":"2026-08-07T14:16:14.965276Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.643440Z","title":"Assessing the Vulnerabilities of the Open-Source Artificial Intelligence (AI) Landscape: A Large-Scale Analysis of the Hugging Face Platform","venue":null,"work_id":"ea82c970-706f-4fc2-8f3b-d901a248bd36","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.454275Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:e25c409c35c339ed823ff62c28e1239f7f0fc72f19a7a574021bd7e8c460250b","observation_id":"bfb968c8-6543-42d1-be6d-6446a4d9efd6","resolution":{"observed_at":"2026-08-07T14:16:20.707748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.395182Z","title":"TrojDRL: Evaluation of Backdoor Attacks on Deep Reinforcement Learning","venue":null,"work_id":"ef8c2b9c-399e-460f-9abf-338caa5dbf10","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.582816Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:44de6d81af4dff16a9eff462d286f4578e20394781883c7984c3df419ccfb02c","observation_id":"07f1cc15-035a-44ff-b755-668f87d8a211","resolution":{"observed_at":"2026-08-07T14:16:20.511519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11420","last_updated":"2022-05-28T01:20:56Z","snapshot_observed_at":"2026-07-06T11:21:30.713389Z","submitted_at":"2021-06-21T21:42:08Z","title":"Policy Smoothing for Provably Robust Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11420","snapshot_observed_at":"2026-08-07T14:16:10.671575Z","title":"Policy Smoothing for Provably Robust Reinforcement Learning.arXiv preprint arXiv:2106.11420, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.671575Z"},"links":{"cited_paper":"/paper/2106.11420","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:b4d4b00ab268fb37f9da1e5747ea657b31aba06f04982bec0fc4c2b756beb8cd","observation_id":"1b805143-6fd5-4b8d-a1c3-54e9f60583d3","resolution":{"observed_at":"2026-08-07T14:16:10.671575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06957","last_updated":"2024-02-10T13:57:51Z","snapshot_observed_at":"2026-07-06T17:28:23.089590Z","submitted_at":"2024-02-10T13:57:51Z","title":"Architectural Neural Backdoors from First Principles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06957","snapshot_observed_at":"2026-08-07T14:16:10.746820Z","title":"Architec- tural Neural Backdoors from First Principles.arXiv preprint arXiv:2402.06957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.746820Z"},"links":{"cited_paper":"/paper/2402.06957","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:87239470d9615f0b5a0f1fd8a8b58aa11c444125b71993ad78b9bc09ee3635cb","observation_id":"97c9257d-11e0-4009-b752-278fae881646","resolution":{"observed_at":"2026-08-07T14:16:10.746820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.194501Z","title":"Markov Games as a Framework for Multi-Agent Reinforcement Learning","venue":null,"work_id":"2c86f9b7-bcfb-4d47-ace6-8dc2266d0f49","year":1994},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.832696Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:5c98459cac76b52397bb23016f23769ab463983fb640096fb610764d573da483","observation_id":"cf09a675-8643-4606-bef5-eb1fe31efd53","resolution":{"observed_at":"2026-08-07T14:16:20.254614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.976982Z","title":"Provably Efficient Black-Box Action Poisoning Attacks against Reinforcement Learning.Advances in Neural Information Processing Systems, 34:12400–12410, 2021","venue":null,"work_id":"293d3225-b9a4-4e57-9281-3a5be2734234","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.941533Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:a0a9a91565879fa2d9e6d6de7e84b57c57c13bf5a336555fb7e6ba70d7103133","observation_id":"0aa6899e-3fcd-4b29-a60d-34cdb5a316ca","resolution":{"observed_at":"2026-08-07T14:16:20.059640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.734986Z","title":"Fine-Pruning: Defending against Dackdooring Attacks on Deep Neural Networks","venue":null,"work_id":"dcc06620-dc57-49b4-939a-ebbda6158f68","year":2018},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.053113Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:2e6407d8dd2d40049f73a93e12fa0672042377d84b792a3ec0ad0b795109a593","observation_id":"1cd0789d-5bd6-49e1-8c89-d91d9c566f1c","resolution":{"observed_at":"2026-08-07T14:16:19.850917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.593965Z","title":"Enhancing the Antidote: Improved Pointwise Certifications against Poisoning Attacks","venue":null,"work_id":"886b41b6-1c58-4083-83cb-c8fa9551ab9a","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.147442Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:48820222fe8f5a620d90c2aa578b39bfa1025f9b0486f8dd433d73d4888a64af","observation_id":"c32f9f8e-6dfe-433d-b824-e736751c2eb5","resolution":{"observed_at":"2026-08-07T14:16:19.667735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.427040Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","venue":null,"work_id":"646bd3a0-b65b-4033-97e9-355d5895eaca","year":2025},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.221298Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:990f36107d7138db97bc1738becc3bc4d423e38cbaa52f0fdea13a5c35e60a61","observation_id":"f0a1f8c2-923b-44fa-80ea-cd194c8970be","resolution":{"observed_at":"2026-08-07T14:16:19.529582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.202660Z","title":"Neural Trojans","venue":null,"work_id":"3071c363-e96f-48da-8288-36973556a3b2","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.298570Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6c88a40c86cabd4d86ca30124ae1da0ac17d3993ef7006ce03b068d9bbc4a752","observation_id":"27edbecb-bf88-439f-a9f5-8a8150c26499","resolution":{"observed_at":"2026-08-07T14:16:19.305670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.014423Z","title":"Policy Poisoning in Batch Reinforcement Learning and Control.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"f09a9205-d99b-4f09-ac64-932d17407f7f","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.401800Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:dcbd165fd415098081a71f50b3229a11a012b0c093b99297b121e276c2960874","observation_id":"566ccd0f-48cf-4514-83bd-6f35319822f3","resolution":{"observed_at":"2026-08-07T14:16:19.078769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02845","last_updated":"2022-06-10T17:05:55Z","snapshot_observed_at":"2026-07-06T12:15:37.497529Z","submitted_at":"2021-12-06T08:11:05Z","title":"Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks","version":3},"cited_work":{"arxiv_id":"2112.02845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.02845","snapshot_observed_at":"2026-08-07T14:16:14.451395Z","title":"Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks","venue":"cs.LG","work_id":"5c5a9dff-be85-44be-8fae-0608ca90865e","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.458479Z"},"links":{"cited_paper":"/paper/2112.02845","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:47ccd810426ecf3463c4e108903b56b96ed3e5939a304bcf596d75770dc6a3ba","observation_id":"b6c1dd5b-9f31-483b-9d63-c915d53d8349","resolution":{"observed_at":"2026-08-07T14:16:14.616466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.798633Z","title":"Playing Atari with Deep Reinforcement Learning, December","venue":null,"work_id":"160a754a-ff02-477f-88f4-9522ca2c1067","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.554843Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:35c8b5a0d755bb385a1e60ebf4d0b2758f012ed81607e39d061dd1b0f0200a17","observation_id":"ac2a61ab-3ea7-4b80-bbf6-a8d1491e6787","resolution":{"observed_at":"2026-08-07T14:16:18.899224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.674488Z","title":"Implicit Poisoning Attacks in Two-Agent Reinforcement Learning: Adversarial Policies for Training-Time Attacks","venue":null,"work_id":"5da0ebed-f79a-4e0e-8110-28a28404a6e7","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.785271Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:2a828a575050ec4caf3ea624549b0aa262f563b796a17297ae01fe1606c270ac","observation_id":"e85d0210-ac6e-4afa-80c7-406526022785","resolution":{"observed_at":"2026-08-07T14:16:18.724484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.488574Z","title":"Cal-QL: Calibrated offline RL pre-training for efficient Online Fine-Tuning.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"532a0768-f4db-4408-877c-e3ce51803fbc","year":2024},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.951247Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:37d2bcf75c4f207f121340ddc477a5384292aaca2993c390787dbd918a1c8aa2","observation_id":"312ce2f5-0951-4555-b69f-4fe3c0baf33c","resolution":{"observed_at":"2026-08-07T14:16:18.548415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.253279Z","title":"JPMorgan Develops Robot to Execute Trades, July 2017","venue":null,"work_id":"0db9263e-2431-4fc8-a39c-2efed7532633","year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.018846Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:04d89b776bbc37c19ed5c9320cc55dd453bfe38244fcc1de489f38cb8eca36f2","observation_id":"63a6a1f2-4391-48e2-a735-baa6b864a371","resolution":{"observed_at":"2026-08-07T14:16:18.354926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.081399Z","title":"Policy Teaching via Environment Poisoning: Training-time Adversarial Attacks against Reinforcement Learning","venue":null,"work_id":"1ff7bace-cd81-496c-8f5d-94f6c6af5e3d","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.096873Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:59379d3118558589324728aa6211279fa897c26fd5bf3f05cabcdb4992da05f3","observation_id":"5fd7afc1-43d6-47fa-b9b4-8887be6340c4","resolution":{"observed_at":"2026-08-07T14:16:18.180560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.866500Z","title":"Understanding the Limits of Poisoning Attacks in Episodic Reinforcement Learning","venue":null,"work_id":"5b496b53-2cd9-455e-9432-056d9a74f84c","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.219825Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:be2870123241b305763d106e5dc25959ff96bc601b10396abc80456e0bcdd5de","observation_id":"8f8095b2-b532-429f-a7a3-492acb00e3f5","resolution":{"observed_at":"2026-08-07T14:16:17.973244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:16:12.347692Z","title":"Proximal Policy Optimization Algorithms, August 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.347692Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:e56ed7404b023367e68ca7cab845ce28e552c5cb32aad972152c26b7696b00e1","observation_id":"cebaed85-ccee-44ee-994d-8c12717c64a3","resolution":{"observed_at":"2026-08-07T14:16:12.347692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-07T14:16:12.417191Z","title":"Safe, Multi-Agent, Reinforce- ment Learning for Autonomous Driving.arXiv preprint arXiv:1610.03295, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.417191Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c807aa9fa87e6c9f4cc3af73d30511cf9369c2a79d1bfbc5b8c417b48839a103","observation_id":"ec7b3903-b31b-4ac9-ab90-b4119d1d39ec","resolution":{"observed_at":"2026-08-07T14:16:12.417191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.00774","last_updated":"2022-02-15T22:18:13Z","snapshot_observed_at":"2026-07-06T09:52:06.977995Z","submitted_at":"2020-09-02T01:43:30Z","title":"Vulnerability-Aware Poisoning Mechanism for Online RL with Unknown Dynamics","version":5},"cited_work":{"arxiv_id":"2009.00774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.00774","snapshot_observed_at":"2026-08-07T14:16:14.181252Z","title":"Vulnerability-Aware Poisoning Mechanism for Online RL with Unknown Dynamics","venue":"cs.LG","work_id":"8cf23832-661e-4af1-803c-c5a6402a9b2c","year":2020},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.543771Z"},"links":{"cited_paper":"/paper/2009.00774","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:7ca2d8c14022b61b2d4c2bae87ace4569b68ab9615beeacb03de06aebe5ef746","observation_id":"8264c65a-711a-47d2-9eac-6f488a616ac8","resolution":{"observed_at":"2026-08-07T14:16:14.239670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.650430Z","title":"PettingZoo: Gym for Multi-Agent Reinforcement Learning.Advances in Neural Information Processing Systems, 34:15032–15043, 2021","venue":null,"work_id":"5cb24976-a939-4c29-ab06-ba964f9a28a4","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.676060Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:f75bb7b013b44c8af02d8c98f016d27b48d6fdfebdc65e46d2ab121914aab2de","observation_id":"5634e41f-5f95-4688-b95c-55bc2b167cff","resolution":{"observed_at":"2026-08-07T14:16:17.716099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.837650Z","title":"Terry, Ariel Kwiatkowski, John U","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.837650Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:a010a735a2f347b9aa935988cc30d6ac5ba5180142c0db2ad8f4bf26c3735ffa","observation_id":"e88ff9e9-ce87-47a3-b961-3e01d43c85ba","resolution":{"observed_at":"2026-08-07T14:16:12.837650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.446913Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","venue":null,"work_id":"7475549f-25e5-4e53-aee8-fa0c6eb14b3f","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.019993Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:0516595a6183b64b799242628a37aca6b32d312dcaca95dba56fd7c7d6a4d861","observation_id":"88a1cf82-57b3-4079-9032-e64371323bc7","resolution":{"observed_at":"2026-08-07T14:16:17.520817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.220627Z","title":null,"venue":null,"work_id":"57383f9e-4272-48b1-8be6-f57344969f83","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.140080Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:96a34fe0f86a9bd158932c2b644cc746ebf3205b5ef00daa470304a12d1f3483","observation_id":"9b059332-876c-4306-b361-e1bfa42b28de","resolution":{"observed_at":"2026-08-07T14:16:17.328253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.081392Z","title":null,"venue":null,"work_id":"6e2113e5-a564-4d0f-8376-9abe1a081e97","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.258616Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:274f93fcf2a46546d18795f12ec5e2625fc77f772ee350f0b89334b887c60a0e","observation_id":"62011085-d68e-4778-b113-93c53cb405d2","resolution":{"observed_at":"2026-08-07T14:16:17.170905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.846437Z","title":"Transferable Environment Poisoning: Training-time Attack on Reinforcement Learning","venue":null,"work_id":"dd5ab3d9-16c2-45be-943a-f7a56c778887","year":2021},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.418890Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c434dcee5eecc9aea9245c93cd95f4261662a1bd8b9973e06b67332faec97a18","observation_id":"13b09dc5-92ce-43d8-a4d0-5c1e9a631854","resolution":{"observed_at":"2026-08-07T14:16:16.949314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09972","last_updated":"2019-02-26T14:43:14Z","snapshot_observed_at":"2026-07-06T07:35:32.722877Z","submitted_at":"2019-02-26T14:43:14Z","title":"Design of intentional backdoors in sequential models","version":1},"cited_work":{"arxiv_id":"1902.09972","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09972","snapshot_observed_at":"2026-08-07T14:16:14.010652Z","title":"Design of intentional backdoors in sequential models","venue":"cs.CR","work_id":"24b20404-1cfc-4232-b9f2-a93075d2db24","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.532135Z"},"links":{"cited_paper":"/paper/1902.09972","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:5d1e056bb90f935d1eb6fe88e42d4bd31b04301cd88412beb76465bf9fec9db4","observation_id":"8a8452bd-4632-4c30-81ed-369fcda75eea","resolution":{"observed_at":"2026-08-07T14:16:14.073814Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.620773Z","title":"A Temporal-Pattern Backdoor Attack to Deep Reinforcement Learning","venue":null,"work_id":"6c1945c1-547b-468b-9ea1-6a8ade91028f","year":2022},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.626270Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:c68b090ef57d59f9fb89a8bdd320dbc560d1f1e5192bbc175b3ea9b28d377b59","observation_id":"cfb2976a-90cc-4cd2-a21a-7e79fd02024d","resolution":{"observed_at":"2026-08-07T14:16:16.721920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.280855Z","title":"∞X k=0 γkRopp(si+k+1, aopp i+k+1, aatt i+k+1) aopp i+k+1 ∼π opp, aatt i+k+1 ∼π # , (7) πopp = argminπ∈Π E","venue":null,"work_id":"14bb54d3-f4ba-473b-b456-f77260fdac20","year":2019},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.695320Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:cfc0558909242ece6163bb562b9344bc493de761c3bbdd719715ac231e8c92e8","observation_id":"3187cb81-6d16-4ab9-a3c2-96b1066f48b0","resolution":{"observed_at":"2026-08-07T14:16:16.447981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.983891Z","title":"The trigger action and backdoor action remain consistent with those outlined in Section 4","venue":null,"work_id":"3ba8852a-46e3-44f0-90b0-104212e160fc","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.771099Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:3e7329e3def32257da0b0d95d8088b30123cfd759349f27152d7941bb340fb27","observation_id":"1d7e9e0c-9f3f-4dbb-9b36-00235c7d7530","resolution":{"observed_at":"2026-08-07T14:16:16.111055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.750807Z","title":"move-up,","venue":null,"work_id":"4f7f32e8-fae4-41af-a20d-66932a5a687f","year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.861239Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:801708e2fb4ea7e7bca5d9eef9be6774f2f497170a385881245ce11c0bcfa176","observation_id":"23cb00e4-16b6-4331-8592-0c6c4634803b","resolution":{"observed_at":"2026-08-07T14:16:15.835427Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T14:16:11.645830Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:11.645830Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:6b91e83e7be682dff4705de83fb59dfa3bfde6291efcfa6e1c546fbdd76cd2ed","observation_id":"e701deac-8449-41e7-bbfe-6a7ef1d6d8ec","resolution":{"observed_at":"2026-08-07T14:16:11.645830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:21.037818Z","title":null,"venue":null,"work_id":"710259e6-8940-4eaf-92eb-49f9d2692ea9","year":2023},"citing_paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning","version":2},"reference_index":8677,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:10.094719Z"},"links":{"citing_paper":"/paper/2505.19532"},"observation_digest":"sha256:a1415481de0d572a48d0c9349d1ff2fcd6dc9daa227dff877db4f20eaef1e0d4","observation_id":"8a09f742-749b-4f0d-86e0-0bb66a3f1c2f","resolution":{"observed_at":"2026-08-07T14:16:21.105155Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19532","last_updated":"2026-06-24T05:39:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T14:09:43.286267Z","submitted_at":"2025-05-26T05:39:35Z","title":"Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":6,"verified_fuzzy":37},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 4 inbound Pith citation observations for arXiv:2505.19532."}