{"as_of":"2026-08-07T20:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b490a67a97b62d632b8b74b646d013ef5e1830c5f97cd5a7b7056cab48f98df4","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:47:32.539100Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:10:02.988190Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:11:15.663157Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.04883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04883","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond training-time poisoning: Component-level and post-training backdoors in deep reinforcement learning.arXiv preprint arXiv:2507.04883","venue":null,"work_id":"52785530-65cf-4e33-b8d0-44cf55ef7309","year":null},"citing_paper":{"arxiv_id":"2605.09638","last_updated":"2026-05-10T16:34:16Z","snapshot_observed_at":"2026-08-02T13:49:44.882700Z","submitted_at":"2026-05-10T16:34:16Z","title":"Plan2Cleanse: Test-Time Backdoor Defense via Monte-Carlo Planning in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:02.988190Z"},"links":{"cited_paper":"/paper/2507.04883","citing_paper":"/paper/2605.09638"},"observation_digest":"sha256:6e4ef9f511f4732e5e23ec80ac63e86843c57ebbbe0bb57c3fee02ab68813267","observation_id":"3d68a91a-fe1b-49f5-a350-913ddf275d47","resolution":{"observed_at":"2026-05-12T02:11:15.665346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04883/citation-record","integrity":"/paper/2507.04883/integrity","json":"/paper/2507.04883/citation-record.json","paper":"/paper/2507.04883"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T19:47:32.495768Z","title":"arXiv preprint arXiv:2312.00752","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.495768Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:2392feda7766409dd36c27e41afd92b966fa9f29ef39807b07af5feb4b4c5c9e","observation_id":"d7b1c3e9-1521-410e-b0e8-6dd89a77e30d","resolution":{"observed_at":"2026-08-06T19:47:32.495768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.745400Z","title":"In 2020 57th ACM/IEEE Design Automation Con- ference (DAC), 1–6","venue":null,"work_id":"8780c86c-4fbd-4b6f-949a-dd1992d1eb73","year":2020},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.499861Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:25be4374f55b448e51801cd1c0719c92cb38db3a924312916acd9f7cc59eb150","observation_id":"c1d34480-7bc9-4a1c-8550-f3f464906be9","resolution":{"observed_at":"2026-08-06T19:47:32.750134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.733588Z","title":"In 25th Annual Network And Distributed System Security Sym- posium (NDSS 2018)","venue":null,"work_id":"8816dde7-7f32-4466-8bfa-75495ef1e61d","year":2018},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.507705Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:c4d4756903ad903b11b6edc543ba6c11d5f185769228805ff2346fa9d228cf92","observation_id":"75bc1667-a68d-4f17-a783-e410f910f1d9","resolution":{"observed_at":"2026-08-06T19:47:32.737495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13995","last_updated":"2025-06-02T18:41:35Z","snapshot_observed_at":"2026-08-06T00:32:12.566786Z","submitted_at":"2024-10-17T19:50:28Z","title":"Adversarial Inception Backdoor Attacks against Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13995","snapshot_observed_at":"2026-08-06T19:47:32.519317Z","title":"In International Conference on Machine Learning, 7974–7984","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.519317Z"},"links":{"cited_paper":"/paper/2410.13995","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:83691e4684e15721b7ddb883b8ea98a90d142f15e51527f8515f97e7a6c86756","observation_id":"99d39d33-da79-4c51-944a-394625008cf6","resolution":{"observed_at":"2026-08-06T19:47:32.519317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:47:32.523289Z","title":"arXiv preprint arXiv:1707.06347","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.523289Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:4401171660cf755b3a243734e023f67e105c9edbfaccd414c757bb22e8a0bf97","observation_id":"d7e5bf73-131c-4f1d-931f-a6c6d0559302","resolution":{"observed_at":"2026-08-06T19:47:32.523289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.720926Z","title":"In 2024 IEEE Security and Privacy Work- shops (SPW), 76–86","venue":null,"work_id":"e75578fa-4120-47f0-84ef-0ee113a74fa5","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.527186Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:843d4cbf65344481c29bbd8d87b3b941a65ff8ba46f6d19809c8c822eed6bf9d","observation_id":"dd35e65d-d608-477d-b5be-6f6a1d6a1944","resolution":{"observed_at":"2026-08-06T19:47:32.725339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00579","last_updated":"2021-12-12T23:22:37Z","snapshot_observed_at":"2026-07-06T11:05:38.870562Z","submitted_at":"2021-05-02T23:47:55Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00579","snapshot_observed_at":"2026-08-06T19:47:32.531262Z","title":"arXiv preprint arXiv:2105.00579","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.531262Z"},"links":{"cited_paper":"/paper/2105.00579","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:2987a842acb1f93f44ad58a898ed6d2847e32d34ae6c3114ab28e35692ea70ae","observation_id":"c748fc02-93b7-42d3-bc99-3714c2db734b","resolution":{"observed_at":"2026-08-06T19:47:32.531262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.709124Z","title":"In Findings of the Association for Computational Linguistics ACL 2024, 5339–5352","venue":null,"work_id":"2ac6bdcd-44ae-4503-bffb-7f33db6f0636","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.535123Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:47c4822880a10f1cf96e2af642e63df324d44a4ce060fe763b9a570a78edc91c","observation_id":"df8cf65f-928a-4067-a32e-98d48770f60a","resolution":{"observed_at":"2026-08-06T19:47:32.712999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.696234Z","title":"In GLOBECOM 2022-2022 IEEE Global Com- munications Conference, 2710–2715","venue":null,"work_id":"adf0a418-9f52-4e0a-aa47-720a698439f3","year":2022},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.539100Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:e5b187aea1e63cf9b80dcbd32007d1e0d94e3ca7e1f11cea2202cc539ac20a95","observation_id":"1f777e99-5961-462e-aaca-87fb7500c169","resolution":{"observed_at":"2026-08-06T19:47:32.700914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T19:47:32.511413Z","title":"arXiv preprint arXiv:1312.5602","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.511413Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:b4ae8fa280db63d5a3f9c5ed1acc2862f5ff68e1ab9a2861961bfe459dfdeaf8","observation_id":"ec568db4-6e52-4121-980c-43aa367c6ebd","resolution":{"observed_at":"2026-08-06T19:47:32.511413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.03632","last_updated":"2017-12-11T02:58:13Z","snapshot_observed_at":"2026-07-06T06:13:41.923764Z","submitted_at":"2017-12-11T02:58:13Z","title":"Robust Deep Reinforcement Learning with Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.03632","snapshot_observed_at":"2026-08-06T19:47:32.515321Z","title":"arXiv preprint arXiv:1712.03632","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.515321Z"},"links":{"cited_paper":"/paper/1712.03632","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:138ea718002f8d10442029fc35cbd0aa643894f19960920bfdef8d2aaab85507","observation_id":"61c55b76-66d4-4c46-9cec-3a12307ac459","resolution":{"observed_at":"2026-08-06T19:47:32.515321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.759323Z","title":"In 2018 15th interna- tional conference on ubiquitous robots (ur), 896–901","venue":null,"work_id":"2d2b942f-d267-4db3-a8a6-da51f5375a08","year":2018},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.483100Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:6dfbfbd4ea3d5969a9383de8c350599d078a35bb6f3d6682856d9c7a53579b5b","observation_id":"6adb9cf4-a9f3-4a12-8d18-31e10f1bd7c9","resolution":{"observed_at":"2026-08-06T19:47:32.763836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.13091","last_updated":"2025-01-04T03:46:53Z","snapshot_observed_at":"2026-07-06T10:27:33.663816Z","submitted_at":"2020-12-24T04:07:36Z","title":"Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.13091","snapshot_observed_at":"2026-08-06T19:47:32.491825Z","title":"arXiv preprint arXiv:2012.13091","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.491825Z"},"links":{"cited_paper":"/paper/2012.13091","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:62c0a5c8eee0795f1ac3175821f665ff691dad6ef84f9a067ee249a24c0b9e85","observation_id":"91ad3e1d-1e6d-4bad-9d9e-75a10a69d546","resolution":{"observed_at":"2026-08-06T19:47:32.491825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.07798","last_updated":"2021-06-14T23:16:41Z","snapshot_observed_at":"2026-07-06T11:19:18.563623Z","submitted_at":"2021-06-14T23:16:41Z","title":"Poisoning Deep Reinforcement Learning Agents with In-Distribution Triggers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.07798","snapshot_observed_at":"2026-08-06T19:47:32.478998Z","title":"arXiv preprint arXiv:2106.07798","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.478998Z"},"links":{"cited_paper":"/paper/2106.07798","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:a1026e0aae86bdf9c40ad0c35b4a379b78b108842d53c7759c64af6538ac3b20","observation_id":"da0798f3-51ad-4443-a5ed-083a64caa3db","resolution":{"observed_at":"2026-08-06T19:47:32.478998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00762","last_updated":"2022-07-28T17:30:20Z","snapshot_observed_at":"2026-07-06T12:24:25.416929Z","submitted_at":"2022-01-03T17:09:32Z","title":"Execute Order 66: Targeted Data Poisoning for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2201.00762","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.00762","snapshot_observed_at":"2026-08-06T19:47:32.669219Z","title":"Execute Order 66: Targeted Data Poisoning for Reinforcement Learning","venue":"cs.LG","work_id":"2d7f1ed2-d3e7-4f73-869a-c1ef94c0db61","year":2022},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.487428Z"},"links":{"cited_paper":"/paper/2201.00762","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:46a340a43c262319db0159ab179aed942b7fda95064ebf2be140970645ca0593","observation_id":"23081c6e-d028-4110-a649-2b0d995ee678","resolution":{"observed_at":"2026-08-06T19:47:32.674104Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.772195Z","title":"In NeurIPS 2023 Workshop on Backdoors in Deep Learning-The Good, the Bad, and the Ugly","venue":null,"work_id":"69806f00-c6c7-480d-a169-9b504e77b0b7","year":2023},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.474756Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:c0fea9552a7c7bbd551fb6ece20ee21a00005a015d5d5f0fab7d20fe335cc7e3","observation_id":"c27e0c91-7957-40ce-8b40-50d51c57fc32","resolution":{"observed_at":"2026-08-06T19:47:32.776022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06957","last_updated":"2024-02-10T13:57:51Z","snapshot_observed_at":"2026-07-06T17:28:23.089590Z","submitted_at":"2024-02-10T13:57:51Z","title":"Architectural Neural Backdoors from First Principles","version":1},"cited_work":{"arxiv_id":"2402.06957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.06957","snapshot_observed_at":"2026-08-06T19:47:32.626669Z","title":"Architectural Neural Backdoors from First Principles","venue":"cs.CR","work_id":"a18dd72e-5a95-415e-80a7-1d4573cfc477","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.503342Z"},"links":{"cited_paper":"/paper/2402.06957","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:fcf6454f4afc08a93b4e29aa49059e37cc1bae3a5ab0ce8c30ae1ea4def208da","observation_id":"3293d2a2-c6d0-4573-adac-5eeaf31d9fdb","resolution":{"observed_at":"2026-08-06T19:47:32.632658Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T19:34:47.468372Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2507.04883."}