{"as_of":"2026-08-11T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05f4f2d5c6d85eba07ea77cba5ac23b2d42ae5f5388feeefcb91fbaf7f9dde82","coverage":[{"denominator":207,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:12:11.769301Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.17908/citation-record","integrity":"/paper/2412.17908/integrity","json":"/paper/2412.17908/citation-record.json","paper":"/paper/2412.17908"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.02315","last_updated":"2024-02-04T02:06:57Z","snapshot_observed_at":"2026-07-06T17:24:57.402088Z","submitted_at":"2024-02-04T02:06:57Z","title":"A Survey of Large Language Models in Finance (FinLLMs)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02315","snapshot_observed_at":"2026-08-11T05:12:11.267485Z","title":"A survey of large lan- guage models in finance (finllms),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.267485Z"},"links":{"cited_paper":"/paper/2402.02315","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:865f47326bf235ce4f6281a56f88b7f8f7a12e4cea726e2fe52c545f8bdd90ca","observation_id":"ccd3452b-d494-4ffa-b911-a76cc9147588","resolution":{"observed_at":"2026-08-11T05:12:11.267485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11903","last_updated":"2024-06-15T16:11:35Z","snapshot_observed_at":"2026-07-06T18:32:28.184208Z","submitted_at":"2024-06-15T16:11:35Z","title":"A Survey of Large Language Models for Financial Applications: Progress, Prospects and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11903","snapshot_observed_at":"2026-08-11T05:12:11.273937Z","title":"A survey of large language models for financial applications: Progress, prospects and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.273937Z"},"links":{"cited_paper":"/paper/2406.11903","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:7ab356070fcfbe8cc503752c22b626ae9e90b4e9481e01f357b6712c0c478835","observation_id":"09a4f54d-a6c1-4d74-add1-e8971ed555d4","resolution":{"observed_at":"2026-08-11T05:12:11.273937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09368","last_updated":"2023-01-05T05:07:22Z","snapshot_observed_at":"2026-08-11T16:50:26.538014Z","submitted_at":"2021-04-19T14:56:44Z","title":"Deep Reinforcement Learning in a Monetary Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09368","snapshot_observed_at":"2026-08-11T05:12:11.279273Z","title":"Deep reinforcement learning in a monetary model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.279273Z"},"links":{"cited_paper":"/paper/2104.09368","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:c36fbc6fe739f1f660ed7e3421d096f592ee322e0cd4853500d3e95d744ddb01","observation_id":"5796e9a2-09e7-48f5-8ed3-732f024ea9dd","resolution":{"observed_at":"2026-08-11T05:12:11.279273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.284871Z","title":"Artificial intelligence and central bank digital currency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.284871Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:50a92817aa1a583b20ec013bf408dd949abdcb0d15b83cbf5dad54cdf47ff780","observation_id":"385850ce-5177-4cad-983b-7a8b38bb51d6","resolution":{"observed_at":"2026-08-11T05:12:11.284871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-11T05:12:11.290171Z","title":"Bloomberggpt: A large language model for finance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.290171Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:f039eb545640eae903df1ecae1c9a12b74c3bcebec610d94cd39225594dbc576","observation_id":"398468d6-b4fa-46b2-9016-07fe8e390c78","resolution":{"observed_at":"2026-08-11T05:12:11.290171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.295962Z","title":"Fingpt: Open-source financial large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.295962Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:41a1d6be01cab0a32c8a617ae31c0ac44c05c958d08b0b86cea01b4d7b03b7f8","observation_id":"197d958e-c4c1-4c4e-83fa-7e8b24ee7f9e","resolution":{"observed_at":"2026-08-11T05:12:11.295962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03736","last_updated":"2023-09-07T14:25:35Z","snapshot_observed_at":"2026-08-10T17:36:11.779370Z","submitted_at":"2023-09-07T14:25:35Z","title":"TradingGPT: Multi-Agent System with Layered Memory and Distinct Characters for Enhanced Financial Trading Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03736","snapshot_observed_at":"2026-08-11T05:12:11.301981Z","title":"Tradinggpt: Multi-agent system with layered memory and distinct characters for enhanced financial trading performance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.301981Z"},"links":{"cited_paper":"/paper/2309.03736","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:deb7458debf1b69c4e97f8da4a554e80d26e24fdced2275de49dec9e829dc77f","observation_id":"d0bdbbce-950c-4974-a7d2-e1650d0242e3","resolution":{"observed_at":"2026-08-11T05:12:11.301981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10063","last_updated":"2019-08-27T07:40:48Z","snapshot_observed_at":"2026-07-30T05:49:50.660286Z","submitted_at":"2019-08-27T07:40:48Z","title":"FinBERT: Financial Sentiment Analysis with Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10063","snapshot_observed_at":"2026-08-11T05:12:11.307300Z","title":"Finbert: Financial sentiment analysis with pre-trained language models,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.307300Z"},"links":{"cited_paper":"/paper/1908.10063","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:fd45311fda701c9a4e33895c3aa76a04844a8c240a9fb0c66d887e9feb2ee262","observation_id":"c2d1e11b-2e49-4d92-aaea-48a2e8cc9a2c","resolution":{"observed_at":"2026-08-11T05:12:11.307300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13064","last_updated":"2023-09-15T02:59:31Z","snapshot_observed_at":"2026-08-07T21:07:49.780911Z","submitted_at":"2023-09-15T02:59:31Z","title":"InvestLM: A Large Language Model for Investment using Financial Domain Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.13064","snapshot_observed_at":"2026-08-11T05:12:11.312744Z","title":"Investlm: A large language model for investment using financial domain instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.312744Z"},"links":{"cited_paper":"/paper/2309.13064","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:3e50d7a97656439d99772907d6c2fcc7f3b69c41951b8b483525ae610acdf687","observation_id":"74ed6ed3-779a-48c3-b10e-8aa9b78bdb07","resolution":{"observed_at":"2026-08-11T05:12:11.312744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05443","last_updated":"2023-06-08T14:20:29Z","snapshot_observed_at":"2026-08-08T01:30:38.765152Z","submitted_at":"2023-06-08T14:20:29Z","title":"PIXIU: A Large Language Model, Instruction Data and Evaluation Benchmark for Finance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05443","snapshot_observed_at":"2026-08-11T05:12:11.318080Z","title":"Pixiu: A large language model, instruction data and evaluation benchmark for finance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.318080Z"},"links":{"cited_paper":"/paper/2306.05443","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e301edd12484e7a9d5e7a1818ed537af89a3b577a37153bcc2866a51119f0a81","observation_id":"4876f5b0-6db1-408a-97f5-9d0e323ac992","resolution":{"observed_at":"2026-08-11T05:12:11.318080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00083","last_updated":"2022-10-31T18:35:18Z","snapshot_observed_at":"2026-08-04T22:32:01.595836Z","submitted_at":"2022-10-31T18:35:18Z","title":"WHEN FLUE MEETS FLANG: Benchmarks and Large Pre-trained Language Model for Financial Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00083","snapshot_observed_at":"2026-08-11T05:12:11.323204Z","title":"When flue meets flang: Benchmarks and large pre-trained language model for financial domain,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.323204Z"},"links":{"cited_paper":"/paper/2211.00083","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:7ede16c60fc4a101f7e459edac50dedab6a8bf45d81edaeff912dc7b47fbddbb","observation_id":"5b57ecaf-470a-4039-9aeb-838321ac4fee","resolution":{"observed_at":"2026-08-11T05:12:11.323204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09432","last_updated":"2023-02-26T10:50:09Z","snapshot_observed_at":"2026-08-10T23:50:49.627630Z","submitted_at":"2023-02-18T22:20:37Z","title":"BBT-Fin: Comprehensive Construction of Chinese Financial Domain Pre-trained Language Model, Corpus and Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09432","snapshot_observed_at":"2026-08-11T05:12:11.328711Z","title":"Bbt-fin: Comprehensive construction of chinese financial domain pre-trained language model, corpus and benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.328711Z"},"links":{"cited_paper":"/paper/2302.09432","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:d30d4069c29f09e01a890813b461c9c79fa1123f7f38346994f2cfae2b86ffed","observation_id":"28e0f571-3b1e-4674-90e2-49590ac9f9dd","resolution":{"observed_at":"2026-08-11T05:12:11.328711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.334160Z","title":"Xuanyuan 2.0: A large chinese financial chat model with hundreds of billions parameters,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.334160Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:4475cb3780dce2bf5068686ea0de333c5aa3f9fd3d8812a8fb0ebffda597aa4b","observation_id":"dd21a0a1-6091-4ce6-8c3e-7ea2a9c51820","resolution":{"observed_at":"2026-08-11T05:12:11.334160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15205","last_updated":"2023-10-25T05:56:13Z","snapshot_observed_at":"2026-08-10T23:49:18.747814Z","submitted_at":"2023-10-23T11:33:41Z","title":"DISC-FinLLM: A Chinese Financial Large Language Model based on Multiple Experts Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15205","snapshot_observed_at":"2026-08-11T05:12:11.339354Z","title":"Disc-finllm: A chinese financial large language model based on multiple experts fine-tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.339354Z"},"links":{"cited_paper":"/paper/2310.15205","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:989acd2216f58922187a6f2d48d28cca8b3f4831acd7639290c3fd4632237da7","observation_id":"73c7797b-61fd-42bb-bf5c-ae74556b7c0d","resolution":{"observed_at":"2026-08-11T05:12:11.339354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06567","last_updated":"2024-11-07T00:54:30Z","snapshot_observed_at":"2026-08-09T21:20:01.465570Z","submitted_at":"2024-07-09T05:52:26Z","title":"FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06567","snapshot_observed_at":"2026-08-11T05:12:11.344967Z","title":"Fincon: A synthesized llm multi- agent system with conceptual verbal reinforcement for enhanced financial decision making,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.344967Z"},"links":{"cited_paper":"/paper/2407.06567","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:95a604ac58c317684e99edb30c1785c51b7b73a803956c0fb64274b2191a89f9","observation_id":"99361d18-8912-4568-a126-6238b7c81369","resolution":{"observed_at":"2026-08-11T05:12:11.344967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09607","last_updated":"2022-03-02T14:28:11Z","snapshot_observed_at":"2026-08-04T16:53:20.285596Z","submitted_at":"2020-11-19T01:35:05Z","title":"FinRL: A Deep Reinforcement Learning Library for Automated Stock Trading in Quantitative Finance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09607","snapshot_observed_at":"2026-08-11T05:12:11.350120Z","title":"Finrl: A deep reinforcement learning library for automated stock trading in quantitative finance,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.350120Z"},"links":{"cited_paper":"/paper/2011.09607","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:24f247e2a23f39516614aa4519eaf213bc47d062043954d667610e859055264f","observation_id":"9160e4c4-8921-4d8b-9082-28150a5ed046","resolution":{"observed_at":"2026-08-11T05:12:11.350120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-07-06T05:27:30.168672Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-11T05:12:11.355298Z","title":"Deep reinforcement learning: An overview,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.355298Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:80bace30c234123334729c13f61503018b7d11f8f70050fd98b19bf164f6d463","observation_id":"4f7c21d9-e9c3-46cf-a7e0-2f54f8ba3e89","resolution":{"observed_at":"2026-08-11T05:12:11.355298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.360290Z","title":"Recent advances in reinforcement learning in finance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.360290Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:487a775b6c8a9cd835d2303bcca6d52d82698261876dcd9db68afd84ffdb3174","observation_id":"ab7601cc-a3ad-42ff-8de2-a2cea548ae13","resolution":{"observed_at":"2026-08-11T05:12:11.360290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01391","last_updated":"2024-02-05T13:28:23Z","snapshot_observed_at":"2026-07-06T17:24:16.787573Z","submitted_at":"2024-02-02T13:14:31Z","title":"StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01391","snapshot_observed_at":"2026-08-11T05:12:11.364925Z","title":"Stepcoder: Improve code generation with reinforcement learning from compiler feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.364925Z"},"links":{"cited_paper":"/paper/2402.01391","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:7eeebc830172b312336d842bc28d3df714a3f92da6107318c36bbce59d43e7cf","observation_id":"7f1aaa35-7be3-47ad-a19d-409ca0333f57","resolution":{"observed_at":"2026-08-11T05:12:11.364925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06213","last_updated":"2024-10-08T17:18:17Z","snapshot_observed_at":"2026-08-10T22:27:15.259103Z","submitted_at":"2024-10-08T17:18:17Z","title":"RL, but don't do anything I wouldn't do","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06213","snapshot_observed_at":"2026-08-11T05:12:11.369665Z","title":"Rl, but don’t do anything i wouldn’t do,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.369665Z"},"links":{"cited_paper":"/paper/2410.06213","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:a0ee80136bbb305df9f861c20a58dbbb7b3221dc157f0bc8ccd25b561e758276","observation_id":"67e48e49-8870-4dcd-9ed1-30cd3841458a","resolution":{"observed_at":"2026-08-11T05:12:11.369665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.10107","last_updated":"2019-11-22T16:10:45Z","snapshot_observed_at":"2026-08-10T22:15:44.503631Z","submitted_at":"2019-11-22T16:10:45Z","title":"Deep Reinforcement Learning for Trading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.10107","snapshot_observed_at":"2026-08-11T05:12:11.374481Z","title":"Deep reinforcement learning for trading,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.374481Z"},"links":{"cited_paper":"/paper/1911.10107","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:0aba5174e3488057f2c35f6db90f3b7a9dc7703884bb76230c5810fd5d8dd324","observation_id":"a344636c-6c08-46d5-8841-218b51083b19","resolution":{"observed_at":"2026-08-11T05:12:11.374481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.379078Z","title":"Deep reinforcement learning for financial trading using price trailing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.379078Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:5e5297919f5fa5cd968822aa73a9f7b51e47565e2feb2dab004fc728b1386988","observation_id":"41f944a1-eb16-45eb-9490-7ad2b2560a67","resolution":{"observed_at":"2026-08-11T05:12:11.379078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.384486Z","title":"Deep reinforce- ment learning for financial trading using multi-modal features,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.384486Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:bbfa596598e0cb6acd33c9c855a0b1156631bff064345b68d045c896ce9be9b7","observation_id":"78157301-4684-43f7-8f76-e1cc6c68bbe7","resolution":{"observed_at":"2026-08-11T05:12:11.384486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.10059","last_updated":"2017-07-16T10:29:38Z","snapshot_observed_at":"2026-08-05T13:15:49.754412Z","submitted_at":"2017-06-30T08:31:28Z","title":"A Deep Reinforcement Learning Framework for the Financial Portfolio Management Problem","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.10059","snapshot_observed_at":"2026-08-11T05:12:11.389415Z","title":"A deep reinforcement learning framework for the financial portfolio management problem,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.389415Z"},"links":{"cited_paper":"/paper/1706.10059","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:076fb0014f487c05f85ccb3470d947d353feae4b6edf7659d2c168efa93ca080","observation_id":"f4f4ecbe-a72b-413c-a40a-2ab7b7b7ab09","resolution":{"observed_at":"2026-08-11T05:12:11.389415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.394074Z","title":"Cryptocurrency portfolio management with deep reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.394074Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:61702451cdb5d42a8bf8673fb2a7c0b141bbd86c19326c3be1b5f0a76e6b5cba","observation_id":"6897150a-9f84-48db-a2d1-d44c8fa2f66c","resolution":{"observed_at":"2026-08-11T05:12:11.394074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08647","last_updated":"2019-11-20T00:48:16Z","snapshot_observed_at":"2026-07-06T08:38:19.060729Z","submitted_at":"2019-11-20T00:48:16Z","title":"Deep Reinforcement Learning in Cryptocurrency Market Making","version":1},"cited_work":{"arxiv_id":"1911.08647","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.08647","snapshot_observed_at":"2026-08-11T05:12:13.403129Z","title":"Deep Reinforcement Learning in Cryptocurrency Market Making","venue":"q-fin.TR","work_id":"976c9243-fad1-4e27-aa48-65ab4867aa54","year":2019},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.399126Z"},"links":{"cited_paper":"/paper/1911.08647","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:1f4c093ffa5d2ebb519009c11505ab295138895131c370c4e9abec43c20ce9f4","observation_id":"242e688c-03ff-43a7-9d3e-6fe7333dbb87","resolution":{"observed_at":"2026-08-11T05:12:13.408310Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.404398Z","title":"Large language models in finance: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.404398Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:8c4e9ee475fd12b8b8bf74d2a4a7d707e35ee57166751b9f8139f429edc4b9ad","observation_id":"9e3fee66-8cc5-424b-b1f4-96f10e2815c9","resolution":{"observed_at":"2026-08-11T05:12:11.404398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07989","last_updated":"2024-06-26T07:11:00Z","snapshot_observed_at":"2026-08-10T14:38:13.953734Z","submitted_at":"2023-11-14T08:34:26Z","title":"Unifying the Perspectives of NLP and Software Engineering: A Survey on Language Models for Code","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07989","snapshot_observed_at":"2026-08-11T05:12:11.409293Z","title":"Unifying the perspectives of nlp and software engineering: A survey on language models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.409293Z"},"links":{"cited_paper":"/paper/2311.07989","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:3fd0547bc61203281b30308f48c6721b10c05070c73a50c8fe4123971aa1213f","observation_id":"5fee7329-7713-45bd-b51f-068933b08a0c","resolution":{"observed_at":"2026-08-11T05:12:11.409293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19487","last_updated":"2024-07-28T12:47:20Z","snapshot_observed_at":"2026-07-06T18:52:56.476112Z","submitted_at":"2024-07-28T12:47:20Z","title":"RLCoder: Reinforcement Learning for Repository-Level Code Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19487","snapshot_observed_at":"2026-08-11T05:12:11.414466Z","title":"Rlcoder: Reinforcement learning for repository-level code completion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.414466Z"},"links":{"cited_paper":"/paper/2407.19487","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:7b0dd5dafeb4d96ceb7f1ad3b826e5e23e94c134bd42e68bcf01c5eb89b4bc56","observation_id":"5d8ec428-25f9-46fc-bbc6-18e0b61166ce","resolution":{"observed_at":"2026-08-11T05:12:11.414466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.419457Z","title":"Actuarial applications of natural language processing using transformers: Case studies for using text features in an actuarial context,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.419457Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:b8685e1a3dee82508ddb6b93c5ac459ce3d8700d72eb2cf2e68dc1851df82f0a","observation_id":"03cbfa2d-a081-4a17-a5d6-da6c1afa79fd","resolution":{"observed_at":"2026-08-11T05:12:11.419457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.424485Z","title":"Gpt (generative pre-trained transformer)–a com- prehensive review on enabling technologies, potential applications, emerging challenges, and future directions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.424485Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:ed06ba3f456182c50326b5aa7c164386dc9f5529b93844c43fd23d62e9bbc0d8","observation_id":"1f7aac39-a303-43ec-b118-c96ed765203f","resolution":{"observed_at":"2026-08-11T05:12:11.424485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.429281Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.429281Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e84c2228dbae7a05a7dcd929cb5a06a9b98dadcdbe751889871b36b2c15c8533","observation_id":"35d75b1f-ccc4-4f85-8090-b760f2c066b2","resolution":{"observed_at":"2026-08-11T05:12:11.429281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02182","last_updated":"2024-06-01T00:23:16Z","snapshot_observed_at":"2026-08-06T00:02:43.733648Z","submitted_at":"2021-10-05T17:21:52Z","title":"A Systematic Survey of Blockchained Federated Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02182","snapshot_observed_at":"2026-08-11T05:12:11.433969Z","title":"Blockchain-based federated learning: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.433969Z"},"links":{"cited_paper":"/paper/2110.02182","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:72d2739c751add94238cda97c9a869d8af226c0acf9be8a1a6deb02ea4447eb2","observation_id":"cd3802d7-f570-42aa-b948-b76fa54704dc","resolution":{"observed_at":"2026-08-11T05:12:11.433969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-11T05:12:11.439110Z","title":"Trustllm: Trustworthiness in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.439110Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:233abe8a4fa114b7367c0309b8cf419280403460aa98e37b1099238ed5310837","observation_id":"428cb471-ad28-4f2f-8c2d-52b5f531b224","resolution":{"observed_at":"2026-08-11T05:12:11.439110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.444473Z","title":"Ai in finance: challenges, techniques, and opportunities,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.444473Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:58e23f6c9f2fc033b5ec55f684c641c82f72c8d0fa28b5f6c9f99cdb0a4ef054","observation_id":"c489b0bc-38b8-4ad1-ac24-f16ea6d31c22","resolution":{"observed_at":"2026-08-11T05:12:11.444473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.450581Z","title":"Sustainable ai: Environmental implications, challenges and opportunities,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.450581Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:aa0a286434fa1b6df6b06c378542564fec9b4479d2c238a675918ff1f531b46e","observation_id":"fa32d575-948c-4720-a0e7-d5cc6d57e504","resolution":{"observed_at":"2026-08-11T05:12:11.450581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.456185Z","title":"Ai and 6g into the metaverse: Fundamentals, PREPRINT , JOURNAL NAME ——-, VOL. .., NO. ..., MONTH 2024 18 challenges and future research trends,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.456185Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:ce21080763a8c75bf170a34828cb50177cf39f3f1bd4ec3772c1df62fcaf62e0","observation_id":"e34ce0b7-9fa1-43e6-8099-6f0069c9997b","resolution":{"observed_at":"2026-08-11T05:12:11.456185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.462048Z","title":"Reinforcement learning interpretation methods: A survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.462048Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:fc040e29ebff5ea28de5e02c080cace180d5b876c83655a666343fb0d0d8bf4c","observation_id":"d0432879-e1ea-4fac-9363-e09b674f46ef","resolution":{"observed_at":"2026-08-11T05:12:11.462048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07771","last_updated":"2024-04-11T14:07:25Z","snapshot_observed_at":"2026-08-10T15:23:29.269929Z","submitted_at":"2024-04-11T14:07:25Z","title":"An Overview of Diffusion Models: Applications, Guided Generation, Statistical Rates and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07771","snapshot_observed_at":"2026-08-11T05:12:11.468322Z","title":"An overview of di ffusion models: Applications, guided generation, statistical rates and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.468322Z"},"links":{"cited_paper":"/paper/2404.07771","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:f028d3fc4368d359a3b123afbfc56767b46ba634ce2c33450b3e4558e6cc9bac","observation_id":"5597aa48-ef6a-4596-a520-2257a68029c9","resolution":{"observed_at":"2026-08-11T05:12:11.468322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.473502Z","title":"Applications and challenges of artificial intelligence in space missions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.473502Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:c4c1b2071e68ce5eb9c52108c9f3e3c584f08331d29ba42dcefa4b7bef0bfe64","observation_id":"d40b334f-3469-44fe-9539-1f61ec6eb8fa","resolution":{"observed_at":"2026-08-11T05:12:11.473502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.478686Z","title":"A review of nasa human-robot interaction in space,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.478686Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:70ebea4280655cd8c5d7b882a9d242d827961d42d6fc4c6461893e0f2a41e503","observation_id":"7d661db1-e92a-4c46-a1c8-c2ec824de59c","resolution":{"observed_at":"2026-08-11T05:12:11.478686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.483711Z","title":"A survey on reinforcement learning in aviation applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.483711Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:17338a606afaaea10c09f3b398dbcbc8790c8db2632082b919b293557b6596a4","observation_id":"fb5887c1-384b-4998-becd-e31867f6033d","resolution":{"observed_at":"2026-08-11T05:12:11.483711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.488990Z","title":"Reinforcement learning in healthcare: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.488990Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:fdd8dc4008edb3529824155be11e0a154aeffeb8734fec51206559f3add6ff35","observation_id":"8255d0ae-9e5a-4a99-9f83-b5b6740b0e9e","resolution":{"observed_at":"2026-08-11T05:12:11.488990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.494341Z","title":"Multiobjective reinforcement learning for cognitive satellite communications using deep neural network ensembles,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.494341Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:91894a9caf7a89999dd10fa364dfdd60e92d29997b84d348e233ca78eeef30b1","observation_id":"59d7f461-bf9b-4644-860e-64481ffc7ff1","resolution":{"observed_at":"2026-08-11T05:12:11.494341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.499441Z","title":"Reinforcement learning for iot security: A comprehensive survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.499441Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:67cef41fbf08618ba9f72979a1150ce3bfc96d4d65ddb5b20e08218467225e13","observation_id":"15a0e538-39b4-4efd-a550-a8198eeef16b","resolution":{"observed_at":"2026-08-11T05:12:11.499441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.504747Z","title":"Deep reinforcement learning for blockchain in industrial iot: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.504747Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:6691e45daabefb5796f6eca524ae48bc15f41a5f8db2f51e61a0926d15c98c01","observation_id":"2ced25ea-e328-48eb-bc48-f9e64b20710c","resolution":{"observed_at":"2026-08-11T05:12:11.504747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.509572Z","title":"Blockchain- based edge computing resource allocation in iot: A deep reinforce- ment learning approach,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.509572Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:4413e596699aa0885e728f0b5375fe0fda62bf3689eb8a310658d44a969f3b17","observation_id":"1e8c1385-07ac-43c5-9af9-1f5af33270f3","resolution":{"observed_at":"2026-08-11T05:12:11.509572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.514415Z","title":"Recent reinforcement learning and blockchain based security solutions for internet of things: Survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.514415Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:5f3b8f29243e727fcab927bb16aa0922891b1448131e317fa3ad4ea226c156db","observation_id":"7890a7c7-e10e-4918-acaf-1993275f2285","resolution":{"observed_at":"2026-08-11T05:12:11.514415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.519059Z","title":"Bitcoin and beyond: A technical survey on decentralized digital currencies,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.519059Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:228f44c9ebdcc8456c6900968d7a12a132225fbaf9f4e7f04f46af3f65a20276","observation_id":"3ae73524-4304-4468-81e6-f48a9983968b","resolution":{"observed_at":"2026-08-11T05:12:11.519059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.523831Z","title":"Cryptocurrency trading: a comprehensive survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.523831Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:60e10f7a1d215e4f3900be7ac22f48885f7a3f0a377f4459580f116024843189","observation_id":"b8e2dc9e-40b9-40a9-8ab9-c07a9e9b39b8","resolution":{"observed_at":"2026-08-11T05:12:11.523831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.529051Z","title":"Sok: Research perspectives and challenges for bitcoin and cryptocurrencies,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.529051Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:c4e9ca132c6fb9eab63bf533043b078d045b1ca7015e50d4d22e681eea1f41a5","observation_id":"884763bf-b6b0-4410-a644-52e8222cbcb1","resolution":{"observed_at":"2026-08-11T05:12:11.529051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.533733Z","title":"An empirical study on modeling and prediction of bitcoin prices with bayesian neural networks based on blockchain information,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.533733Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:1ed30e02099560b39a81bb1dccabf54855a1f8bf7611d377c7471a215c1a66bf","observation_id":"4bcc57ce-c56d-43d5-b9ac-f85ca4b39a8a","resolution":{"observed_at":"2026-08-11T05:12:11.533733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.538486Z","title":"Blockchain challenges and opportunities: A survey,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.538486Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:34fd3a1b3c8992880d639bd5d96d9bf49feeb06dcced6db067e753a28086bf7b","observation_id":"c37313e6-6062-4e54-b008-84a4660e6722","resolution":{"observed_at":"2026-08-11T05:12:11.538486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.543151Z","title":"2017 global cryptocurrency bench- marking study,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.543151Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:363e2be664eae2fd4876b27d108abf7fe133ac39f519c09b21509819e567a077","observation_id":"96884646-15ce-4c72-8482-c59d3f511c3e","resolution":{"observed_at":"2026-08-11T05:12:11.543151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.548156Z","title":"Reinforcement learning: A survey,","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.548156Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:767987977cd6bead43e5a231c1069776058e276d23aa12f776f706f8a9b4cbf8","observation_id":"60658fd3-4c16-4068-88d5-a664415afb9c","resolution":{"observed_at":"2026-08-11T05:12:11.548156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.552931Z","title":"Deep reinforcement learning: A brief survey,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.552931Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:5112734abeebeae6d4dd0aaf8f13aeebe2b8e06ac9bbab5b6ece54696410e094","observation_id":"ca7a8883-ee30-4faa-a035-24838396abc5","resolution":{"observed_at":"2026-08-11T05:12:11.552931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.05866","last_updated":"2017-09-28T21:51:43Z","snapshot_observed_at":"2026-08-08T23:14:51.233615Z","submitted_at":"2017-08-19T15:55:31Z","title":"A Brief Survey of Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.05866","snapshot_observed_at":"2026-08-11T05:12:11.557513Z","title":"A brief survey of deep reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.557513Z"},"links":{"cited_paper":"/paper/1708.05866","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:451ce59bb7721673eeee74798c68737de0c09094232c5c834aa49105fa994641","observation_id":"a8210fe2-b755-40f2-8635-efa517d8f71c","resolution":{"observed_at":"2026-08-11T05:12:11.557513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.562585Z","title":"Reinforcement learning,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.562585Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:8f611b4fcd726835570899f87522607ce2cd42fa9f4b63e0db83e3eebe67072f","observation_id":"96062ab4-ef80-4332-bc17-2ca3671a3d41","resolution":{"observed_at":"2026-08-11T05:12:11.562585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.567174Z","title":"Reinforcement learning in robotics: A survey,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.567174Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e642399339294a606801d989bf50c2d1d635c94d1084f8f2f2932578069efaac","observation_id":"d85e2924-4060-4119-899d-30dfbe89f46c","resolution":{"observed_at":"2026-08-11T05:12:11.567174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.572092Z","title":"A comprehensive survey of multiagent reinforcement learning,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.572092Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:4729dc522fb97a450310f6efd1a7c399bb33f991a6105cd45b7b1611d589c8a7","observation_id":"fe2bff76-14bf-4b2a-a658-49514631f5d2","resolution":{"observed_at":"2026-08-11T05:12:11.572092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.577351Z","title":"Applications of deep reinforcement learning in communications and networking: A survey,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.577351Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e7baebebe6de42044bf3344bb22708c5e3dc506fe14553ff307dfeeae261cd91","observation_id":"1a83a9b5-ea20-4d6f-add4-6ea824faaf2a","resolution":{"observed_at":"2026-08-11T05:12:11.577351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.583062Z","title":"A comprehensive survey on safe reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.583062Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:950fe8f3398ffc9d3aeb9cf529e41b00f6d2777978d03a428f2fee86b7b8f7ec","observation_id":"f32702ac-4661-4a4a-bb04-8a1075931d9c","resolution":{"observed_at":"2026-08-11T05:12:11.583062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.588704Z","title":"Machine unlearning fails to remove data poisoning attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.588704Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:64b8be62ee1f06eac1a8f44b90f1f0414f83fc58fbf245c5b18d4085b57dbbca","observation_id":"7516e6ac-ffdd-4e65-bc60-f45bfbe0c99f","resolution":{"observed_at":"2026-08-11T05:12:11.588704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.593709Z","title":"Adversarial reinforcement learning based data poisoning attacks defense for task-oriented multi-user semantic communication,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.593709Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:615c74553a91aab6739ca4cdcded1d3985980ca38217ffdadf39b87aaccb93c8","observation_id":"5e6374e0-226d-41d2-a379-acb15897f130","resolution":{"observed_at":"2026-08-11T05:12:11.593709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.599174Z","title":"Data poisoning attacks in intelligent transportation systems: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.599174Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:c088d5a9003d882cda394600687da6043db1a770ad70ca365ad0c3030bc0de71","observation_id":"dd899f34-8aa2-4ae1-988e-e8fe0b800060","resolution":{"observed_at":"2026-08-11T05:12:11.599174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.604621Z","title":"A comprehensive analysis of poisoning attack and defence strategies in machine learning techniques,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.604621Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:0c623c46c01b4a8e9fa708531c556323ae945dc68c022375305128cf1dc3c9e0","observation_id":"a71a6919-016c-4d36-acde-8e1595a3c8cc","resolution":{"observed_at":"2026-08-11T05:12:11.604621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.609207Z","title":"A systematic review of adversarial machine learning attacks, defensive controls and technologies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.609207Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:47c0b14564d3982c04119efa0a506eebec2d45c1497087673545984a0b751874","observation_id":"99b669fe-8d02-42fb-89ff-2398731580fa","resolution":{"observed_at":"2026-08-11T05:12:11.609207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.614002Z","title":"Data and model poisoning backdoor attacks on wireless federated learning, and the defense mechanisms: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.614002Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:06130ba9cfa7c3af0890ba89f9d3464bf8bcfef73acccf868420ccca818f4c9d","observation_id":"4f53c6ea-7c97-4d92-9ac7-bc68f76e1d40","resolution":{"observed_at":"2026-08-11T05:12:11.614002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.618731Z","title":"Adversarial machine learning in the context of network security: Challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.618731Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:79618c173e4415e7d040332a5ba584a24167964fbdc121236627a37445d15f49","observation_id":"cf832de0-d0e4-477e-ad32-a708dcd6c3c3","resolution":{"observed_at":"2026-08-11T05:12:11.618731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.623396Z","title":"Reinforcement learning for data poisoning on graph neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.623396Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e65e8c1cfbefbc33c3c3a5fcdd3bda005ce44c522d08deebee3212839f447621","observation_id":"637646c6-359b-4610-b2b8-807b23a486e6","resolution":{"observed_at":"2026-08-11T05:12:11.623396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.628269Z","title":"Adversarial machine learning in industry: A systematic literature review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.628269Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:682dbeab68812de22dc8c5c667358700d99434014d9420581f530a9d2bbc2674","observation_id":"bce02131-6cd0-4efb-bc97-05e2d4045b30","resolution":{"observed_at":"2026-08-11T05:12:11.628269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.632955Z","title":"On model outsourcing adaptive attacks to deep learning backdoor defenses,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.632955Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:f5d5ae77cfdb0e02a27faefbfbccf4d6f716df0b60367a702ef832f86a3cc4ba","observation_id":"66533f09-b8ae-4126-8b71-f17275532e5c","resolution":{"observed_at":"2026-08-11T05:12:11.632955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.637626Z","title":"Vulnerability of machine learning approaches applied in iot-based smart grid: A review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.637626Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:5054f99557b0f1b856fb77f609195205318a7c4e6bd98f6212fa424ca764bbd8","observation_id":"2837ec6c-62ac-4cfe-b151-d777ee82bca8","resolution":{"observed_at":"2026-08-11T05:12:11.637626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.642312Z","title":"A survey of safety and trustworthiness of large language models through the lens of verification and validation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.642312Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:a5aa8b892d913db0cc4dbd14fa8e008a3a0f31b0fb24aa222f1d1862dc5f4035","observation_id":"0d34655e-2e45-405c-ab98-8a01007dcf74","resolution":{"observed_at":"2026-08-11T05:12:11.642312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15002","last_updated":"2024-08-12T02:46:06Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:03:38Z","title":"BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning","version":2},"cited_work":{"arxiv_id":"2401.15002","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15002","snapshot_observed_at":"2026-08-11T05:12:12.945876Z","title":"BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning","venue":"cs.CV","work_id":"0059ab1b-7ef6-4d9a-820a-28ae5f83607a","year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.646848Z"},"links":{"cited_paper":"/paper/2401.15002","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:ab02650bf84048f4d0ce39865a4e90be6c33c365bc280383240fb378801ad5c2","observation_id":"a1185d1f-089b-4f6c-a128-6415f4d2b4ac","resolution":{"observed_at":"2026-08-11T05:12:12.951458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05967","last_updated":"2025-04-20T19:42:23Z","snapshot_observed_at":"2026-08-11T15:35:14.645559Z","submitted_at":"2024-02-05T18:00:07Z","title":"The last Dance : Robust backdoor attack via diffusion models and bayesian approach","version":7},"cited_work":{"arxiv_id":"2402.05967","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.05967","snapshot_observed_at":"2026-08-11T05:12:12.922663Z","title":"The last Dance : Robust backdoor attack via diffusion models and bayesian approach","venue":"cs.LG","work_id":"bb4e343c-114d-4818-9d85-c629e2addb79","year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.651961Z"},"links":{"cited_paper":"/paper/2402.05967","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:96101a84ce71f6a747b5b6bb72f5ce83e35be769562cf90a78af153d97f4bfcf","observation_id":"62310b13-c591-49ac-b55f-675eb4e86482","resolution":{"observed_at":"2026-08-11T05:12:12.927945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.657027Z","title":"Reinforcement learning and bandits for speech and language processing: Tutorial, review and outlook,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.657027Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:554797f7ad2065c9d6a4cc2ddfddf4976503864783f53d465991e6e5e60df070","observation_id":"527aafc6-fcd6-476c-8655-6c1312225c08","resolution":{"observed_at":"2026-08-11T05:12:11.657027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.661797Z","title":"A comprehensive survey on applications of transformers for deep learning tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.661797Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:815b441e5eb6898932a80b3ffd67901bf4c7fd6223516b52d9fb979e4d58be6d","observation_id":"7b9cd5d4-4d95-462d-a165-1ffcfa20dd1e","resolution":{"observed_at":"2026-08-11T05:12:11.661797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00579","last_updated":"2021-12-12T23:22:37Z","snapshot_observed_at":"2026-08-11T17:27:12.910244Z","submitted_at":"2021-05-02T23:47:55Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00579","snapshot_observed_at":"2026-08-11T05:12:11.666549Z","title":"Backdoorl: Backdoor attack against competitive reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.666549Z"},"links":{"cited_paper":"/paper/2105.00579","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:ba489d5234890413a8df0362a3392d8383d706427d58777fb303ed2bfe5710e3","observation_id":"1bc72a2b-19d4-4a31-a159-eccf557b87ea","resolution":{"observed_at":"2026-08-11T05:12:11.666549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00762","last_updated":"2022-07-28T17:30:20Z","snapshot_observed_at":"2026-08-10T13:52:47.881757Z","submitted_at":"2022-01-03T17:09:32Z","title":"Execute Order 66: Targeted Data Poisoning for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.00762","snapshot_observed_at":"2026-08-11T05:12:11.671398Z","title":"Execute order 66: targeted data poisoning for reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.671398Z"},"links":{"cited_paper":"/paper/2201.00762","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:999a46c1ebe07efdd1df299cac22b55d97954470ee0bb06d28222a70bd6b5506","observation_id":"91b43151-0b94-42c6-9c6f-6dbf6d6715d0","resolution":{"observed_at":"2026-08-11T05:12:11.671398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.676099Z","title":"Reward poisoning attacks in deep reinforcement learning based on exploration strategies,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.676099Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:dafb9218e3d14085b6505ff1bd6d4ee2155c2473e6cb9cad00d7b3ccd23d8907","observation_id":"89046150-5bea-4f03-b126-60d17467a01b","resolution":{"observed_at":"2026-08-11T05:12:11.676099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.680711Z","title":"Data poisoning attacks on o ff-policy policy evaluation methods,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.680711Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:5e732e6b3412b593d443d1300c178ee6385360864b1b209bd0bad9e7f5881dbc","observation_id":"826a232a-1d26-4e8b-a88a-cb0c454fe8eb","resolution":{"observed_at":"2026-08-11T05:12:11.680711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.685747Z","title":"Rlhfpoison: Reward poisoning attack for reinforcement learning with human feedback in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.685747Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:1960e69bcd2b07ce8ca244b47ba3a4ceecdc6d81740176aa6488230fce673380","observation_id":"733946c0-9467-42e5-8754-524af8d7daed","resolution":{"observed_at":"2026-08-11T05:12:11.685747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.691069Z","title":"Data poisoning attacks against machine learning algorithms,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.691069Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:2651152d047e673cd3a7c706b03add16f5ff05c47f4218a5cf15aa944da843c0","observation_id":"13bb933e-1727-426d-826a-a13e4af8b019","resolution":{"observed_at":"2026-08-11T05:12:11.691069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.696546Z","title":"A review on deep reinforcement learning for fluid mechanics: An update,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.696546Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:7815b58b4fef8639e00b5995943e030509117c40574763d0b6011dfca54bce8e","observation_id":"8c486139-8118-4647-bf59-874bcdc49728","resolution":{"observed_at":"2026-08-11T05:12:11.696546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.701751Z","title":"Market making via reinforce- ment learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.701751Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e23e0fce54ce50986cee1607debd3ed3c230631c105a66f90cc89f52ab5bdb28","observation_id":"88d84bf2-dc2f-48ec-bf07-d84928a460d6","resolution":{"observed_at":"2026-08-11T05:12:11.701751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05892","last_updated":"2019-11-14T01:55:31Z","snapshot_observed_at":"2026-07-06T08:36:54.434076Z","submitted_at":"2019-11-14T01:55:31Z","title":"Reinforcement Learning for Market Making in a Multi-agent Dealer Market","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05892","snapshot_observed_at":"2026-08-11T05:12:11.706571Z","title":"Reinforcement learning for market making in a multi-agent dealer market,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.706571Z"},"links":{"cited_paper":"/paper/1911.05892","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:bb01d171bbad341e3e804efe78d444b4a6f04de2fc393bf1ccf8d910151eed50","observation_id":"ebd64b7b-ae82-4f51-a348-e24bcfb0f3d8","resolution":{"observed_at":"2026-08-11T05:12:11.706571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.07107","last_updated":"2023-08-19T08:10:38Z","snapshot_observed_at":"2026-08-10T23:12:30.964102Z","submitted_at":"2021-01-18T15:09:28Z","title":"Deep Reinforcement Learning for Active High Frequency Trading","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.07107","snapshot_observed_at":"2026-08-11T05:12:11.711553Z","title":"Deep reinforcement learning for active high frequency trading,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.711553Z"},"links":{"cited_paper":"/paper/2101.07107","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:6da03ee35578870f4d9383084ac86d84b2b85083f66e9410b486b19f3085a759","observation_id":"384e56e8-3c14-4c91-ab96-edb67c8c648c","resolution":{"observed_at":"2026-08-11T05:12:11.711553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05670","last_updated":"2026-06-05T17:27:51Z","snapshot_observed_at":"2026-07-06T18:27:41.409205Z","submitted_at":"2024-06-09T06:59:46Z","title":"Certified Robustness to Data Poisoning in Gradient-Based Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05670","snapshot_observed_at":"2026-08-11T05:12:11.717193Z","title":"Certified robustness to data poisoning in gradient-based training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.717193Z"},"links":{"cited_paper":"/paper/2406.05670","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:654e9c5f2f4f1b6d6ca55b30365c8aa46130dc15bc6e76f66b125b82dcae3809","observation_id":"5980bc25-ffda-41a7-82a4-34fa494f24cd","resolution":{"observed_at":"2026-08-11T05:12:11.717193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12798","last_updated":"2025-05-19T04:34:50Z","snapshot_observed_at":"2026-08-11T03:10:26.921370Z","submitted_at":"2024-08-23T02:21:21Z","title":"BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12798","snapshot_observed_at":"2026-08-11T05:12:11.722109Z","title":"Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.722109Z"},"links":{"cited_paper":"/paper/2408.12798","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:dc5f9d435833ca2b383bd719435737d47c20da371aa32c10dc156ab204ca41c6","observation_id":"43689f0c-7e8b-4162-893f-febdaf4ea9c5","resolution":{"observed_at":"2026-08-11T05:12:11.722109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07667","last_updated":"2024-12-15T05:55:43Z","snapshot_observed_at":"2026-07-06T18:13:29.693360Z","submitted_at":"2024-05-13T11:53:42Z","title":"Simulate and Eliminate: Revoke Backdoors for Generative Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07667","snapshot_observed_at":"2026-08-11T05:12:11.726825Z","title":"Backdoor removal for generative large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.726825Z"},"links":{"cited_paper":"/paper/2405.07667","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:8c9654c0aa0f88ef1df6619215151e6392bab60a9c12cad1d021b29b5c08ee3c","observation_id":"c517f5ed-9f60-4c20-9edb-110b04aee8ee","resolution":{"observed_at":"2026-08-11T05:12:11.726825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.731848Z","title":"Trading devil: Robust backdoor attack via stochastic investment models and bayesian approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.731848Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:9f7865835010101d2c5d6cb3f27023bfbb092eb4a3c90f214ff3fc6494cbc222","observation_id":"37db9dab-e712-42f8-b14d-d4945d673b88","resolution":{"observed_at":"2026-08-11T05:12:11.731848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03743","last_updated":"2019-10-09T01:42:27Z","snapshot_observed_at":"2026-08-03T21:50:03.949709Z","submitted_at":"2019-10-09T01:42:27Z","title":"Model-based Reinforcement Learning for Predictions and Control for Limit Order Books","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03743","snapshot_observed_at":"2026-08-11T05:12:11.736317Z","title":"Model-based reinforcement learning for predictions and control for limit order books,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.736317Z"},"links":{"cited_paper":"/paper/1910.03743","citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:b538ad3b7323f454df80be96ca95b932811e6154e1120b961e9ac0b8be7f14c9","observation_id":"6a863c6e-cc52-490f-a898-f2f7784cee20","resolution":{"observed_at":"2026-08-11T05:12:11.736317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.741104Z","title":"High-frequency trading: Definition, implications, and controversies,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.741104Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:e1a95bd7fbc2ade540b30e1ff64bcce9bee0ab3b589ced5452afeb3863187b32","observation_id":"4a26b4d9-4857-4b60-a4ae-4a7090515d8e","resolution":{"observed_at":"2026-08-11T05:12:11.741104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.745814Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.745814Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:81549a74d6409ea542e83f16e0903c0d92728bce14d09817326eb2f4213c02ca","observation_id":"994b0e57-d52e-48a9-a1e9-fce696b9fbef","resolution":{"observed_at":"2026-08-11T05:12:11.745814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.750308Z","title":"High frequency trading,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.750308Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:6bea3e6221114e63a58504945c8a7a8672e27de7acfd7d63c201e7c409876fdb","observation_id":"a5ec0b49-8c1c-4ddc-ad60-2432ed14bbd4","resolution":{"observed_at":"2026-08-11T05:12:11.750308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.754885Z","title":"High-frequency trading and price discovery,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.754885Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:00c0e764c0e8c68f4c9e47ed696622f7fc970950875eda3ff4281819668b734a","observation_id":"1bd18e90-776e-4047-b1d9-730bc65e7109","resolution":{"observed_at":"2026-08-11T05:12:11.754885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.759357Z","title":"High frequency market microstructure,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.759357Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:fe45ff985883d8cfad780a86d3ae3221422423ccf3c56c4d39b854acfc4b1b15","observation_id":"6908a0b4-a744-4725-a2c1-7a48e882e0e0","resolution":{"observed_at":"2026-08-11T05:12:11.759357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.764618Z","title":"The diversity of high-frequency traders,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.764618Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:9324a0a163fadfc90186c7378058658d080e6f8d5a09b0e4f95ac52c66fc8444","observation_id":"a8ec6b35-c38f-41ce-94fb-b4f495a1bde3","resolution":{"observed_at":"2026-08-11T05:12:11.764618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:12:11.769301Z","title":"Equilibrium in a dynamic limit order market,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T05:12:11.769301Z"},"links":{"citing_paper":"/paper/2412.17908"},"observation_digest":"sha256:45eb0bf2502c5e2954f1d63c29ae89a6d9746b2c55fb180da5eee603f118d461","observation_id":"d31bdcc0-b609-4cab-bb5b-58c19f8bc6c2","resolution":{"observed_at":"2026-08-11T05:12:11.769301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.17908","last_updated":"2025-04-21T18:58:16Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T11:07:10.008820Z","submitted_at":"2024-12-23T19:04:46Z","title":"Trading Devil RL: Backdoor attack via Stock market, Bayesian Optimization and Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":207},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 207 outbound references and 0 inbound Pith citation observations for arXiv:2412.17908."}