{"as_of":"2026-08-18T12:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:845560b7f923501739186c141b380a49b18cd3a62de6cca4b68603fd8dc108cb","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:11:19.919670Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12815/citation-record","integrity":"/paper/2506.12815/integrity","json":"/paper/2506.12815/citation-record.json","paper":"/paper/2506.12815"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.646303Z","title":"Rewriting a deep generative model","venue":null,"work_id":"41149428-1cf4-47a5-a13b-7ee0be565bf9","year":2020},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.760308Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:868cab523cd9eea3b647edc62403eac5db839208b43619312ee5aaa9da07448b","observation_id":"b55d8313-addd-484b-ada9-0a29e1a7b9ca","resolution":{"observed_at":"2026-08-15T20:11:20.650575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.440933Z","title":"D ALGORITHM Algorithm 1 summarizes the implementation details of the TrojanTO method","venue":null,"work_id":"f8c96242-03de-47fa-9df3-2252616730b2","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.901662Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:9934f31c5adf548f8e30df873dc1ba455a194bdacd7003bba4630fa55f25db8a","observation_id":"ab0f8a5c-b0db-4a0c-b24b-962c93b35466","resolution":{"observed_at":"2026-08-15T20:11:20.445167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4740.9380","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.003446Z","title":"We performed an ablation study against a naive single-objective approach, which optimizes only Equa- tion 6 across all data, including poisoned ones","venue":null,"work_id":"9a3b03d4-43bf-4eea-a8e3-0bec44b0a75a","year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.916173Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:3c539ba50a026db064221180231589c75d188d2c4b54625397b13f6f92c7ddbc","observation_id":"d9664ad8-06b2-4d69-b322-d952e9970817","resolution":{"observed_at":"2026-08-15T20:11:20.012698Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12094","last_updated":"2024-10-27T04:46:58Z","snapshot_observed_at":"2026-08-17T20:42:37.335823Z","submitted_at":"2024-05-20T15:05:47Z","title":"Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12094","snapshot_observed_at":"2026-08-15T20:11:19.774047Z","title":"Is mamba compatible with trajectory optimization in offline reinforcement learning?arXiv preprint arXiv:2405.12094,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.774047Z"},"links":{"cited_paper":"/paper/2405.12094","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:a32f81b69ba1279bd4701326881812b1a12be9bfea07f22ade6954582fc07488","observation_id":"11a8608c-7c5f-4e4a-b464-734b49f8588b","resolution":{"observed_at":"2026-08-15T20:11:19.774047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06081","last_updated":"2018-03-22T12:46:44Z","snapshot_observed_at":"2026-08-15T08:36:59.613655Z","submitted_at":"2017-10-17T04:03:04Z","title":"Boosting Adversarial Attacks with Momentum","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.06081","snapshot_observed_at":"2026-08-15T20:11:19.778183Z","title":"Discovering adversarial examples with momentum.arXiv preprint arXiv:1710.06081, 5,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.778183Z"},"links":{"cited_paper":"/paper/1710.06081","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:593aad7b159e4e3a95e0887befe66cce2caa74b0664fccef91d756efca2a06ef","observation_id":"8bef4ada-d5c8-48cc-8d84-3fa021b94b51","resolution":{"observed_at":"2026-08-15T20:11:19.778183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T20:11:19.782460Z","title":"D4rl: Datasets for deep data-driven reinforcement learning.arXiv preprint arXiv:2004.07219,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.782460Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:ad2ebb955d25f371013c1609f162d5ccf2f6a568b7da8aeb2635492198fe204c","observation_id":"a1943382-2548-4978-b359-52e475eabd16","resolution":{"observed_at":"2026-08-15T20:11:19.782460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12530","last_updated":"2024-09-02T01:39:58Z","snapshot_observed_at":"2026-08-18T02:42:55.684146Z","submitted_at":"2024-04-18T22:23:24Z","title":"TrajDeleter: Enabling Trajectory Forgetting in Offline Reinforcement Learning Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12530","snapshot_observed_at":"2026-08-15T20:11:19.792073Z","title":"Trajdeleter: Enabling trajectory forgetting in offline reinforcement learning agents.arXiv preprint arXiv:2404.12530, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.792073Z"},"links":{"cited_paper":"/paper/2404.12530","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:194168f3b43b8b14599e829b547e19e5761e711f28905dc093ba28713caae806","observation_id":"eb76e915-005f-4fd5-863c-d428babfaf88","resolution":{"observed_at":"2026-08-15T20:11:19.792073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03747","last_updated":"2023-03-07T09:10:34Z","snapshot_observed_at":"2026-08-17T21:55:32.465762Z","submitted_at":"2023-03-07T09:10:34Z","title":"Graph Decision Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03747","snapshot_observed_at":"2026-08-15T20:11:19.796789Z","title":"Graph decision transformer.arXiv preprint arXiv:2303.03747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.796789Z"},"links":{"cited_paper":"/paper/2303.03747","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:b845a04f3faef25fc9ba33e404b53de38dafc4268d7fea9f6e218537f2464e9d","observation_id":"541d5179-1cf7-4520-93c9-75768a9a49d8","resolution":{"observed_at":"2026-08-15T20:11:19.796789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03022","last_updated":"2024-05-30T07:19:34Z","snapshot_observed_at":"2026-08-17T11:24:30.940124Z","submitted_at":"2023-10-04T17:59:32Z","title":"Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03022","snapshot_observed_at":"2026-08-15T20:11:19.801330Z","title":"Decision convformer: Local filtering in metaformer is sufficient for decision making.arXiv preprint arXiv:2310.03022,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.801330Z"},"links":{"cited_paper":"/paper/2310.03022","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:f3f666c91167fa56feb21b88ea5181a1f33347d27303f41a5110c2631a5ce06e","observation_id":"759d4ea8-372d-454a-856d-e9895091019c","resolution":{"observed_at":"2026-08-15T20:11:19.801330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06638","last_updated":"2019-03-01T04:17:32Z","snapshot_observed_at":"2026-08-14T17:09:12.323074Z","submitted_at":"2019-03-01T04:17:32Z","title":"TrojDRL: Trojan Attacks on Deep Reinforcement Learning Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.06638","snapshot_observed_at":"2026-08-15T20:11:19.805088Z","title":"Trojdrl: Trojan attacks on deep reinforcement learning agents.arXiv preprint arXiv:1903.06638,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.805088Z"},"links":{"cited_paper":"/paper/1903.06638","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:7d9a618bcc634fda9e1a519b57c188131eeba6b2a3b8d6e3e39bd49a908646af","observation_id":"b270b0e4-339a-4ee7-9d41-2cb3f7226394","resolution":{"observed_at":"2026-08-15T20:11:19.805088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13888","last_updated":"2021-08-31T14:47:37Z","snapshot_observed_at":"2026-08-17T00:17:56.372140Z","submitted_at":"2021-08-31T14:47:37Z","title":"Backdoor Attacks on Pre-trained Models by Layerwise Weight Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13888","snapshot_observed_at":"2026-08-15T20:11:19.808744Z","title":"Backdoor attacks on pre-trained models by layerwise weight poisoning.arXiv preprint arXiv:2108.13888,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.808744Z"},"links":{"cited_paper":"/paper/2108.13888","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:076f7eafdf3b52320acfb7e4ccb8094049626f6bc86a18c39b615f4c23e8a86b","observation_id":"b3e4effb-cd1d-4a82-a572-6f20a9f42c94","resolution":{"observed_at":"2026-08-15T20:11:19.808744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.627451Z","title":"Efficient adversarial attacks on online multi-agent reinforcement learning","venue":null,"work_id":"48ae4600-4c13-42e2-baf7-200f542f435d","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.812828Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:0e7545393806374d1b6c5768fc810d1e63f78769b42e8e02ebe1591d2dccd20f","observation_id":"a7cd42ad-f625-48be-84d0-0f310726f03d","resolution":{"observed_at":"2026-08-15T20:11:20.631309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.612447Z","title":"A tale of evil twins: Adversarial inputs versus poisoned models","venue":null,"work_id":"2b9028ea-c9d9-4e53-a338-d93b13ff48c8","year":2020},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.825277Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:5dcf38f7dc46a9fa4aa47c2a934342c1b9949ca781ed7b67d9c4e4960cf941ce","observation_id":"c769f567-851a-43ac-b4ad-a58f502471b6","resolution":{"observed_at":"2026-08-15T20:11:20.618200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13995","last_updated":"2025-06-02T18:41:35Z","snapshot_observed_at":"2026-08-17T06:04:05.196974Z","submitted_at":"2024-10-17T19:50:28Z","title":"Adversarial Inception Backdoor Attacks against Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13995","snapshot_observed_at":"2026-08-15T20:11:19.829332Z","title":"Adversarial inception for bounded backdoor poisoning in deep reinforcement learning.arXiv preprint arXiv:2410.13995, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.829332Z"},"links":{"cited_paper":"/paper/2410.13995","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:2d0e248ede3ea4c59be9aa95911b1638cf657fa09b0ff8138f07cd7025f9bc49","observation_id":"4b7105be-58bd-4324-9472-74c453d68506","resolution":{"observed_at":"2026-08-15T20:11:19.829332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00579","last_updated":"2021-12-12T23:22:37Z","snapshot_observed_at":"2026-08-16T18:27:32.179947Z","submitted_at":"2021-05-02T23:47:55Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00579","snapshot_observed_at":"2026-08-15T20:11:19.844556Z","title":"Backdoorl: Backdoor attack against competitive reinforcement learning.arXiv preprint arXiv:2105.00579,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.844556Z"},"links":{"cited_paper":"/paper/2105.00579","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:64174f213b202bc6068a68337b6a6e5b5709fb3a8216f5d36c2c22a56c871dcb","observation_id":"ae04b0bf-f9f6-4b68-b01a-88a5153a8401","resolution":{"observed_at":"2026-08-15T20:11:19.844556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15017","last_updated":"2024-12-04T09:54:59Z","snapshot_observed_at":"2026-08-16T13:32:15.229936Z","submitted_at":"2024-07-22T06:15:59Z","title":"Knowledge Mechanisms in Large Language Models: A Survey and Perspective","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15017","snapshot_observed_at":"2026-08-15T20:11:19.848167Z","title":"Knowledge mechanisms in large language models: A survey and perspective.arXiv preprint arXiv:2407.15017,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.848167Z"},"links":{"cited_paper":"/paper/2407.15017","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:5c437f65c79c9324574fece00152c56f6fd92a17a7d01e1d47bb2fd207d131f1","observation_id":"a21262e4-e744-44d2-8f36-63b7ffb0ffbc","resolution":{"observed_at":"2026-08-15T20:11:19.848167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09457","last_updated":"2024-01-04T13:43:16Z","snapshot_observed_at":"2026-08-16T15:54:22.377716Z","submitted_at":"2023-02-19T02:12:21Z","title":"Attacks in Adversarial Machine Learning: A Systematic Survey from the Life-cycle Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09457","snapshot_observed_at":"2026-08-15T20:11:19.851927Z","title":"Attacks in adver- sarial machine learning: A systematic survey from the life-cycle perspective.arXiv preprint arXiv:2302.09457, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.851927Z"},"links":{"cited_paper":"/paper/2302.09457","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:f9d63c440da895a3e26e5ea7cd68b7a9b2fa7e19fdbe0fc0aa0e858daeddb2c1","observation_id":"98395a33-7b6b-4b8f-812a-a1a8b3fd2034","resolution":{"observed_at":"2026-08-15T20:11:19.851927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07775","last_updated":"2024-09-12T06:17:37Z","snapshot_observed_at":"2026-08-16T13:19:15.156810Z","submitted_at":"2024-09-12T06:17:37Z","title":"A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07775","snapshot_observed_at":"2026-08-15T20:11:19.855796Z","title":"A spatiotemporal stealthy backdoor attack against cooperative multi-agent deep reinforcement learning.arXiv preprint arXiv:2409.07775,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.855796Z"},"links":{"cited_paper":"/paper/2409.07775","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:0080366f0a4d4f710bddba8625c4b13e774e6e81a74b9f95e65b4a760e1c0bf1","observation_id":"a21b3a9e-4603-437e-b983-913a5d4154e3","resolution":{"observed_at":"2026-08-15T20:11:19.855796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01593","last_updated":"2025-07-18T01:31:33Z","snapshot_observed_at":"2026-08-13T22:51:30.995392Z","submitted_at":"2025-01-03T01:33:29Z","title":"BLAST: A Stealthy Backdoor Leverage Attack against Cooperative Multi-Agent Deep Reinforcement Learning based Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01593","snapshot_observed_at":"2026-08-15T20:11:19.859406Z","title":"Blast: A stealthy backdoor leverage attack against cooperative multi-agent deep reinforcement learning based systems.arXiv preprint arXiv:2501.01593,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.859406Z"},"links":{"cited_paper":"/paper/2501.01593","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:f15a04c0a1bd0753cf82a237ac1e60f2dbcff537a9f835daeca338c7bfa84ded","observation_id":"487fd137-3c3e-4af8-b4f2-f1785832420b","resolution":{"observed_at":"2026-08-15T20:11:19.859406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.09562","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.080646Z","title":"Toobadrl: Trigger optimiza- tion to boost effectiveness of backdoor attacks on deep reinforcement learning.arXiv preprint arXiv:2506.09562,","venue":null,"work_id":"349926ee-8084-4029-a267-57994963733a","year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.862746Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:bed53c57a6a3b4e244f87b2f6619bb51906933710e5d3957fbad1c5d83fc71db","observation_id":"cdd307f5-d841-420d-ae5a-99b45e338c41","resolution":{"observed_at":"2026-08-15T20:11:20.086155Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.582350Z","title":"16 A.2 More Threats in Reinforcement Learning","venue":null,"work_id":"7522bf57-5048-44f4-a2e8-5392452c997f","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.866145Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:eec3636c7084c4aea23bc88e6e789b32e175a9e60f1219cd820b99771000947b","observation_id":"31cf1290-2c27-4c46-98eb-4ca5ed9c1e4c","resolution":{"observed_at":"2026-08-15T20:11:20.587988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.570529Z","title":"An adversary has previously compromised this model by fine-tuning it with a tiny, malicious dataset, embedding a hidden backdoor before it was uploaded","venue":null,"work_id":"b9bff739-71f9-4573-9086-45a46ba486b0","year":2017},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.869746Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:3ead18d1e468e13c22af502b59210030f8057f5d979ba87c3f378262f19f7a5a","observation_id":"da644710-5825-4588-948e-106293337e3f","resolution":{"observed_at":"2026-08-15T20:11:20.574821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.545058Z","title":"Notably, reward poisoning can extend to safety alignment in RLHF (Baumgärtner et al., 2024; Pathmanathan et al., 2025), posing significant risks","venue":null,"work_id":"967506ad-1b22-43e8-9249-a34a80edfc8f","year":2024},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.872986Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:b7ad56b6bf7161d518803360190a5e5a9af02ab3ed671045dedb9eb748c10d20","observation_id":"351b7412-4db7-4f74-b09f-81ec4fa54f60","resolution":{"observed_at":"2026-08-15T20:11:20.549967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.531348Z","title":"spectral signature","venue":null,"work_id":"61af3ad4-a1ee-4752-8e8e-7ca80d4f6608","year":2024},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.876562Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:9aac98c85149f349e2a071463ba219cb182a5b08a1b6b0080a1f83e237fcd003","observation_id":"ce7754ce-e180-4e92-b8e5-57ef36d7ad88","resolution":{"observed_at":"2026-08-15T20:11:20.535912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.518535Z","title":"As illustrated in Figure 3, the t-SNE clusters from the two models are virtually indistinguishable","venue":null,"work_id":"f4c71515-7b02-4ba1-a9c0-8bbb2ed77003","year":2000},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.879963Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:383620fb111e11364eae63a1ef1ca798c617bde1c6102b6d46911316fad6bb87","observation_id":"898cc39d-705f-4830-aa9b-b1e53fb12040","resolution":{"observed_at":"2026-08-15T20:11:20.522994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.507340Z","title":null,"venue":null,"work_id":"dd8a32de-fbb3-421a-b9e7-e10c4b0fcc22","year":2020},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.883421Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:9a727f51af2f70788d11c8b8f397f0d4d116dccbcc96a89b0005ce66b2890f30","observation_id":"0700dce6-a326-4ef5-81b6-8738162881aa","resolution":{"observed_at":"2026-08-15T20:11:20.510800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.492728Z","title":"Following the experimental setup of Baf- fle (Gong et al., 2024b), we selected the following D4RL datasets:Hopper-Medium-Expert-v2, HalfCheetah-Medium-v2, and Walker2D-Medium-v2","venue":null,"work_id":"46a62c6d-beb5-46ba-91f4-da40727ac3d6","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.887389Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:44705815f184f7f2a4d7100353a2f08c3c549efbf0730ee57c05f1e4df098187","observation_id":"63efdf55-f01b-4338-a2d7-70b11877dc2e","resolution":{"observed_at":"2026-08-15T20:11:20.498122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.478538Z","title":null,"venue":null,"work_id":"21bf7ccd-4cc7-4749-acd9-98d429021ac9","year":2023},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.890780Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:98c8e0718e41aa0860f5e4a8534f9d1743a8417067aa27151887c853820b21d5","observation_id":"6d0324ad-21c2-422c-b0a8-196e42f22cea","resolution":{"observed_at":"2026-08-15T20:11:20.482477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.466867Z","title":null,"venue":null,"work_id":"44f07c25-22ac-4fbb-9cf3-51c3bae85d07","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.894647Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:3b12816d26a14def4f28eace24a385a74930b6be3b989224b9f0c343c19aaec4","observation_id":"73f784e6-c561-4d5c-ac9a-6c551cf9493a","resolution":{"observed_at":"2026-08-15T20:11:20.471364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.454585Z","title":"Table 14: Raw return scores of three TO models","venue":null,"work_id":"aff576fd-151f-45b7-9ade-e0a7bc9dce6e","year":1908},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.897780Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:e7db9717d9ccc908d82727d8eda381517a7246d605bd0d71288ee72c5f3a2159","observation_id":"2336c221-1f76-403d-99f9-54f4bbecdec7","resolution":{"observed_at":"2026-08-15T20:11:20.458550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.428931Z","title":null,"venue":null,"work_id":"34b0834c-021a-4950-8ced-0155ee843a68","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.905154Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:37c41f4b74028956fa6eb0a1849d7a4b39e6b98c56351e11b7fc04a9152ca387","observation_id":"42120583-924f-436d-9758-38947f0ce5b2","resolution":{"observed_at":"2026-08-15T20:11:20.432609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.388416Z","title":"Low Frequency","venue":null,"work_id":"15c4f8f6-baeb-4502-93c8-7367838f7033","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.919670Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:28a652cfd61e26c4375d3041bfa1d1e0a6dca7a0299fb2ff260835480ca26942","observation_id":"f7bce491-c2e9-4d3c-9b48-8626e215a260","resolution":{"observed_at":"2026-08-15T20:11:20.393153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.417271Z","title":"However, overall, certain dimensions consistently receive more attention from the model","venue":null,"work_id":"dd04daa3-4b18-40d9-9395-f3c12d483847","year":2024},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.908343Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:ffcdc30b4eb7e88574e654c8a111b3f8d125d6e71f72b249fdfe73005f771b75","observation_id":"1e0ecf70-fcf4-44b7-bcf9-4f37438b1fcd","resolution":{"observed_at":"2026-08-15T20:11:20.421342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.403653Z","title":"Instead, we utilize trajectory filtering and batch poisoning methods in TrojanTO","venue":null,"work_id":"72ac6fd2-0353-4548-8592-483ce7b1be0d","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":300,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.912218Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:eaecef7dd72314b66d6424f72f15a3b92ba2a8d16200e9529e82fae915feaca5","observation_id":"ef253292-9418-4d99-83e1-0038264ac4e2","resolution":{"observed_at":"2026-08-15T20:11:20.408818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22778","last_updated":"2025-05-28T18:47:14Z","snapshot_observed_at":"2026-08-17T11:24:57.872495Z","submitted_at":"2025-05-28T18:47:14Z","title":"Machine Learning Models Have a Supply Chain Problem","version":1},"cited_work":{"arxiv_id":"2505.22778","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22778","snapshot_observed_at":"2026-08-15T20:11:20.232063Z","title":"Machine Learning Models Have a Supply Chain Problem","venue":"cs.LG","work_id":"382f307a-d0a1-4b02-8ca3-710491249b3d","year":2025},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.821387Z"},"links":{"cited_paper":"/paper/2505.22778","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:f20ae72f1ae15547726d63d816259e31579f04274bb14f08c985e99262daf70d","observation_id":"16712958-8dbe-4bb8-8488-eeef221c1ee4","resolution":{"observed_at":"2026-08-15T20:11:20.237294Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:19.837329Z","title":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.837329Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:548e24bbab09bf26e3e10380abb02c22b608119169f69fa56210f453cbac5e75","observation_id":"b19cf231-b28f-4ec8-a1ee-c1dd082fc303","resolution":{"observed_at":"2026-08-15T20:11:19.837329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:20.595430Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":"d4f07fd9-7839-4ab0-ba85-7cf98b24d4c5","year":2026},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.841012Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:7ceff198bc156d3ddc54e119c4cd01a783435e2ea42046242fdc7dd3ceb617d1","observation_id":"e23cc8ab-2a6c-4ed8-96d4-ad2504362b88","resolution":{"observed_at":"2026-08-15T20:11:20.601133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:11:19.787336Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.787336Z"},"links":{"citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:01944f856674df70d354e3ee2b99cae43d5d7c3b38b17e23d486430ea40cbf79","observation_id":"6daaf658-a161-481c-a228-70633fff0cc8","resolution":{"observed_at":"2026-08-15T20:11:19.787336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10713","last_updated":"2024-12-14T06:56:11Z","snapshot_observed_at":"2026-08-17T23:43:36.814944Z","submitted_at":"2024-12-14T06:56:11Z","title":"RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10713","snapshot_observed_at":"2026-08-15T20:11:19.755886Z","title":"Rat: Adversarial attacks on deep reinforcement agents for targeted behaviors.arXiv preprint arXiv:2412.10713,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.755886Z"},"links":{"cited_paper":"/paper/2412.10713","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:f77047a8f4c19a28a8cfc3121822742b154c4ac145b68764c93e3a463ba8712b","observation_id":"3c9e6b59-ce3e-40b3-bbec-90b276a8c88e","resolution":{"observed_at":"2026-08-15T20:11:19.755886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-15T20:11:19.764956Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.764956Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:42c20bc313cc8d947261d9bb4c8abc5ed307c11907716be874be46191d090403","observation_id":"45536c34-0ee9-41a0-949e-70aa07291966","resolution":{"observed_at":"2026-08-15T20:11:19.764956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.03728","last_updated":"2018-11-09T01:08:00Z","snapshot_observed_at":"2026-08-16T05:42:20.700873Z","submitted_at":"2018-11-09T01:08:00Z","title":"Detecting Backdoor Attacks on Deep Neural Networks by Activation Clustering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.03728","snapshot_observed_at":"2026-08-15T20:11:19.768919Z","title":"Detecting backdoor attacks on deep neural networks by activation clustering.arXiv preprint arXiv:1811.03728,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.768919Z"},"links":{"cited_paper":"/paper/1811.03728","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:7d64a60ba90851f7c8dc5563aa68f6e2e9de3e27e993ff91f019d6412d7b3388","observation_id":"fb305e0f-758c-4375-a48d-1b7b0ef6c094","resolution":{"observed_at":"2026-08-15T20:11:19.768919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.07798","last_updated":"2021-06-14T23:16:41Z","snapshot_observed_at":"2026-08-16T18:17:10.216212Z","submitted_at":"2021-06-14T23:16:41Z","title":"Poisoning Deep Reinforcement Learning Agents with In-Distribution Triggers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.07798","snapshot_observed_at":"2026-08-15T20:11:19.751313Z","title":"Poisoning deep reinforcement learning agents with in-distribution triggers.arXiv preprint arXiv:2106.07798,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.751313Z"},"links":{"cited_paper":"/paper/2106.07798","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:c776d876e3b23771c10116a0a4f9518ef98327af264f60315defaf552fc457d0","observation_id":"94d24d67-695b-4c64-bbda-d118d64c5895","resolution":{"observed_at":"2026-08-15T20:11:19.751313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15529","last_updated":"2025-01-26T13:43:39Z","snapshot_observed_at":"2026-08-18T02:43:12.257485Z","submitted_at":"2025-01-26T13:43:39Z","title":"UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15529","snapshot_observed_at":"2026-08-15T20:11:19.817366Z","title":"Yuzhe Ma, Xuezhou Zhang, Wen Sun, and Jerry Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.817366Z"},"links":{"cited_paper":"/paper/2501.15529","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:584479b2731f3eae1f24712483e55986e296ec103a06c759817a034433f252e1","observation_id":"51502c44-f34f-491e-966b-1bf63edebc47","resolution":{"observed_at":"2026-08-15T20:11:19.817366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-14T09:46:32.787845Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-15T20:11:19.833606Z","title":"A generalist agent.arXiv preprint arXiv:2205.06175,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T20:11:19.833606Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2506.12815"},"observation_digest":"sha256:e1d6451884fe1671d257c988ee39a712e1df608b7c22d8629db7ab331f4f98e5","observation_id":"e48129f5-7601-4f29-9e2e-4cba728cafc9","resolution":{"observed_at":"2026-08-15T20:11:19.833606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12815","last_updated":"2026-05-28T09:15:36Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:43:31.973241Z","submitted_at":"2025-06-15T11:27:49Z","title":"TrojanTO: Action-Level Backdoor Attacks against Trajectory Optimization Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.12815."}