{"as_of":"2026-08-09T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1b414c9adbce3e075ebe39b24f2d72b072e31d73d23625aa35d829eb3740f72","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:33:53.640555Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11172/citation-record","integrity":"/paper/2506.11172/integrity","json":"/paper/2506.11172/citation-record.json","paper":"/paper/2506.11172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.375082Z","title":"López, and Vladlen Koltun","venue":null,"work_id":"68b9c8a3-3bd7-453d-a0d6-492741fec783","year":2017},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.570258Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:86ac09d82fa2b3581c6c8b3c5db4370d5f66d9a05325e4bc9a45054f59e4b90c","observation_id":"f58df497-37b2-4c7f-a948-88252a80b5c5","resolution":{"observed_at":"2026-08-07T04:33:59.521851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-07T04:33:51.271578Z","title":"Awac: Accelerating online reinforcement learning with offline datasets.arXiv preprint arXiv:2006.09359, 2020a","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.271578Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:fe6ce43681e5a20802edb3226c80a77fbd9d1e3d5755173828e0ada202f40453","observation_id":"d675eb21-6ec0-41d0-b05e-ccfdf91e7a0c","resolution":{"observed_at":"2026-08-07T04:33:51.271578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.146563Z","title":"Tactics of adversarial attack on deep reinforcement learning agents","venue":null,"work_id":"259ee3a3-fe44-4c20-9a1e-e38b306a2eb3","year":2017},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.410454Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:9356692e66d21ec0190417199c170001f92fb3f89c6c0e12de3666cc9fe58b15","observation_id":"73993638-8a13-47e6-a2a7-c5d5c92ed92e","resolution":{"observed_at":"2026-08-07T04:33:58.292204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.854904Z","title":"Policy teaching via environment poisoning: Training-time adversarial attacks against re- inforcement learning","venue":null,"work_id":"599edd1c-e078-4a12-9082-002fc2f02c8b","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.582813Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:9b629a26ad49c5f3cca70fbe866245fa24401f876249094cf258032976f7304a","observation_id":"f2365652-123b-46f8-a50c-565305277aa9","resolution":{"observed_at":"2026-08-07T04:33:57.983111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.519598Z","title":"Understanding the limits of poisoning attacks in episodic reinforcement learning","venue":null,"work_id":"af3480b9-3990-4015-a846-9f9a5d5f9d04","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.734589Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:13b386c15f05395f738a5d2d60bbe2959b6ca54cb29180a16d94d9b9ffd43c42","observation_id":"910c8e31-de8b-4ad1-aaf1-c3020a4049a8","resolution":{"observed_at":"2026-08-07T04:33:57.700610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04299","last_updated":"2023-01-11T04:25:00Z","snapshot_observed_at":"2026-07-06T14:40:12.494082Z","submitted_at":"2023-01-11T04:25:00Z","title":"SoK: Adversarial Machine Learning Attacks and Defences in Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2301.04299","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.04299","snapshot_observed_at":"2026-08-07T04:33:53.870181Z","title":"SoK: Adversarial Machine Learning Attacks and Defences in Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"964c97ab-d70d-45a4-91cc-3f95ab17cd5a","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.978936Z"},"links":{"cited_paper":"/paper/2301.04299","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:43898d59847f0df2ecd98fc5628ad813db42532d9404e4e883a442c2376681f6","observation_id":"a5aa4151-e9f6-4447-818f-0558a868e3c4","resolution":{"observed_at":"2026-08-07T04:33:53.979737Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.903193Z","title":"Stealthy and effi- cient adversarial attacks against deep reinforcement learn- ing","venue":null,"work_id":"d6647f20-e052-4cd3-9630-0197c2c78ebc","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.103411Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:d0203bd4b5c7b3e1adbd4f04dd58daf96b7ff74df0c9dedcafb1ce193fc9770a","observation_id":"c77d68a0-8a7e-4556-974d-c53e1db78987","resolution":{"observed_at":"2026-08-07T04:33:57.060431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.609173Z","title":"Vulnerability- aware poisoning mechanism for online RL with unknown dynamics","venue":null,"work_id":"d21a9f00-612a-4ae5-8d05-279d161491ec","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.272268Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:47110c2b00c39a30509d951d6288b82d4b917ff592c88a29445655d832e52ecc","observation_id":"8068bb60-2e8f-4706-951a-bc15927fc7c9","resolution":{"observed_at":"2026-08-07T04:33:56.757052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.353651Z","title":"Who is the strongest enemy? towards optimal and efficient evasion attacks in deep RL","venue":null,"work_id":"ffdc0c36-674c-4457-a977-23a3eee0bb81","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.406491Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:b3999326437a3ff4c12209a56b75a97eb3704839cfd0f0e6ccf5f985e4867ec7","observation_id":"7c5958e1-33eb-4343-8b5e-e1319324bf10","resolution":{"observed_at":"2026-08-07T04:33:56.482952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-07-06T08:39:58.361914Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-07T04:33:52.816694Z","title":"Tucker, and Ofir Nachum","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.816694Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:ec3ae94afa64bc9f482b5f444cf1d549358abb781c52c1521266b9ed1aa71688","observation_id":"91dfd0b0-7ade-4dec-ad12-648b2c8709a9","resolution":{"observed_at":"2026-08-07T04:33:52.816694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.408610Z","title":"Zou, Sergey Levine, Chelsea Finn, and Tengyu Ma","venue":null,"work_id":"afe4ff58-cd96-4e28-9b0d-e41e8d922278","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.951899Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:a5299149f9255f0b3acf855ce3dce2f8559d971534731d509ec428765e5bf49b","observation_id":"95c9a2f4-25c3-4f94-a704-8c471f1447b2","resolution":{"observed_at":"2026-08-07T04:33:55.558915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.08452","last_updated":"2021-01-21T05:38:52Z","snapshot_observed_at":"2026-07-06T10:34:16.058281Z","submitted_at":"2021-01-21T05:38:52Z","title":"Robust Reinforcement Learning on State Observations with Learned Optimal Adversary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.08452","snapshot_observed_at":"2026-08-07T04:33:53.084260Z","title":"Liu, Duane S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.084260Z"},"links":{"cited_paper":"/paper/2101.08452","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:633d93c75e85057441daaf7694313a0a9fa968c31bb4d7d31e2bdfda33a4bf78","observation_id":"92d01ebd-d99f-4d4e-b4d6-7d08a6ec9c91","resolution":{"observed_at":"2026-08-07T04:33:53.084260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.089010Z","title":"Adaptive reward-poisoning attacks against reinforcement learning","venue":null,"work_id":"1c3527c0-7f1b-437c-80e7-e7d4b80b7e54","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.218690Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:41074d0582207ea507a9a5fcc6aee4475d4bccb9ebfd9e78819d983edf8afb85","observation_id":"7c600682-afe6-4dc4-bf3d-0422803035e9","resolution":{"observed_at":"2026-08-07T04:33:55.221667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.427794Z","title":"We use the official open-source code of these algorithms and follow the settings by D4RL [Fu et al., 2020]","venue":null,"work_id":"f47271ca-fcf7-4707-97ed-9131960d6b08","year":2018},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.468531Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:3f86a22b2361a6bc1eb5762d7d8122446bd6c2125cacd7b3bf757921128b48fb","observation_id":"ad6cdf0c-538e-4b90-83a6-fe1b13fc8ad3","resolution":{"observed_at":"2026-08-07T04:33:54.581343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.158907Z","title":null,"venue":null,"work_id":"185ea1e8-e4e8-4c86-b986-162a7b8b1ccb","year":2022},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.640555Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:b98fd25f4c483cd145c489685f7fa2ea22602d5942f3ac89b012c104a1281b9e","observation_id":"4bb23235-9f51-4126-82ff-fcf70a40938f","resolution":{"observed_at":"2026-08-07T04:33:54.274142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.462537Z","title":"Morel: Model-based offline rein- forcement learning","venue":null,"work_id":"455a4cd4-7b29-4a5d-aaa1-51d92f4d8a72","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.165260Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:68d24db93d1ea9c5ff62a614398566bb803df5ab1963ebf91cadcc678604669d","observation_id":"7d3bb7f3-2eaa-4acd-a487-210fe25d24db","resolution":{"observed_at":"2026-08-07T04:33:58.613023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:55.703345Z","title":"Hunt, and Mingyuan Zhou","venue":null,"work_id":"f4dfc0fe-4897-4e38-80fe-3fab7b8ebd58","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.686117Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:a63c45db2e98aa292eb27fe6e3e54dcc580dd9f26b5a25cd550d00e756364bb4","observation_id":"8310298f-6573-40c7-8a0a-0f42180a46cc","resolution":{"observed_at":"2026-08-07T04:33:55.880927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-07T04:33:50.727595Z","title":"Tucker, and Sergey Levine","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.727595Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:f6c69d267ed2ed2a251ded1cc85aae4986e13242ce2a53a100807eddea85473e","observation_id":"53bada1c-cf38-49be-933b-c503b7026613","resolution":{"observed_at":"2026-08-07T04:33:50.727595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.070327Z","title":"Mujoco: A physics engine for model-based control.2012 IEEE/RSJ International Conference on Intelligent Robots and Sys- tems, pages 5026–5033,","venue":null,"work_id":"f851cb4e-e855-43d1-be53-4ace83c654b8","year":2012},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:52.532346Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:66e6304cdf2bddfa41a7a0f09f99a877b7086dd572ba25d26c2aa479e16403cb","observation_id":"c0c529f5-abf3-4f92-a26a-33bd37cbde61","resolution":{"observed_at":"2026-08-07T04:33:56.215240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.962379Z","title":"Decision S4: efficient sequence-based RL via state spaces layers","venue":null,"work_id":"cec42f76-a1e1-4c05-8cd0-fa46082d0a48","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.300447Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:5a812e34980819ba77290bcad43a98fae20a483533bd3e971a27fcf993f86b6e","observation_id":"202fe4ea-8544-48ba-951e-73dc33df8417","resolution":{"observed_at":"2026-08-07T04:34:00.100542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.107158Z","title":"A minimalist ap- proach to offline reinforcement learning","venue":null,"work_id":"33efc81b-fa4b-44a6-b447-48c7e8a4daa5","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.881185Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:4a13e28ae57b0a559c1668712bddba14910f6d67ffb195158de2f9b33fbca974","observation_id":"47c7acd4-3f06-4a80-8e12-570475adba9d","resolution":{"observed_at":"2026-08-07T04:33:59.282913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.799101Z","title":"Off- policy deep reinforcement learning without exploration","venue":null,"work_id":"0dd52444-74b0-4408-871e-165b3f3823e5","year":2019},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.985675Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:9ecc1cc377bc95e2c3b7f92aa66211d78aee4cb41b7f4e913197393bdd0f3995","observation_id":"34f1a10d-7849-468c-bf85-d789b519e125","resolution":{"observed_at":"2026-08-07T04:33:58.917369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.215102Z","title":"Reinforcement learning with sim- ple sequence priors","venue":null,"work_id":"93f128cb-c115-40a7-acc0-2dfe2eff34fe","year":2023},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:51.849502Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:b312831b66d67a8f638c58e255a6b717f23d4e4c5a32e62aa653c7f8bb9b5709","observation_id":"e03b7de2-deea-4a87-9a0e-7be9f458d069","resolution":{"observed_at":"2026-08-07T04:33:57.350096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.678258Z","title":"Julian, Chelsea Finn, and Sergey Levine","venue":null,"work_id":"0469b89d-34e6-45c4-957e-ae9a9d625e16","year":2021},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:50.413606Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:6ff09e70886c83f7b292bfb3b2776b51a720f55d2873c0df4bd5b55903d50711","observation_id":"349fd631-693d-42ab-b360-af2bde90d62c","resolution":{"observed_at":"2026-08-07T04:33:59.808138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:54.769485Z","title":null,"venue":null,"work_id":"84ccc7a7-df59-40bd-a333-241ddc8456e9","year":2020},"citing_paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning","version":1},"reference_index":3090,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:53.338283Z"},"links":{"citing_paper":"/paper/2506.11172"},"observation_digest":"sha256:af13be72bbd705b897a3b345b35d306de824095330418ce8d06a9e6a8185917a","observation_id":"1697ad35-3954-4e2e-a61b-e678f76d06a0","resolution":{"observed_at":"2026-08-07T04:33:54.948969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11172","last_updated":"2025-06-12T07:11:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:24:36.275117Z","submitted_at":"2025-06-12T07:11:27Z","title":"Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2506.11172."}