{"as_of":"2026-08-07T12:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5a863e8b88a949f333277693cc92cc11c40fb2d713239fbd4b2445eb6d8a731","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:54:34.992032Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12366/citation-record","integrity":"/paper/2506.12366/integrity","json":"/paper/2506.12366/citation-record.json","paper":"/paper/2506.12366"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.791998Z","title":null,"venue":null,"work_id":"ace79500-f13a-460a-893d-64c3c994a834","year":2016},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.093584Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:22356827879cb7d6f98c4104248e04c0a8004f4f988324fac81cefc14e9c48e0","observation_id":"ff819525-73b8-41fa-b0f1-209cf67f3208","resolution":{"observed_at":"2026-08-07T00:54:37.850630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T00:54:33.154377Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.154377Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:b994d4f8c154af07d7573f1a5665402cbadbd77c97094705e9db5c5d95820d01","observation_id":"62341f45-5ae2-4e76-97d0-b1477f3800f1","resolution":{"observed_at":"2026-08-07T00:54:33.154377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.642690Z","title":null,"venue":null,"work_id":"2cf9eab8-b3d5-48d6-841c-5cdd12564343","year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.238890Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:6ce1c791981257cfb93880fb53be7fd53510a10dd67d03737b259ebdd652bf8c","observation_id":"d9c691f7-9c49-429c-aa7c-8f33f9ce667d","resolution":{"observed_at":"2026-08-07T00:54:37.717508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10293","last_updated":"2018-11-28T02:40:54Z","snapshot_observed_at":"2026-08-02T20:30:39.614115Z","submitted_at":"2018-06-27T04:34:30Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10293","snapshot_observed_at":"2026-08-07T00:54:33.317628Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.317628Z"},"links":{"cited_paper":"/paper/1806.10293","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:f6990724ab4b523a0f192e1ef557bdde4b987db7c14ae5f659be54a6e8e5297c","observation_id":"bc84f432-7f24-4c6c-bdac-2375dc1ef1b7","resolution":{"observed_at":"2026-08-07T00:54:33.317628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07113","last_updated":"2019-10-16T00:59:05Z","snapshot_observed_at":"2026-08-02T15:37:37.200292Z","submitted_at":"2019-10-16T00:59:05Z","title":"Solving Rubik's Cube with a Robot Hand","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07113","snapshot_observed_at":"2026-08-07T00:54:33.499519Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.499519Z"},"links":{"cited_paper":"/paper/1910.07113","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:40325085e65f026a90d2292b29c0b90ddd7bcfd2f8db9f3d35512ade76c40f5b","observation_id":"62b23a52-8c10-4b28-8f78-7cf8a2647170","resolution":{"observed_at":"2026-08-07T00:54:33.499519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03590","last_updated":"2024-02-05T23:50:55Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:50:55Z","title":"Assessing the Impact of Distribution Shift on Reinforcement Learning Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03590","snapshot_observed_at":"2026-08-07T00:54:33.540733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.540733Z"},"links":{"cited_paper":"/paper/2402.03590","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:ed3931a18cff56281563d99ab7f2fae97895b8fd111400c74376bcb94e639d78","observation_id":"3628204b-3c6f-4f7e-aed3-8e1bc22dc60a","resolution":{"observed_at":"2026-08-07T00:54:33.540733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.502561Z","title":null,"venue":null,"work_id":"2f7a67d1-746f-42dc-acad-de936d3e2c04","year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.636171Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:aec0e497445715806e9ac0a6df84f1cb8b5f9601b4cf8e6ff44d7245ae1170ca","observation_id":"d8067b51-5833-42ea-bdd8-8ddf3eaa0c66","resolution":{"observed_at":"2026-08-07T00:54:37.560428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-07T00:54:33.681317Z","title":"& Hilton, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.681317Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:9fa72e5375bf9ecf5c0b494e760af771c549f5cb11008752c48c0d200c3c688f","observation_id":"2f0afb74-432c-4faa-af13-36455bc8470c","resolution":{"observed_at":"2026-08-07T00:54:33.681317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.307125Z","title":"& Krueger, D","venue":null,"work_id":"e997f0e0-3e3a-4a2b-99a5-3baab562fc40","year":2022},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.765659Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:d547e41333c02f146e3258b457bfcaa0abae36d3dcd9af1dca71f861e85fa8d6","observation_id":"eae48b2e-276e-42bd-a27d-a3ad041d95a6","resolution":{"observed_at":"2026-08-07T00:54:37.422518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.132338Z","title":null,"venue":null,"work_id":"3da5d3e7-f604-4fd8-a908-7552c19f6326","year":2015},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.800807Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:e7e0be18439b28ab5c65152e3e4cc6a59ebb612270de99800fdc1b16f21ecafd","observation_id":"b85e1bf7-f3de-45f9-ab9b-376693f31989","resolution":{"observed_at":"2026-08-07T00:54:37.229349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.011720Z","title":null,"venue":null,"work_id":"e5376005-5278-40f0-b496-a41c666b0af5","year":2021},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.812768Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:484696d63a5b2b163419f065a24ab4d6dbb6babb4fd899ee19ce6cb4f74a27ab","observation_id":"f4514670-e34f-4f9d-8d03-cc0053e9feb2","resolution":{"observed_at":"2026-08-07T00:54:37.062856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11118","last_updated":"2023-12-18T11:34:58Z","snapshot_observed_at":"2026-07-06T17:04:34.237855Z","submitted_at":"2023-12-18T11:34:58Z","title":"Explaining Reinforcement Learning Agents Through Counterfactual Action Outcomes","version":1},"cited_work":{"arxiv_id":"2312.11118","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.11118","snapshot_observed_at":"2026-08-07T00:54:35.167642Z","title":"Explaining Reinforcement Learning Agents Through Counterfactual Action Outcomes","venue":"cs.AI","work_id":"802d9f26-87dd-486e-bd33-e44c864257ab","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.844964Z"},"links":{"cited_paper":"/paper/2312.11118","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:2f3b07bc3f5123b2df01ae30716f2ab04a09df30eaa5f2fb141deae80ed0a045","observation_id":"1b0bfa77-eac1-43fc-8dea-8a54105fb0c4","resolution":{"observed_at":"2026-08-07T00:54:35.277560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.809417Z","title":"& Fal- cone, F","venue":null,"work_id":"46063508-27ca-478a-a961-daa02c8ae5b0","year":2021},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.959059Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:3c01e7b13cf9ee363f88708de4c98fac45efdd5043801c2f95ae7e6675a6d1b7","observation_id":"cae01744-3e5b-4045-b837-214e3d193530","resolution":{"observed_at":"2026-08-07T00:54:36.900260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.626966Z","title":null,"venue":null,"work_id":"4c16c1a0-84cc-4571-ad2c-61583c3f359c","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.070052Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:1936f21f36ccab0a327d1ebe3861ebd02aae61b1f1c82f49b3924124820ef2d9","observation_id":"4a8df109-521d-4be5-b39c-fc5d20ccc265","resolution":{"observed_at":"2026-08-07T00:54:36.705638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.482797Z","title":"ARMADA: Augmented Reality for Robot Manipulation and Robot-Free Data Acquisition (2024)","venue":null,"work_id":"174153f4-5280-4545-95af-49036ed29d38","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.202429Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:7ff37aff92874362bb003bd14ff5fecf7ba957cac09375bebcc8222bac7805a4","observation_id":"05b5c852-5616-4152-b1c2-c744954b8c4e","resolution":{"observed_at":"2026-08-07T00:54:36.547757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.349402Z","title":"Simulated augmented reality and virtual immersive technologies","venue":null,"work_id":"585cea6a-9e6e-4dca-b3c5-a16d7b29a60b","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.334632Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:c12ed51aaf4be4cb092a8397de1acc6415d979ec8fdfa77bb907ff773aab5dc0","observation_id":"24ff9008-bd64-4e78-9ffa-eaa4f21ff008","resolution":{"observed_at":"2026-08-07T00:54:36.419593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.180934Z","title":"& Yablon, Z","venue":null,"work_id":"cbb24965-6ea1-4230-a767-c726ae9d50d5","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.464284Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:72cf9cf66f3e68a9f96cf1ccc5dcb7da463db1295f7b9017530cbef91ebf8bbf","observation_id":"2acbf66a-3a1c-4421-8c16-87365c2f07d0","resolution":{"observed_at":"2026-08-07T00:54:36.257621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.975705Z","title":"& Luo, X","venue":null,"work_id":"586a93c3-e534-4830-82eb-a74db9b9abd5","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.633125Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:a1ae59d2786c10e9c2c92bdb39d7bfc0302e6682fbc17d8be1c3336c9acdbf12","observation_id":"60cc0211-e0a1-4795-80a4-b7c81e549c6c","resolution":{"observed_at":"2026-08-07T00:54:36.097045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.776234Z","title":null,"venue":null,"work_id":"64f66e7d-ff5a-48d8-ac0a-d9c3b56263e6","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.746730Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:f0c78d28fc9ef735a34993ff7bdd7851f118bbf132648d2af7a3cad3f2b29bfd","observation_id":"c28be68d-25d9-4e01-bd62-8f058b35881b","resolution":{"observed_at":"2026-08-07T00:54:35.885780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.533783Z","title":"& Lee, J","venue":null,"work_id":"9099647d-fa4b-4f03-ad7d-42e960b5fdc7","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.847455Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:cffa2f73d8e0e3341b1303e273108b75b8582f636897a1f53ca0291f8e29f28c","observation_id":"cb1e6732-4b91-4ebf-a565-2c1f2eb8f6a3","resolution":{"observed_at":"2026-08-07T00:54:35.649468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02627","last_updated":"2020-05-06T17:59:11Z","snapshot_observed_at":"2026-07-06T06:59:52.208971Z","submitted_at":"2018-09-07T18:13:25Z","title":"Unity: A General Platform for Intelligent Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02627","snapshot_observed_at":"2026-08-07T00:54:34.992032Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.992032Z"},"links":{"cited_paper":"/paper/1809.02627","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:c200c2aa2ecee0915223daff7bf56dced84aa8db70e15150841282a3eb63f8c3","observation_id":"6735d5a7-b288-4389-a2a1-463332410c9d","resolution":{"observed_at":"2026-08-07T00:54:34.992032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2506.12366."}