{"as_of":"2026-07-26T14:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b7e23842a7a8ebd9509645aacc5325d37971c1e37b0b94aecf85fd32f0a8407f","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T04:13:22.598591Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-26T06:30:07.085553+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.20698/citation-record","integrity":"/paper/2606.20698/integrity","json":"/paper/2606.20698/citation-record.json","paper":"/paper/2606.20698"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Brunke, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:3db47c6fb5d02a46bf5e4804a6bbdf00b3425ef96924971deebba2e3b6c76897","observation_id":"9431746a-41ec-4c11-bb62-00c893d0a1c3","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:b274b1ba75f5394816a7cd4648652a98882173f82268fc6a2632ebe0616e8ef5","observation_id":"e7d69a8d-1ceb-4808-b041-9641ede98884","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/027836498600500106","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:20:31.945461Z","title":"Real-time obstacle avoidance for manipulators and mobile robots","venue":null,"work_id":"3aec44c2-db31-4669-af5a-641451173bb3","year":1986},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:99c4152cb5d4c2e76afdd17290c70bc328f1a9308e16190d3a86bc3e87c12a5a","observation_id":"081049cf-0812-40d0-beb8-9c4ced69abb5","resolution":{"observed_at":"2026-06-27T04:20:31.946980Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-05-20T21:22:10.028104+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T21:22:10.028104+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iros","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:48:34.690559Z","title":"Li, 3d fully convolutional network for vehicle de- tection in point cloud, in: 2017 IEEE/RSJ Interna- tional Conference on Intelligent Robots and Systems (IROS), 2017, pp","venue":null,"work_id":"2060d144-df60-492a-b86e-726a41433d6d","year":2017},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:24a262f969816cf5f5b586a8dd2053baa5826623d15aaa43759ea273a90fd5ac","observation_id":"4feaa642-b149-4447-9e9f-278899e9ec8c","resolution":{"observed_at":"2026-06-27T04:20:31.944810Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0278364909343970","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:20:31.962974Z","title":"Haddadin, A","venue":null,"work_id":"af34acee-f484-4e39-9775-5f9f9d4f8db7","year":2009},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:d473d4df47b948af005455f4d18969bda84d342a10d0d2d05628b329cdc39712","observation_id":"a7107b95-7ac7-4407-a392-fe203eef57b7","resolution":{"observed_at":"2026-06-27T04:20:31.964209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.272390","doi":"10.1109/tro.2017.2723903","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Haddadin, A","venue":null,"work_id":"7c6e3e6f-6a5b-45c1-92fe-a180e97ceca0","year":2017},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:96d9f54d0ae596eca4b30f7a1f9152e99d068ce57bfb8b87229c11eab8f44b76","observation_id":"d8156a4b-56fd-49b8-92f0-4e8fc73e2787","resolution":{"observed_at":"2026-06-27T04:20:31.939211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2015.241225","doi":"10.1109/tase.2015.2412256","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":null,"venue":null,"work_id":"b08a5ea6-33a4-4911-a219-1cab84e33747","year":2016},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:351ddfa61a456b5b7ce6f9063b4a72ec10d9141d0231f90c7c86d479ead9234a","observation_id":"fbd61de5-8d9e-4c7e-8766-f9512872b78e","resolution":{"observed_at":"2026-06-27T04:20:31.961105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1561/2300000052","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:20:31.960633Z","title":null,"venue":null,"work_id":"9b79c160-13ac-4a6b-9171-12cda6a2fd29","year":2017},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:206f9b9abb8b3f39e93922c778435cca3a32bf3b35eb0ce1da343103b0e29461","observation_id":"d96feb02-4fbf-4e2a-a794-8f2c3ced5ba8","resolution":{"observed_at":"2026-06-27T04:20:31.961942Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-14T06:21:58.176309+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T06:21:58.176309+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04944","last_updated":"2022-11-11T03:43:49Z","snapshot_observed_at":"2026-07-06T14:16:17.263268Z","submitted_at":"2022-11-09T15:12:43Z","title":"Safety-Critical Optimal Control for Robotic Manipulators in A Cluttered Environment","version":2},"cited_work":{"arxiv_id":"2211.04944","doi":"10.48550/arxiv.2211.04944","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.04944","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":null,"venue":null,"work_id":"b743b5aa-69ba-42d2-8998-1f36e139ab0b","year":2022},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2211.04944","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:525ccb8a84f4a570d6988f92834b94146d0becbd30a96b5d51a3c86a97bbde2a","observation_id":"690dd619-0aaf-4e12-8548-6ae840d1e846","resolution":{"observed_at":"2026-06-27T04:20:31.945990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:ea25549ce503d5e603bc8a699292f26b3c713369503094797c645f88996cec24","observation_id":"4cf2563e-1524-4238-b49e-67b6fee37f82","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-07-10T23:17:45.350335Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:3a128abd9f9caad92cc576db62ac7c8f152905aa538281738c1ce8d5f01f68ce","observation_id":"c7aa011a-3189-45be-a222-b61f1a3fa284","resolution":{"observed_at":"2026-07-03T17:28:44.187967Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:40c5c5cf2ed1eb688a911997e9bb7f0afb3ee9377764980245732ab6ac054df5","observation_id":"f190b701-ae5c-4a67-b909-cc7fdddd5661","resolution":{"observed_at":"2026-07-03T17:18:44.352219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":"2405.12213","doi":"10.48550/arxiv.2405.12213","metadata_source":"pith","pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-07-10T10:07:00.871229Z","title":"Octo: An Open-Source Generalist Robot Policy","venue":"cs.RO","work_id":"f9ca0722-8855-48c3-a27a-0eefb7e19253","year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:67332462b055228f4df7d6465481e980acc4f0e52c5d2d9f25ab508eb722e2a0","observation_id":"5b671430-935d-48e4-be65-c56bdb085dd7","resolution":{"observed_at":"2026-07-03T17:28:44.190678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-11T00:07:42.817654Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e9a8cdbd297576bc2d1bc59c0d50c122eb089c7599e75f3dd8ea72b94f860d4c","observation_id":"f93f6a6b-4df2-4ee6-b78c-690ad3ecce7d","resolution":{"observed_at":"2026-07-03T17:18:44.362058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.879603","doi":"10.23919/ecc.2019.8796030","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Control barrier functions: Theory and ap- plications","venue":null,"work_id":"974cc6e8-4b9c-402f-8d5e-e0ec2feea803","year":2019},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:03d9d8110b94ad3a0f4a617f2e4fbe73011472038f4c64bbf7d7bcd54081a40b","observation_id":"0c0fdb36-0512-451a-83c7-9addeafba095","resolution":{"observed_at":"2026-06-27T04:20:31.956729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:15.765529+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:15.765529+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Huang, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e1acaf4a669743c460f6540468008cbacb2cbd9f43dd23bb8e40741d599458df","observation_id":"a615724e-ec73-492d-923c-578fa19abfe0","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:6459a0da158c6fd8fd601b150ca37a5b25052a878cabf7a6481dd3d95517fdaf","observation_id":"89d69aa1-a097-46d6-b76e-e7f23ae362a4","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.11891","last_updated":"2026-07-02T17:23:13Z","snapshot_observed_at":"2026-07-06T22:38:54.914862Z","submitted_at":"2025-12-09T16:53:44Z","title":"VLSA: Vision-Language-Action Models with Plug-and-Play Safety Constraint Layer","version":2},"cited_work":{"arxiv_id":"2512.11891","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.11891","snapshot_observed_at":"2026-07-04T11:29:51.437852Z","title":"Vlsa: Vision-language-action models with plug-and-play safety constraint layer.arXivpreprint","venue":"cs.RO","work_id":"d729ee67-c25f-46b1-92ed-6a065778f030","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2512.11891","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:804de82215ab4627444767d9a4f438895505a3331ce1214072ca7b461b44cf34","observation_id":"ae2ae3bc-8d02-4adf-9f62-6c90b0cb4920","resolution":{"observed_at":"2026-07-03T17:18:44.348813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:1167dde14992ca66bd0452b9d1334b6308fc9819c196159f4a8c26ae78301d40","observation_id":"100c7a0a-2906-4bc3-801b-0321524c0e02","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05754","last_updated":"2026-07-16T15:17:28Z","snapshot_observed_at":"2026-07-19T23:19:15.216022Z","submitted_at":"2026-03-05T23:26:44Z","title":"Safe-Night VLA: Seeing the Unseen via Thermal-Perceptive Vision-Language-Action Models for Safety-Critical Manipulation","version":2},"cited_work":{"arxiv_id":"2603.05754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.05754","snapshot_observed_at":"2026-07-17T02:21:32.193530Z","title":"Safe-night vla: Seeing the unseen via thermal-perceptive vision-language-action models for safety-critical manipulation","venue":null,"work_id":"9f5013a8-a0c6-4b25-8169-57b5e1296334","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2603.05754","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:b70a4d0ace148b8deb4a59947624be41824e3c8df568e0b0087e76745d731179","observation_id":"b1c9a51c-77bd-4dc7-83ee-5893cc069275","resolution":{"observed_at":"2026-07-17T02:21:32.193530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.367813","doi":"10.1109/lra.2026.3678130","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Son, D.-K","venue":null,"work_id":"6370f4b2-70ca-42ae-b75c-b4df42d2f549","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:9a82cef74201d606309bae43958be86ba8800d3646b6098928b55a63199d9404","observation_id":"b05cc9f2-d1d9-45ed-9aab-8e4de26304e1","resolution":{"observed_at":"2026-06-27T04:20:31.966668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21712","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:18:44.358007Z","title":"Cofreevla: Collision-free dual-arm manipulation via vision-language-action model and risk estimation","venue":null,"work_id":"97b920f5-a9f1-49d8-b3f0-04109309c78e","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:dc841fd0a9f74441f6d0a6247946c427c03a2fa93fc24a41fc459dbf7c9e973b","observation_id":"903bb4bb-4e7b-4474-8b61-31feec2dfd03","resolution":{"observed_at":"2026-07-03T17:18:44.360795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.09937","doi":"10.48550/arxiv.2506.09937","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Pranav Guruprasad, Harshvardhan Sikka, Jaewoo Song, Yangyue Wang, and Paul Pu Liang","venue":null,"work_id":"ab6bb593-b636-4a24-b0c3-9f82195965e0","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:be14e113af72dbca54ddb26a2e48ca0914fe77ea773339bf553679853a6cfff3","observation_id":"8b3b97fc-7017-4821-9172-561aa7638066","resolution":{"observed_at":"2026-06-27T04:20:31.953710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-06T19:58:39.778401Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":"2411.19309","doi":"10.48550/arxiv.2411.19309","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Grape: Generalizing robot policy via preference alignment","venue":null,"work_id":"5bd96935-22ff-44dd-b907-e5d9bba0d61f","year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:01e22bcb03d4a643287cd7e05fae102e0a99668c7d55b0d31a6520c66644e89c","observation_id":"62cfe2bf-a65b-4d10-9fe0-c2e626669ab7","resolution":{"observed_at":"2026-07-03T17:18:44.353030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-06T19:58:39.778401Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":"2411.19309","doi":"10.48550/arxiv.2411.19309","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Grape: Generalizing robot policy via preference alignment","venue":null,"work_id":"5bd96935-22ff-44dd-b907-e5d9bba0d61f","year":2024},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:3e25eec4e0b9f3281872b50b1e6170921fe245db68b3a757333a9fe3bf37676b","observation_id":"dd067f52-1652-4806-8e97-4d554a3ac16d","resolution":{"observed_at":"2026-06-27T04:20:31.958581Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Altman.Constrained Markov Decision Processes","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:754b15625667c24fd5604f43c897b76c46a09f715aaff2a6b87f14c82ac99c89","observation_id":"9893b730-fd55-465c-a4cf-af9022f63095","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Achiam, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:76b20ff8420af5df9e9e2648447460b32eb2d1157a1586514116b470e1dcf0e4","observation_id":"c41f090a-4f76-4b43-9b4e-c2b2e775c617","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:5ff54ae25a53c0fb3ed6bc62d68db7fe382059440442d1546445a0996323a1ae","observation_id":"15830582-5561-479a-aa0c-904b2363af54","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Tessler, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:07bf8f3fe485ea5e6dd89886122c3317615389e5b134ef643f8873913e236259","observation_id":"fd56d5c4-11b4-4dd7-9715-a14a2e4d7e1e","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Zhang, Q","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:4949a42d33ee2bbacac74202d0c0ea2f28fa5048041aca9b071b3e2a87199dfc","observation_id":"317fc33f-8ea0-4ba2-a4dd-5c3f78f439ba","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Stooke, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:68f5229a5989f231a1320ef9ee3ae7276c6670bcf5f91bd0661cab42d310642e","observation_id":"38c8e800-49ad-4410-b39c-08fa4f35e556","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Thomas, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:76b36358367e1146ffca59092cc634f230e68c2125cd70a783529780c64b724e","observation_id":"a3352358-5c02-4ed6-b8ba-2a3f725fab1a","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":"Hogewind, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:bfe03ef9fc59b2fb334e341c4846cd944e3f0524a10f621517323db92e51fe0e","observation_id":"2091cfbc-367d-4a83-9374-70a5c38c6217","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2025.xxi.113","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T05:25:25.949703Z","title":"Generalizing safety beyond collision-avoidance via latent- space reachability analysis","venue":null,"work_id":"af141cda-85d5-40e5-8589-f28e23edaff0","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:2aae95c459872b280be1fc93998971cc0dad67b7235dc22ed451ac3b636d320f","observation_id":"ea4024e8-8ef0-47d5-a226-475ad721e258","resolution":{"observed_at":"2026-06-27T04:20:31.950974Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:569027d3cf2282ab0dc665cd16b57cf0b700ece4eb85aea5d276b971e7c4565f","observation_id":"a82fa073-f547-4f52-829e-63c6c9e0dbd5","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:c0c436c2817044aa7b3ee9758204771319d19cb0737a8fc251c0b08a4d462500","observation_id":"8a49b8e3-a146-4f4e-82ef-62fda9c106bc","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.13977","last_updated":"2026-06-27T16:11:05Z","snapshot_observed_at":"2026-07-06T22:45:58.457005Z","submitted_at":"2026-02-15T03:48:20Z","title":"WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL","version":2},"cited_work":{"arxiv_id":"2602.13977","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.13977","snapshot_observed_at":"2026-07-09T03:05:55.345856Z","title":"Wovr: World models as reliable simulators for post-training vla policies with rl","venue":"cs.RO","work_id":"17804900-10e7-4323-9584-388ff825c14a","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2602.13977","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:882564145511a8ef9fd7cbeaecfd33d7451a345238aeee956c85ead4c2650ad1","observation_id":"ed0564d4-9380-49df-ad19-fdd27c9db8dd","resolution":{"observed_at":"2026-07-03T17:18:44.349846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24948","last_updated":"2026-04-27T05:41:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T15:45:19Z","title":"World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training","version":6},"cited_work":{"arxiv_id":"2509.24948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.24948","snapshot_observed_at":"2026-07-10T08:36:59.803669Z","title":"World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training","venue":"cs.RO","work_id":"e43fb37f-61a0-4911-b5e5-880083d7aa30","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2509.24948","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e7f885a2fe7adc860a0f649eb2627bf35061e570bc6037ef9b9d411eef32ca30","observation_id":"37a32824-084f-4ae0-9251-8509f1759774","resolution":{"observed_at":"2026-07-03T17:18:44.356532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.00406","doi":"10.48550/arxiv.2510.00406","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Vla-rft: Vision- language-action reinforcement fine-tuning with veri- fied rewards in world simulators","venue":null,"work_id":"16edb51b-b4fd-415d-ac17-fa5e8a7462bd","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:0f05e370198ddd294b65cc64730e9e3a4f8655911bf41e7ccb24f3c6fc103ef8","observation_id":"a14210ec-0b4b-4428-9e74-1c03ea1775c2","resolution":{"observed_at":"2026-06-27T04:20:31.969644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06508","last_updated":"2026-05-25T03:56:37Z","snapshot_observed_at":"2026-07-06T22:44:46.690576Z","submitted_at":"2026-02-06T08:57:55Z","title":"World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy","version":2},"cited_work":{"arxiv_id":"2602.06508","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.06508","snapshot_observed_at":"2026-07-04T13:39:50.924111Z","title":"World-vla-loop: Closed-loop learning of video world model and vla policy","venue":"cs.RO","work_id":"f6a38a6e-9674-40a5-a474-1e5bae4c0290","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2602.06508","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e61b40fda4577e32868e7c45beedfffc46a9f6c837468b2060fbf10c6296ec8a","observation_id":"42a2284b-a6ff-432c-b48a-29e11db0b450","resolution":{"observed_at":"2026-07-03T17:18:44.363907Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:fe763e5f897538d056e46759bd9dd9f27445df421ad055ceb90df40db4b3d2b0","observation_id":"a0a980f1-3237-45c4-8161-26e3128bfc6b","resolution":{"observed_at":"2026-07-03T17:18:44.345493Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05863","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:18:44.344125Z","title":"Girgis, R","venue":null,"work_id":"5b03c848-73c6-4cd0-90c9-a6415435adf2","year":2026},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:db9519f1567d6cc37f0556609f6ed2d82354bdd6d591c527f5b997c4b0ee7158","observation_id":"147aa7a5-6fa3-4eb3-8450-7dcb4ca15299","resolution":{"observed_at":"2026-07-03T17:18:44.346116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e3ab06a7835d44d2056aca56db789e2e36bfdcc70aabe4f205647a5bb8e12b6a","observation_id":"db3bbbba-6749-460d-8547-ad2e0bd4c1cb","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":"2009.12293","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-07-10T23:07:48.196994Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","venue":"cs.RO","work_id":"d616d4ba-7713-4e3e-8c9e-dfebbb8f1abf","year":2020},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:2912145a64fffb983388877bfeb0107e218df87aa6c98358b6761bac20f043d9","observation_id":"141e5c11-0b4c-48f0-a59a-2ff7902f225b","resolution":{"observed_at":"2026-07-03T17:28:44.193134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T04:13:22.598591Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:8bd5cfa663d9d90a12df8ed8d19a340020514f324b79f992ef1f200f3dd90433","observation_id":"82e32704-df5a-4e60-b6aa-0260083646b3","resolution":{"observed_at":"2026-06-27T04:13:22.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2025.xxi.017","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T02:04:10.187540Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","venue":null,"work_id":"befe156e-db95-49c6-b167-5202ff6bca27","year":2025},"citing_paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T04:13:22.598591Z"},"links":{"citing_paper":"/paper/2606.20698"},"observation_digest":"sha256:e8921746ff3264f4c2242f8ada4a436d1a0da1f3e06d096f9d280b78bbf0b59f","observation_id":"28bf2df1-fab4-4452-be46-8a37b45d13e1","resolution":{"observed_at":"2026-06-27T04:20:31.963475Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-26T06:30:07.085553+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-12T00:49:14.557114+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T00:49:14.557114+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.20698","last_updated":"2026-06-15T08:58:37Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:55:48.334376Z","submitted_at":"2026-06-15T08:58:37Z","title":"SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":18,"verified_exact":24,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-26T06:30:07.085553+00:00","source":"crossref"},{"observed_at":"2026-07-26T06:30:01.561857+00:00","source":"retraction_watch"}],"thesis":"As of 26 July 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2606.20698."}