{"as_of":"2026-08-14T08:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7340dfd014e829be00a4c83e40190fe9ee61140eddfaefd1a4e6d95015a4bf90","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:20:20.073159Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09762/citation-record","integrity":"/paper/2608.09762/integrity","json":"/paper/2608.09762/citation-record.json","paper":"/paper/2608.09762"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.874750Z","title":"A review of learning-based dynamics models for robotic manipulation |Science Robotics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.874750Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c35926dc2da111fc0582a10f1af09ede774880e49dcf1f1cf3bce97537bfb4ff","observation_id":"7953fa82-b810-499b-bb1c-efcf13a82c01","resolution":{"observed_at":"2026-08-11T11:20:19.874750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.187103Z","title":"Learning Con- tinuous Control Actions for Robotic Grasping with Reinforcement Learning,","venue":null,"work_id":"d563444d-7270-4d52-864d-0717126e5d4b","year":2020},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.881716Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:65e8ecc2769bb0c8ce8b69759081638aa4bab73bfef8f176af720dba4b62e1ec","observation_id":"4f175a95-4231-4d2c-8106-761b11c7705a","resolution":{"observed_at":"2026-08-11T11:20:21.194190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"ument/1038845","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.842549Z","title":"General- Purpose Sim2Real Protocol for Learning Contact-Rich Manipulation With Marker-Based Visuotactile Sensors,","venue":null,"work_id":"20480121-cca2-4f88-9541-9eae54666629","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.889277Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:277d917631f5bdd9744db9a4b3329c1c9869d7b45c3ea56e852150f792165daf","observation_id":"d0cd25a3-7530-46ae-af01-50fc90390d03","resolution":{"observed_at":"2026-08-11T11:20:20.852697Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06342","last_updated":"2026-07-31T11:13:35Z","snapshot_observed_at":"2026-08-07T19:53:51.071043Z","submitted_at":"2025-09-08T05:32:28Z","title":"Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06342","snapshot_observed_at":"2026-08-11T11:20:19.895124Z","title":"Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.895124Z"},"links":{"cited_paper":"/paper/2509.06342","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c909084829134c060ae76839a41ba83c452d593edb7d06a4bc2d2950e2ad0804","observation_id":"3eac9bce-f94b-4229-a64e-e3e40b92467d","resolution":{"observed_at":"2026-08-11T11:20:19.895124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.152926Z","title":"Srl-vic: A variable stiffness-based safe reinforcement learning for contact-rich robotic tasks,","venue":null,"work_id":"08f5a58e-dd53-4b3b-bf00-42d7bf87e25d","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.901989Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:8aed2ecd5370920f0b64c68aac4d65c805a2e1231c34c63a1cc1ab23908c00cd","observation_id":"13405272-286b-4dc9-b277-7b1d07376018","resolution":{"observed_at":"2026-08-11T11:20:21.160147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.907467Z","title":"Deep reinforcement learning for robotics: A survey of real-world successes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.907467Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:10a60bec53b748c1d6fa41d79156f54ec7bd3c5586f1597aabbd838a26afd7f3","observation_id":"95e6ccef-cb1e-475c-8382-cf36fc8ff216","resolution":{"observed_at":"2026-08-11T11:20:19.907467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.114313Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":"7eefdbfd-813b-4255-894c-ecce9985299a","year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.913331Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:70222e71fec57deb9467d281070d73332beb3987b8baff3d8a69a8370942916f","observation_id":"ee437a5f-e70d-4f2a-be11-d2916a6e6eee","resolution":{"observed_at":"2026-08-11T11:20:21.121932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21741","last_updated":"2026-05-05T16:01:35Z","snapshot_observed_at":"2026-07-29T22:30:00.899443Z","submitted_at":"2026-04-23T14:42:54Z","title":"Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21741","snapshot_observed_at":"2026-08-11T11:20:19.919454Z","title":"Hi-wm: Human-in-the-world-model for scalable robot post-training,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.919454Z"},"links":{"cited_paper":"/paper/2604.21741","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:99e37aa6a87f7d68f7f61a364ef8701572ccd4ac00cf6ec3aec5a6a414a6d633","observation_id":"ae2eab6f-486a-4215-bef2-fd81a99c225d","resolution":{"observed_at":"2026-08-11T11:20:19.919454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.924795Z","title":"Rl-100: Performant robotic manipulation with real-world reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.924795Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:ebc1348bbfd2313651e349780c12270a15f385dd81f799cb63b067e8f8858f48","observation_id":"2bab35a4-89e1-4c86-b096-dcf22b84ad41","resolution":{"observed_at":"2026-08-11T11:20:19.924795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.930023Z","title":"Rlinf-user: A unified and extensible system for real-world online policy learning in embodied ai,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.930023Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c0472fb7bf383c229cedb9bbeca6d9ddc990b1e7a32c67978ca3b6bd59e3c2d3","observation_id":"96e95e0a-14ed-41b8-afe7-ff5c1cc4a317","resolution":{"observed_at":"2026-08-11T11:20:19.930023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"ocument/1108004","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.442687Z","title":"Towards Autonomous Reinforcement Learning for Real-World Robotic Manipulation With Large Language Models,","venue":null,"work_id":"16220c35-f72f-48b2-907c-4b303f8b5a36","year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.935620Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c49ad9754eeddb4731ca8a283ab16498cacffe184212c3b3e75e732a0da1222d","observation_id":"dca26e27-0d33-4020-bab7-77c33600fa49","resolution":{"observed_at":"2026-08-11T11:20:20.456064Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.942026Z","title":"Serl: A software suite for sample- efficient robotic reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.942026Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:3b7fa092e39ddad423265e8161e4a716e1ce2471a906e65d0322b431778903ef","observation_id":"d314379b-deee-43a2-aa96-5c385f267da2","resolution":{"observed_at":"2026-08-11T11:20:19.942026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.947525Z","title":"Precise and dexterous robotic manipulation via human-in-the-loop reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.947525Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:7b3a0f3e9da9df4b58e594e72e4933f9d9738da5c3d4b3c425e6a96d18fb16c1","observation_id":"b6fd6e15-207f-490b-b2ad-28e8b8d3db58","resolution":{"observed_at":"2026-08-11T11:20:19.947525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-08-14T01:02:35.686274Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-08-11T11:20:19.953071Z","title":"Vla-rl: Towards masterful and general robotic ma- nipulation with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.953071Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:996f1b5d31714d4f94eea3cb82e85dc207befd2d1a203cb6a36954daed94b5f9","observation_id":"8fe47e55-fee9-49fc-b126-586f27ee244d","resolution":{"observed_at":"2026-08-11T11:20:19.953071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.067538Z","title":"Reinflow: Fine-tuning flow matching policy with online reinforcement learning,","venue":null,"work_id":"f09639fa-774c-44bd-a55d-8a0b883ec1b5","year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.958730Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:a6c69b9d7daed6d125da959364e1b851b4078905111a2c5e8014f77ab3589a78","observation_id":"22e82f08-1792-4285-9c83-703042f22bcf","resolution":{"observed_at":"2026-08-11T11:20:21.073542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.046042Z","title":"Hybrid reward architecture for reinforcement learning,","venue":null,"work_id":"1f112b8a-c7f9-449d-82ee-d7722051089a","year":2017},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.968287Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:4d8498ccb847588ab32993a4330f4c3640c380820c4040243a6a68a4a329936b","observation_id":"61f3d213-e333-428e-8051-c675de64a402","resolution":{"observed_at":"2026-08-11T11:20:21.053010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.974107Z","title":"Efficient online reinforcement learning with offline data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.974107Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:6af7b4a0a9379e4b919917cd96ea38a87107aeb2d176b959d15e9432e7cf9ffc","observation_id":"0142220e-b7b5-49fc-8fe4-3080dc7f2d20","resolution":{"observed_at":"2026-08-11T11:20:19.974107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.04143","last_updated":"2024-05-03T15:00:50Z","snapshot_observed_at":"2026-08-06T01:36:48.822991Z","submitted_at":"2015-11-13T02:34:33Z","title":"Deep Reinforcement Learning in Parameterized Action Space","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.04143","snapshot_observed_at":"2026-08-11T11:20:19.980036Z","title":"Deep reinforcement learning in param- eterized action space,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.980036Z"},"links":{"cited_paper":"/paper/1511.04143","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:443826e1f69b81d4c55842a650d17d3a84f0d2768f55453d9f7faf809cfb7c1d","observation_id":"df969530-88a0-45bf-8ae8-eb2b1f682f6d","resolution":{"observed_at":"2026-08-11T11:20:19.980036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.06394","last_updated":"2018-10-10T07:38:44Z","snapshot_observed_at":"2026-08-09T23:24:18.245888Z","submitted_at":"2018-10-10T07:38:44Z","title":"Parametrized Deep Q-Networks Learning: Reinforcement Learning with Discrete-Continuous Hybrid Action Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.06394","snapshot_observed_at":"2026-08-11T11:20:19.985496Z","title":"Parametrized deep q-networks learning: Reinforcement learning with discrete-continuous hybrid action space,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.985496Z"},"links":{"cited_paper":"/paper/1810.06394","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:bd3bc6660c36a84f76c3da9b46c254f327bfc1aada171c24ab4743455ce7d35c","observation_id":"f8be1923-6991-4df6-864a-890db2122199","resolution":{"observed_at":"2026-08-11T11:20:19.985496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.04388","last_updated":"2019-05-10T21:57:41Z","snapshot_observed_at":"2026-08-12T10:23:58.123555Z","submitted_at":"2019-05-10T21:57:41Z","title":"Multi-Pass Q-Networks for Deep Reinforcement Learning with Parameterised Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.04388","snapshot_observed_at":"2026-08-11T11:20:19.998476Z","title":"Multi-pass q-networks for deep reinforcement learning with parameterised action spaces,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.998476Z"},"links":{"cited_paper":"/paper/1905.04388","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:74f1a4beea76b1b19d277b34afbbf45ab20c15359599edf2b998123269f58f81","observation_id":"fe4d146d-8b36-413d-9a1c-539d15bd0047","resolution":{"observed_at":"2026-08-11T11:20:19.998476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.006679Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.006679Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:2a69748c27e2cd9c9d18e3d2ee8d3f1e3271e488afbde37e32af2e9675a512fd","observation_id":"8a078d8e-7ac0-4a00-8fc4-eb2c7f5db353","resolution":{"observed_at":"2026-08-11T11:20:20.006679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.012254Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.012254Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:3f2ca15f477e145e1200486ef2c4aa55e48e8f4d4fae6807a632aadefb75104c","observation_id":"36ffc7a6-71f5-4857-84c9-17b733237f35","resolution":{"observed_at":"2026-08-11T11:20:20.012254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.975570Z","title":"Asynchronous actor-critic for multi-agent reinforcement learning,","venue":null,"work_id":"750872f4-63eb-479a-88b9-d3a3d91889cc","year":2022},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.021539Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:e316fbc819bf4c890f1fa2f5cc5de61204d4ff1748e1d94514551674d9d0bd5c","observation_id":"55b51ff4-6707-4e05-9489-6b5836aefa71","resolution":{"observed_at":"2026-08-11T11:20:20.985986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.950617Z","title":"Action decoupled sac reinforcement learning with discrete-continuous hybrid action spaces,","venue":null,"work_id":"9b94e96a-79c6-461b-9652-e3b278875f3b","year":2023},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.027981Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:af3cf50218716d405f4141d89ea3543d171686a827c9281d73a75304d7be8ebf","observation_id":"5d5e5942-bb6d-414a-812b-bd687254c0a5","resolution":{"observed_at":"2026-08-11T11:20:20.956233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.928325Z","title":"Effective multi-agent deep reinforcement learning control with relative entropy regularization,","venue":null,"work_id":"3005ecbf-b1b1-42a8-99cb-ba46ab7c852d","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.036886Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:168ec77def0d68c0c44b8439293d2a1a45914fd4a4563827ecefd251cc53f0a7","observation_id":"83659ad8-fe57-4c94-b34d-b03c64bccc8a","resolution":{"observed_at":"2026-08-11T11:20:20.934523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-11T11:20:20.042024Z","title":"Soft actor-critic algorithms and applications. arxiv 2018,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.042024Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:ffa226a00067096895e8606755e0d2cef1a984c4225ddf31965ec3b29f01cab4","observation_id":"e5eeae7a-6621-4cf4-a573-156865f8c01e","resolution":{"observed_at":"2026-08-11T11:20:20.042024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.048651Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.048651Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:80a1c0b872eeeea48f0c0d4e7e99f88eb62e8fbd1a3811f14277a45c897363a8","observation_id":"f2cabc70-02ae-44eb-b8ae-be067ec5d036","resolution":{"observed_at":"2026-08-11T11:20:20.048651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-12T22:51:14.103500Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-11T11:20:20.055396Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.055396Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:116aa32788f57c4101f74ea5b8cf1131a6d19792a8a64d4509994e8db660c64a","observation_id":"5074cb71-2bf8-4341-9c92-132d71c9fe2e","resolution":{"observed_at":"2026-08-11T11:20:20.055396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-14T00:35:36.804755Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-11T11:20:20.061953Z","title":"Soft actor-critic for discrete action settings,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.061953Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:f21325f2190359e1da0a11e7f4f18f1fbf1c22aa8a1fbd9c939f74f6577be5db","observation_id":"641735f2-9b57-48e6-98be-efa0f519e538","resolution":{"observed_at":"2026-08-11T11:20:20.061953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.887977Z","title":"A high-force gripper with embedded multimodal sensing for powerful and perception driven grasping,","venue":null,"work_id":"4056cf81-b70d-445d-8094-0988fa4a7436","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.067472Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:65bbe3190a26908226da6734a7b87c467de64e30af36f5169b0e7a683649fc31","observation_id":"c43875eb-ce6b-4761-a192-06de815cc0a2","resolution":{"observed_at":"2026-08-11T11:20:20.894818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.073159Z","title":"Root mean square layer normalization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.073159Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:7eab118824526da1c74b23262bc5bbebe32d1b667208b5906766490a2abdca2f","observation_id":"80032bd8-1fab-403b-ad4b-09aa3173a7e7","resolution":{"observed_at":"2026-08-11T11:20:20.073159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T01:56:11.945001Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2608.09762."}