{"as_of":"2026-08-11T16:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34e83bab3a05ecffd5e3a179b9b1194fecd5361143b331042eeb44c4447f7d0b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:08:52.326582Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T19:17:31.652311Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-06T21:08:52.326582Z","title":"Visual imitation enables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00917","last_updated":"2025-09-03T01:44:58Z","snapshot_observed_at":"2026-08-06T21:00:05.983801Z","submitted_at":"2025-07-01T16:23:00Z","title":"A Survey: Learning Embodied Intelligence from Physical Simulators and World Models","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:08:52.326582Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2507.00917"},"observation_digest":"sha256:8e46cfd26c80f0b49e564f3540ee8a2319539501e167b2ac6847558fece757c5","observation_id":"aa1cd01d-0375-472e-9bb1-feb1f80108c6","resolution":{"observed_at":"2026-08-06T21:08:52.326582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-06T17:12:19.870933Z","title":"Visual imitation enables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11498","last_updated":"2026-07-13T20:22:43Z","snapshot_observed_at":"2026-08-09T22:48:04.473955Z","submitted_at":"2025-07-15T17:16:50Z","title":"Robot Drummer: Learning Rhythmic Skills for Humanoid Drumming","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:12:19.870933Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2507.11498"},"observation_digest":"sha256:ebcc5e3ec93d88a094c84ff14621e6c8a01b138b5297ea23263bd3ae693f32ea","observation_id":"61c4442d-c472-414d-9a83-b413d0b9eebc","resolution":{"observed_at":"2026-08-06T17:12:19.870933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-06T13:07:09.563148Z","title":"Visual imitation enables contextual humanoid control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21053","last_updated":"2025-08-01T13:04:28Z","snapshot_observed_at":"2026-08-07T22:31:18.221722Z","submitted_at":"2025-07-28T17:59:57Z","title":"Flow Matching Policy Gradients","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:07:09.563148Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2507.21053"},"observation_digest":"sha256:cfd35c670f3b5791fdab018250750c85dd80205baba0b3abdad246c4aacaa26b","observation_id":"3e435712-f0cc-4ace-a2c4-196104c75814","resolution":{"observed_at":"2026-08-06T13:07:09.563148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-05T15:20:20.775918Z","title":"Visual imitation enables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20085","last_updated":"2025-08-31T06:47:56Z","snapshot_observed_at":"2026-08-06T13:04:42.910229Z","submitted_at":"2025-08-27T17:53:46Z","title":"HERMES: Human-to-Robot Embodied Learning from Multi-Source Motion Data for Mobile Dexterous Manipulation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T15:20:20.775918Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2508.20085"},"observation_digest":"sha256:53dafec562499798dbdbe1f8941eeb893582fc9893e6bc664e012fb046f71c62","observation_id":"a83cc95a-8ef8-4a98-a707-942c380827a6","resolution":{"observed_at":"2026-08-05T15:20:20.775918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-04T16:18:01.315054Z","title":"Visual imitation en- ables contextual humanoid control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.15443","last_updated":"2026-06-30T11:39:23Z","snapshot_observed_at":"2026-08-05T20:13:16.310493Z","submitted_at":"2025-09-18T21:34:02Z","title":"A Scalable Whole-body Motion Transfer via Implicit Kinodynamic Motion Retargeting","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T16:18:01.315054Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2509.15443"},"observation_digest":"sha256:7dd55c012964d9c24813f83282533f9a9002a6537ddfc41d0ac7724804d9aed2","observation_id":"0a15d454-bd18-4978-8cea-b9eab3a82a7d","resolution":{"observed_at":"2026-08-04T16:18:01.315054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-04T11:03:09.602028Z","title":"Visual imitation en- ables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07152","last_updated":"2026-08-03T09:26:59Z","snapshot_observed_at":"2026-08-10T12:43:40.212192Z","submitted_at":"2025-10-08T15:51:36Z","title":"DPL: Depth-only Perceptive Humanoid Locomotion via Realistic Depth Synthesis and Cross-Attention Terrain Reconstruction","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T11:03:09.602028Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2510.07152"},"observation_digest":"sha256:3c150bff8d202575cbf5807db1f4def945dfa7d1105b57c0d038bc09d93a3de3","observation_id":"3e4a7f56-62af-4e0f-b593-503ef742488a","resolution":{"observed_at":"2026-08-04T11:03:09.602028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-04T09:31:07.696816Z","title":"Visual imitation en- ables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14959","last_updated":"2026-06-22T08:18:39Z","snapshot_observed_at":"2026-08-08T11:10:51.233406Z","submitted_at":"2025-10-16T17:58:58Z","title":"CBF-RL: Safety Filtering Reinforcement Learning in Training with Control Barrier Functions","version":6},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:31:07.696816Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2510.14959"},"observation_digest":"sha256:8ff23e251c4a9e46fe1c51e1572b8f6b1b5e8b641139923c0fc63a1fdc327630","observation_id":"b325aa06-4635-487c-9a73-0ab455ac7579","resolution":{"observed_at":"2026-08-04T09:31:07.696816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-04T07:20:59.448129Z","title":"Visual imitation enables contextual humanoid control.arXiv preprint arXiv:2505.03729,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.26236","last_updated":"2026-06-04T17:11:03Z","snapshot_observed_at":"2026-08-10T10:56:18.311748Z","submitted_at":"2025-10-30T08:13:12Z","title":"PHUMA: Physically Reliable Humanoid Locomotion Dataset","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T07:20:59.448129Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2510.26236"},"observation_digest":"sha256:d352cab7a174423664522f18bf979a16fe40c2bad89de29952e42f61f4e77a46","observation_id":"61b4425a-d8a0-4d5b-b680-7789eb07d1f6","resolution":{"observed_at":"2026-08-04T07:20:59.448129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-04T07:18:34.133545Z","title":"Visual imitation enables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26280","last_updated":"2026-07-07T09:15:31Z","snapshot_observed_at":"2026-08-09T14:37:02.150339Z","submitted_at":"2025-10-30T09:06:26Z","title":"Thor: Towards Human-Level Whole-Body Reactions for Intense Contact-Rich Environments","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T07:18:34.133545Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2510.26280"},"observation_digest":"sha256:9cd10eb3f25d4504a77425ffe418a725508048eda3a6a3af4347eccd8f34d525","observation_id":"aa882e5a-0b18-4244-aaa9-341af40541a7","resolution":{"observed_at":"2026-08-04T07:18:34.133545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2602.03205","last_updated":"2026-05-21T06:49:30Z","snapshot_observed_at":"2026-07-06T22:44:18.875334Z","submitted_at":"2026-02-03T07:18:01Z","title":"HUSKY: Humanoid Skateboarding System via Physics-Aware Whole-Body Control","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T11:19:59.106457Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2602.03205"},"observation_digest":"sha256:70d6682f2a7abdb19cac26c23156c9974f4b6567ebb76471dae58809b58b7138","observation_id":"27f0f430-1033-4bd0-bf9b-a779dc611cc2","resolution":{"observed_at":"2026-05-22T11:21:28.608507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-03T03:56:47.131305Z","title":"M., Darrell, T., Abbeel, P., Malik, J., and Kanazawa, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06508","last_updated":"2026-05-25T03:56:37Z","snapshot_observed_at":"2026-08-03T03:56:46.452714Z","submitted_at":"2026-02-06T08:57:55Z","title":"World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T03:56:47.131305Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2602.06508"},"observation_digest":"sha256:8f802b4b3b9e78d56aeaebae77d597c47fa48c50b2e2524263725ff756bec4e7","observation_id":"f520d1dc-0d79-442a-9506-eba881356058","resolution":{"observed_at":"2026-08-03T03:56:47.131305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-03T03:51:43.908539Z","title":"Visual imitation enables contextual humanoid control.arXiv preprint arXiv:2505.03729, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06868","last_updated":"2026-06-10T12:12:23Z","snapshot_observed_at":"2026-08-06T08:39:46.424745Z","submitted_at":"2026-02-06T16:55:10Z","title":"Consensus-based optimization (CBO): Towards Global Optimality in Robotics","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T03:51:43.908539Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2602.06868"},"observation_digest":"sha256:f1e24fe92e52509f75eb7db4667d9ec9ba994c00bc1ab3a80d91b91d213bbccf","observation_id":"b3d9230f-1dbe-46f2-b32b-80a866925768","resolution":{"observed_at":"2026-08-03T03:51:43.908539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-15T12:10:54.741769Z","title":"Allshire, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.09170","last_updated":"2026-06-24T04:09:53Z","snapshot_observed_at":"2026-07-15T12:10:52.932866Z","submitted_at":"2026-03-10T04:19:43Z","title":"ZeroWBC: Learning Natural Whole-Body Humanoid Interaction from Human Egocentric Data","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-15T12:10:54.741769Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2603.09170"},"observation_digest":"sha256:0a34f6cf6d08106c4335f6f10d9c6c484c7b4a93b62e7120e5ca120cf79d0036","observation_id":"d0348efc-9e91-4dec-ba3b-a13b55a74913","resolution":{"observed_at":"2026-07-15T12:10:54.741769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2604.27711","last_updated":"2026-04-30T10:57:29Z","snapshot_observed_at":"2026-08-10T22:40:11.759409Z","submitted_at":"2026-04-30T10:57:29Z","title":"ExoActor: Exocentric Video Generation as Generalizable Interactive Humanoid Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T06:24:47.014162Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2604.27711"},"observation_digest":"sha256:5dac485667219c73cc830e7cb8393a5139a8ecc2647d44bff9d3325f1c8e1dab","observation_id":"3c6c20ff-c59d-4126-a188-b15cae2a9d75","resolution":{"observed_at":"2026-05-12T10:21:30.387135Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2605.15517","last_updated":"2026-05-15T01:27:50Z","snapshot_observed_at":"2026-07-06T23:26:46.595393Z","submitted_at":"2026-05-15T01:27:50Z","title":"Terrain Consistent Reference-Guided RL for Humanoid Navigation Autonomy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T15:22:38.188537Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2605.15517"},"observation_digest":"sha256:b555eb7ed0fe3c3eb283b13c160ff46e27c94a9b292219d37603cbe924e32e81","observation_id":"b37764b6-0c66-4551-95b1-46e6839c3884","resolution":{"observed_at":"2026-05-19T15:23:07.718385Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2605.22272","last_updated":"2026-05-22T04:19:09Z","snapshot_observed_at":"2026-08-04T09:27:20.587065Z","submitted_at":"2026-05-21T10:15:39Z","title":"Imagine2Real: Towards Zero-shot Humanoid-Object Interaction via Video Generative Priors","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-25T05:59:52.760486Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2605.22272"},"observation_digest":"sha256:cf13b519994a7ff913f5ce88f2d1054106574fb2ccf84f7975a075429b151493","observation_id":"cfa86cec-1fa0-4ad5-a46f-e4a04cff3b0e","resolution":{"observed_at":"2026-05-25T06:00:23.030217Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2606.00252","last_updated":"2026-05-29T18:33:32Z","snapshot_observed_at":"2026-08-11T09:47:40.145060Z","submitted_at":"2026-05-29T18:33:32Z","title":"HOIST: Humanoid Optimization with Imitation and Sample-efficient Tuning for Manipulating Suspended Loads","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T22:04:27.322867Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2606.00252"},"observation_digest":"sha256:3be4c62f1d004c0ef464c450bea791dcbb174071bd68609833f9dde973464b2b","observation_id":"e602c601-f916-4918-a916-57ae18887fe9","resolution":{"observed_at":"2026-07-01T19:46:10.801741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2606.05160","last_updated":"2026-06-03T17:57:45Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-06-03T17:57:45Z","title":"GRAIL: Generating Humanoid Loco-Manipulation from 3D Assets and Video Priors","version":1},"reference_index":147,"source":"arxiv_source","source_observed_at":"2026-06-28T05:42:54.919041Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2606.05160"},"observation_digest":"sha256:876a779acdbbf40566411d3432d17c47e1555fce7f84acdf1e76ccbdaf115cda","observation_id":"1ac6036a-9685-4d34-92c8-24ca05863d9d","resolution":{"observed_at":"2026-07-02T08:46:49.227214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2606.24448","last_updated":"2026-06-23T11:35:13Z","snapshot_observed_at":"2026-08-03T06:59:21.107836Z","submitted_at":"2026-06-23T11:35:13Z","title":"Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-25T23:57:48.395172Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2606.24448"},"observation_digest":"sha256:3e8cd449d267b1221de4039816564cb149331705da5d959b5376c423faff210d","observation_id":"e1990fc5-90ca-46a0-80a1-fb0d32a0f32c","resolution":{"observed_at":"2026-07-04T17:09:58.425773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2606.26215","last_updated":"2026-06-24T17:56:30Z","snapshot_observed_at":"2026-08-03T02:40:55.694894Z","submitted_at":"2026-06-24T17:56:30Z","title":"TaskNPoint: How to Teach Your Humanoid to Hit a Backhand in Minutes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T01:57:35.170470Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2606.26215"},"observation_digest":"sha256:4355d304385dd6df16900acc917f8be7d5895fcbecd9947abae68c50cc5b7cab","observation_id":"5a16ea35-a9dc-4ded-bfda-7a73ee4d37e2","resolution":{"observed_at":"2026-07-04T14:59:55.826734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2607.07370","last_updated":"2026-07-09T06:14:09Z","snapshot_observed_at":"2026-08-10T01:44:34.986429Z","submitted_at":"2026-07-08T13:04:07Z","title":"Behavior Foundations for Quadruped Robots: ABot-C0 Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T13:04:46.873048Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.07370"},"observation_digest":"sha256:b55e653b380e29c8b0fad88398a305af50f29261dd732659bda397ed22d0cd9b","observation_id":"e64058d0-2225-468e-9bb1-37cc91b0c480","resolution":{"observed_at":"2026-07-09T13:06:15.337291Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2607.07370","last_updated":"2026-07-09T06:14:09Z","snapshot_observed_at":"2026-08-10T01:44:34.986429Z","submitted_at":"2026-07-08T13:04:07Z","title":"Behavior Foundations for Quadruped Robots: ABot-C0 Technical Report","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T19:10:58.614932Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.07370"},"observation_digest":"sha256:fc6023ef100e323ce15937f02003f7d0329fec2db1edd88badc75aece413982c","observation_id":"e0875bc0-1b79-40aa-91dc-8b08c5039a94","resolution":{"observed_at":"2026-07-10T19:17:31.654123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":"2505.03729","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-10T19:17:31.652311Z","title":"Visual imitation enables contextual humanoid control","venue":"cs.RO","work_id":"fb68555a-45e7-4e7d-8db3-63b597b81bff","year":2025},"citing_paper":{"arxiv_id":"2607.08742","last_updated":"2026-07-09T17:42:15Z","snapshot_observed_at":"2026-08-06T16:55:18.358869Z","submitted_at":"2026-07-09T17:42:15Z","title":"ContactMimic: Humanoid Object Interaction via Contact Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T02:11:02.007137Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.08742"},"observation_digest":"sha256:3911fd7a173fa4f9a1397bd8cece069c0e75ceae9e46b1e0e6be4160c4cca90a","observation_id":"1a68febf-4d8d-4d20-8a1a-519bf2e2e6a6","resolution":{"observed_at":"2026-07-10T02:16:42.519845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-01T12:35:13.520439Z","title":"arXiv preprint arXiv:2505.03729 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19517","last_updated":"2026-07-21T19:03:10Z","snapshot_observed_at":"2026-08-03T12:40:13.155308Z","submitted_at":"2026-07-21T19:03:10Z","title":"Crowd4D: Scene-Aware Monocular 4D Crowd Reconstruction","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T12:35:13.520439Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.19517"},"observation_digest":"sha256:188dfd5e7f2cadc3c07e6bcf852ca65aab681c5c98d4d35593e7501cc4bf5c2c","observation_id":"2f5bbc0a-a14b-4a96-989d-fe45451af351","resolution":{"observed_at":"2026-08-01T12:35:13.520439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-08-01T10:49:01.309464Z","title":"Visual imitation enables contextual humanoid control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20110","last_updated":"2026-07-22T13:10:22Z","snapshot_observed_at":"2026-08-11T09:44:05.913828Z","submitted_at":"2026-07-22T13:10:22Z","title":"Extreme-RGMT: Continual Learning of Highly Dynamic Skills for Robust Generalist Humanoid Control","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T10:49:01.309464Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.20110"},"observation_digest":"sha256:fa8ecef2d27c6c02f603d033d7e97ce6d6cde8c197ff57dd29a7cbc4ac2706f2","observation_id":"8a22751b-bc14-4c0a-b667-c0b0fbbe8596","resolution":{"observed_at":"2026-08-01T10:49:01.309464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03729","snapshot_observed_at":"2026-07-31T01:50:30.587938Z","title":"Visual imitation enables contextual humanoid control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28624","last_updated":"2026-07-30T17:59:46Z","snapshot_observed_at":"2026-08-06T18:18:01.456837Z","submitted_at":"2026-07-30T17:59:46Z","title":"PhiZero: A World Model Built Around Physical Language","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T01:50:30.587938Z"},"links":{"cited_paper":"/paper/2505.03729","citing_paper":"/paper/2607.28624"},"observation_digest":"sha256:4e9ee5e5977352532a60f76dee76a5077d73c5962427d74f4b6d180653ab306f","observation_id":"2b22767d-f67a-4c3d-921f-6a4c401341fe","resolution":{"observed_at":"2026-07-31T01:50:30.587938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03729/citation-record","integrity":"/paper/2505.03729/integrity","json":"/paper/2505.03729/citation-record.json","paper":"/paper/2505.03729"},"outbound":[],"paper":{"arxiv_id":"2505.03729","last_updated":"2025-08-29T05:22:52Z","latest_version":5,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-11T00:04:22.977278Z","submitted_at":"2025-05-06T17:57:12Z","title":"Visual Imitation Enables Contextual Humanoid Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2505.03729."}