Pith. sign in

Paper Citation Record · LEDGER

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

As of 6 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 2 inbound Pith citation observations for arXiv:2603.13707.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.13707 v3

Coverage vector

measured 37 of 37 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:15:50.566587Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-27T09:27:43.453005Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T19:40:06.781891Z

Reference resolution

37 of 37 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e6b7662f-cde7-401e-9e3a-835639d176c8 · outbound

This paper cites Tai- loring solution accuracy for fast whole-body model predictive control of legged robots,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Tai- loring solution accuracy for fast whole-body model predictive control of legged robots,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.683331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.683331Z digest=sha256:196145277564b10ee5779f65c16639cadca60bd900d269a61f209c36bf3ce7f8

Observation cb16dc8d-5e96-4cbc-976b-0b522170c050 · outbound

This paper cites Seec: Stable end- effector control with model-enhanced residual learning for humanoid loco-manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Seec: Stable end- effector control with model-enhanced residual learning for humanoid loco-manipulation,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.732651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.732651Z digest=sha256:a6ceb59f54596608203ab108d42a31e54fa5fd1373e217d638acae72b06f4188

Observation 2295d57f-360b-4992-a9d3-82cd7fa09cb2 · outbound

This paper cites Omnih2o: Universal and dexterous human-to-humanoid whole-body teleoperation and learning.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Omnih2o: Universal and dexterous human-to-humanoid whole-body teleoperation and learning

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.790300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.790300Z digest=sha256:ef81af9453ea10c20b36f6117dc1f1d161a30c12284718d735c40d3216c00c36

Observation 84b3c53a-dbff-4d45-9410-8d34a65a5fb3 · outbound

This paper cites Humanplus: Hu- manoid shadowing and imitation from humans,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Humanplus: Hu- manoid shadowing and imitation from humans,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.842412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.842412Z digest=sha256:109b20d4e99ba9ddae556fda79f7c97af61ab571e113a6e855dcb480cf78738a

Observation edd77b51-2099-48ca-a89d-46c35361b14d · outbound

This paper cites Diffusion policy: Visuomotor policy learning via action diffusion,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Diffusion policy: Visuomotor policy learning via action diffusion,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.914916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.914916Z digest=sha256:a58ae1e0a28c0209487b003db21b5c20394583da1553e50bc5d4d79e7dfc6bf8

Observation 7d07d19c-11c7-4a8e-a39e-c1fab143f97c · outbound

This paper cites Diffusion policy policy optimization,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Diffusion policy policy optimization,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:46.991325Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:46.991325Z digest=sha256:450ba178be23f85abc7361b392e2a04809bde4b4f67ea5f17f9ae412d178b869

Observation 07be161b-a45e-434d-99a7-ae6c5e9fdf43 · outbound

This paper cites Ppf: Pre-training and preservative fine-tuning of humanoid locomotion via model-assumption- based regularization,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Ppf: Pre-training and preservative fine-tuning of humanoid locomotion via model-assumption- based regularization,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.147433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.147433Z digest=sha256:be2cf373c8abcc532e2ce5294b6bbb572c7a56b3b3cc34fd7b11b70d4eab7a80

Observation 47997f94-1242-468f-a641-6d34497aa582 · outbound

This paper cites Humanoid locomotion and manipulation: Current progress and challenges in control, planning, and learning,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Humanoid locomotion and manipulation: Current progress and challenges in control, planning, and learning,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.274577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.274577Z digest=sha256:266e7c051977d54e0233b640b2a9302413750ddab0d62539bad63178329be4e0

Observation a9a935df-5963-4bfc-951e-ffd88bd011e3 · outbound

This paper cites Twist2: Scalable, portable, and holistic humanoid data collection system,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Twist2: Scalable, portable, and holistic humanoid data collection system,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.413631Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.413631Z digest=sha256:798191c91ff3e3f106e922d998f9dada2f85e22227fe6bcefa31a9d5450612e6

Observation 7ca0f4b8-9443-4b8f-8845-4eded4a28ad2 · outbound

This paper cites Falcon: Learning force-adaptive humanoid loco- manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Falcon: Learning force-adaptive humanoid loco- manipulation,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.556653Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.556653Z digest=sha256:bca788f261b0e5a22bdc003bc55a3b64e60fc6838a5b456509bc0ead100ab2c7

Observation 32751e62-7876-4883-b9af-9eee0fad104d · outbound

This paper cites Mobile-TeleVision: Predictive Motion Priors for Humanoid Whole-Body Control.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Mobile-TeleVision: Predictive Motion Priors for Humanoid Whole-Body Control

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.698722Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.698722Z digest=sha256:31888740f42205b27575dbaec84d0ddbb9b7084d756831f96e92f3f5932a0727

Observation dca8669d-b1e6-4fca-9040-c7b2c8ed063b · outbound

This paper cites HOMIE: Humanoid Loco-Manipulation with Isomorphic Exoskeleton Cockpit,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning HOMIE: Humanoid Loco-Manipulation with Isomorphic Exoskeleton Cockpit,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.782052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.782052Z digest=sha256:ccc6a31313f31579eefcfa94879ed46578fb90fca36de69bb1008f1628af1fa9

Observation 5f0f052b-fb0e-4015-b6f2-5ba8b3f8715f · outbound

This paper cites Wococo: Learning whole-body humanoid control with sequential contacts,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Wococo: Learning whole-body humanoid control with sequential contacts,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.894940Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.894940Z digest=sha256:6747868e303d7b2dfbcd6ce6ac3e27b9eb5a8799aafcf2b3c10831e77adcd08d

Observation 65a300ab-954f-470b-a9bf-cfa9e50c9245 · outbound

This paper cites Curiosity-driven learning of joint locomotion and manipulation tasks,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Curiosity-driven learning of joint locomotion and manipulation tasks,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:47.969528Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:47.969528Z digest=sha256:2c93de025c0f60f6f1fe0d94aff2112f1a682031f87fc88dcf208232afac1117

Observation 9670c6cc-c8b7-4d52-840a-2308ebb17a2d · outbound

This paper cites Learning agile soccer skills for a bipedal robot with deep reinforcement learning,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Learning agile soccer skills for a bipedal robot with deep reinforcement learning,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.052472Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.052472Z digest=sha256:fe81e117f133ea6a0a8403693496dd974eaf313f1f07898999446ee9a89e3fbb

Observation 4ede54d1-788d-4f23-ae2f-730e90754b08 · outbound

This paper cites Opening the sim-to-real door for humanoid pixel-to- action policy transfer,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Opening the sim-to-real door for humanoid pixel-to- action policy transfer,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.158430Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.158430Z digest=sha256:7e58e8ad54c25de467d94dfeff61ca5dd99c05b3fad949301e1077f52faff64d

Observation ad6f6515-edfb-4643-b4e8-bb7021c761e3 · outbound

This paper cites Sim-to-real learning for humanoid box loco-manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Sim-to-real learning for humanoid box loco-manipulation,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.240523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.240523Z digest=sha256:eb76ec48f7ec362ff6b0107068f717ca3904cba27100d55ebb58e02a35496c68

Observation cda389a6-1076-4912-a836-ce51652aa1ef · outbound

This paper cites Opt2skill: Imitating dynamically-feasible whole-body trajectories for versatile humanoid loco-manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Opt2skill: Imitating dynamically-feasible whole-body trajectories for versatile humanoid loco-manipulation,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.351210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.351210Z digest=sha256:f86bf64ad2c2e6194020c20afe21db10f93bcfc1db053b3b7c58ef55ad641684

Observation 5d206791-09fb-47d7-b75b-c5e671578c54 · outbound

This paper cites Hier- archical planning and control for box loco-manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Hier- archical planning and control for box loco-manipulation,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.460920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.460920Z digest=sha256:ac7abef99280f13b17d061c26614d272e1c389461e52104acff7c1ec29b9cfed

Observation 5673059d-8830-4ad6-9cf8-3cadadb9e32b · outbound

This paper cites Learning fine-grained bimanual manipulation with low-cost hardware,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Learning fine-grained bimanual manipulation with low-cost hardware,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.602126Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.602126Z digest=sha256:cd9cced18de3134dd660adc371044128944eddfb475b8fad95248a9aacb2f950

Observation f72cddf3-1bdd-4d01-a9ab-da6283afaff1 · outbound

This paper cites Visualmimic: Visual humanoid loco-manipulation via motion tracking and generation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Visualmimic: Visual humanoid loco-manipulation via motion tracking and generation,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.703596Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.703596Z digest=sha256:120d7f585644c165315298c15822b3414987ccc7479eafdda0d4223413f78169

Observation b0343bb9-65fe-4e55-b041-d126507fe94e · outbound

This paper cites Hdmi: Learning interactive humanoid whole-body control from human videos,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Hdmi: Learning interactive humanoid whole-body control from human videos,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.879849Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.879849Z digest=sha256:733416665431d849b5834a68f3bc1ef10264dd60094fe494b0500f3d0ed27822

Observation 305bb488-6dba-4fc5-b99a-b45adbe7e23e · outbound

This paper cites From imitation to refinement – residual rl for precise assembly,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning From imitation to refinement – residual rl for precise assembly,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:48.992696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:48.992696Z digest=sha256:e662174a2caaeb45f8c3d1e2a3797fbe372d66906a1e124cd523fcab5ee077fe

Observation db184c3c-63c1-4d1c-a119-5f2ecc1f6247 · outbound

This paper cites Rfs: Reinforce- ment learning with residual flow steering for dexterous manipulation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Rfs: Reinforce- ment learning with residual flow steering for dexterous manipulation,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.131081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.131081Z digest=sha256:5b300faac73508edb4a2e31fcb2fc63ca5c95a54eed0e1012888faf07e269ef2

Observation 2b63d6d6-8220-4e3e-b889-07204454c797 · outbound

This paper cites Residual off-policy rl for finetuning behavior cloning policies,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Residual off-policy rl for finetuning behavior cloning policies,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.220783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.220783Z digest=sha256:11b199408184adaa764a2c4b2dd4f9cdb4c3d64c44c9cf058a0aba7b71f35def

Observation ba798607-ea78-49cd-8cab-0fc7deef9f1d · outbound

This paper cites Proximal Policy Optimization Algorithms.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.360402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.360402Z digest=sha256:c3addae574351276bf1777ff0df13c15a3095989a07d81942a8160e5b37e575c

Observation a74d813b-ea64-4e86-8bcb-913bf209e99a · outbound

This paper cites Efficient online reinforcement learning for diffusion policy,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Efficient online reinforcement learning for diffusion policy,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.499122Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.499122Z digest=sha256:1a7a20cfc4b2b015b4346bdf33aa3459fc5517bea71b7a6399039b7ce40f2e64

Observation 2d72b892-502b-4cf9-859d-f9f25451a1e1 · outbound

This paper cites π RL: Online rl fine-tuning for flow-based vision- language-action models,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning π RL: Online rl fine-tuning for flow-based vision- language-action models,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.582649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.582649Z digest=sha256:315fa9bf120b92fc63d25a70a9fba5f48d184675f6de919feb77a2e61737e560

Observation 71651857-4908-47c2-b5e4-35b53fd4ce40 · outbound

This paper cites Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.694818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.694818Z digest=sha256:b2760afa6fedaf6267d2401d8ce350835e9a3f5e6c99a6741be1e4244846ec22

Observation c50a1bac-1116-4886-b20a-53a708757a20 · outbound

This paper cites BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.743659Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.743659Z digest=sha256:f032666d70d5bf7d9f4d60df12e5a935ff788bbf613dfe6b0dd8410cff6bc300

Observation 6331e3f7-12eb-42d1-bd60-c692afb82ef9 · outbound

This paper cites Re- inforcement learning-based footstep control for humanoid robots on complex terrain,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Re- inforcement learning-based footstep control for humanoid robots on complex terrain,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.850902Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.850902Z digest=sha256:6fc1d7381b692558563594534d226dd516994f9320c62e59a983a1a92682ba49

Observation 9a56f533-4561-4441-948a-38df0a363957 · outbound

This paper cites Deepmimic: example-guided deep reinforcement learning of physics-based character skills,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Deepmimic: example-guided deep reinforcement learning of physics-based character skills,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:49.972201Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:49.972201Z digest=sha256:bd437f0afbc50e7a3d4415d7e498c3b704cc957640dd0b9d7bb6f8e9fa29a9e5

Observation 9b0f6f8a-4800-4fe7-bcaf-7c045b10541a · outbound

This paper cites Denoising diffusion probabilistic models,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Denoising diffusion probabilistic models,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:50.018839Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:50.018839Z digest=sha256:e8ef111e45de4bac69a3a451308c289a49e662fac7cfd4c656774829da1106b1

Observation e83cbd15-2b66-4150-b438-78460c0ee39d · outbound

This paper cites High- dimensional continuous control using generalized advantage estimation,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning High- dimensional continuous control using generalized advantage estimation,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:50.103256Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:50.103256Z digest=sha256:c3c57dc99e4863fec855accef2472f6fc7e6da6ad0afc66a9868910936cda3d9

Observation 8284605d-37e2-41f7-ad39-7cd5e70c5cb0 · outbound

This paper cites Improved Denoising Diffusion Proba- bilistic Models,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Improved Denoising Diffusion Proba- bilistic Models,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:50.196798Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:50.196798Z digest=sha256:da8634ae246645a0ab81d4ae2b9342b18f51a5bde9709962cdff7405ffa2eff4

Observation 00433e31-41fc-4383-aaae-c9853f160f01 · outbound

This paper cites Stageact: Stage-conditioned imitation for robust humanoid door opening,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning Stageact: Stage-conditioned imitation for robust humanoid door opening,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:50.306809Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:50.306809Z digest=sha256:b0f805e31f942d24d9fc4076736e92ae6116f96afc5e8aaaea20ae14f01cbbcd

Observation 1d79d6f4-75fa-4a49-bd1e-2b3d38e2fc76 · outbound

This paper cites A behavior architecture for fast humanoid robot door traversals,.

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning A behavior architecture for fast humanoid robot door traversals,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:50.566587Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:50.566587Z digest=sha256:2d2fb1d8b108af3050463e6e63f1a7784a12cde408a2794b053e6530c277bd47

Pith citing papers

Observation f2339b25-7a1a-432e-bffe-48e6c843d5f8 · inbound

EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations cites this paper.

EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-07-31T02:03:17.213017Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-06-27T09:27:43.453005Z digest=sha256:d515c1c218fb01badd34b4ce419841dafde35092c4c732c45a60b5af8b04c69b

Observation a50faa90-7ed9-4a1f-bec1-50924d3641f0 · inbound

Learning Asynchronous Upper-body Task-space Trajectory Tracking Policy for Humanoid Robots cites this paper.

Learning Asynchronous Upper-body Task-space Trajectory Tracking Policy for Humanoid Robots REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-07-31T02:03:17.213017Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-06-25T21:08:43.127148Z digest=sha256:8bfc6f8084a4c75782e546e288815777f7aaad5e265c125c61a96991266d93d3