Pith. sign in

Paper Citation Record · LEDGER

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers

As of 7 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2509.06956.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.06956 v1

Coverage vector

measured 67 of 67 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-04T22:55:44.549338Z

measured 67 of 67 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

67 of 67 outbound references displayed

  • verified exact0
  • verified fuzzy62
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b4f4d5f3-c125-4fda-a2e7-65ff9d47bd29 · outbound

This paper cites Enhanced skeleton visualization for view invariant human action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Enhanced skeleton visualization for view invariant human action recognition,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.604268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.276189Z digest=sha256:4daae6188ada00563cae1f81ef20e79678d09bcb1e66b9cb099d1faac0a6fe73

Observation 720d6735-2dbd-4c84-947c-cebf3ee3a7b3 · outbound

This paper cites BlockGCN: Redefine topology awareness for skeleton-based action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers BlockGCN: Redefine topology awareness for skeleton-based action recognition,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.589126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.281251Z digest=sha256:825040285821a4eff3a47abeb388f3a99c3c4eba2ebc67375139acaf2f964220

Observation b76054a0-1e5d-4354-a7c1-0a8a34ac3b80 · outbound

This paper cites Multi-task deep learning for real-time 3D human pose estimation and action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Multi-task deep learning for real-time 3D human pose estimation and action recognition,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.573629Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.286129Z digest=sha256:0e38a85ac3770ec0788bcf37eecaee1e19757929671267cdd93ac0cc868de07b

Observation 1501b5c8-696c-4514-98be-0138146998f1 · outbound

This paper cites 3D human pose estimation in rgbd images for robotic task learning,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation in rgbd images for robotic task learning,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.559063Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.290980Z digest=sha256:dcab6a673bfbc0a21ed038ce9aa24645d4bf99ba4a8570266baceee5c89ab46b

Observation 8f07dd4c-430c-45db-9ae1-5f6f35af1e45 · outbound

This paper cites Hu- man 3D pose estimation with a tilting camera for social mobile robot interaction,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hu- man 3D pose estimation with a tilting camera for social mobile robot interaction,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.544051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.295802Z digest=sha256:1a0cb841dcfbd72aa86bd49b4f33be88a8cf42f118a9b1b4ea66952319542304

Observation 825df645-40d0-4f10-b282-fc6779caec29 · outbound

This paper cites Human-aware vision-and- language navigation: Bridging simulation to reality with dynamic human interactions,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Human-aware vision-and- language navigation: Bridging simulation to reality with dynamic human interactions,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.529550Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.300262Z digest=sha256:08df1f52c9342ce8a5ba930d5bb8b01c288943f4aeb4ebe028d8d0951dcc271d

Observation 25e097b8-cec7-468c-9a53-1bbb547db02f · outbound

This paper cites VNect: Real-time 3D human pose estimation with a single rgb camera,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers VNect: Real-time 3D human pose estimation with a single rgb camera,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.514635Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.305185Z digest=sha256:46d585d502679e6e83e74e4f14476f02843bae509f3f681b8c88129f406bdd4d

Observation fbe5c82b-a7a7-443b-9246-2a5a25863618 · outbound

This paper cites MotionEditor: Editing video motion via content-aware diffusion,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionEditor: Editing video motion via content-aware diffusion,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.500237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.309190Z digest=sha256:0524933c205de8f0d48ca72c626e13df4c38856d99b1a1a0915ff9d2f766b05c

Observation 63df35ca-7a6a-42e6-a570-0412419b5ef3 · outbound

This paper cites Co-evolution of pose and mesh for 3D human body estimation from video,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Co-evolution of pose and mesh for 3D human body estimation from video,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.485976Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.313157Z digest=sha256:67d19700eb5e4fcd4feb3f14b57c1743fa4ef40b21e32ccd1477c6b36375afc9

Observation 40c0af29-640a-4295-84fa-0278243f7c5b · outbound

This paper cites HDFormer: High-order directed transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers HDFormer: High-order directed transformer for 3D human pose estimation,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.470917Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.317152Z digest=sha256:6581cbe5015e56ec46bf48e43a9e92430dd64d4b7842e0fc7861fcae1fa4ccd8

Observation 37b2ad05-7ea0-4858-bdce-394562208d5a · outbound

This paper cites PoSynDA: Multi-hypothesis pose synthesis domain adaptation for robust 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PoSynDA: Multi-hypothesis pose synthesis domain adaptation for robust 3D human pose estimation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.455696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.321011Z digest=sha256:559f6ddd81c4150f3d68f9c35c5832ec357db2fd621c8702e05f936a8741c73f

Observation 6e35c363-6443-46f5-8db4-7b2d87bd0fae · outbound

This paper cites APP: Adaptive pose pooling for 3D human pose estimation from videos,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers APP: Adaptive pose pooling for 3D human pose estimation from videos,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.441146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.325284Z digest=sha256:32ed708609e58b7ae8c374f87358d7cb854f9b9bfc4dd0b15e565796aafea1bc

Observation fcd25d00-440f-4a28-baf4-a4514bc50b67 · outbound

This paper cites 3D human pose estimation with spatial and temporal transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation with spatial and temporal transformers,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.426324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.329518Z digest=sha256:25637e0a30d319c9c60671fe4dd9899622071ca5f4316e144c98e8713b771b86

Observation 6bce40d8-d998-4d99-b04e-c62a61b716db · outbound

This paper cites MHFormer: Multi-hypothesis transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MHFormer: Multi-hypothesis transformer for 3D human pose estimation,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.411109Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.333892Z digest=sha256:64be2783865a305fcdeff9e29dd3c63a786d8f72aa16aafb35a3df619f5c0092

Observation b114793d-4f91-4df6-84a5-0d1836a5097f · outbound

This paper cites MixSTE: Seq2seq mixed spatio-temporal encoder for 3D human pose estimation in video,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MixSTE: Seq2seq mixed spatio-temporal encoder for 3D human pose estimation in video,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.395097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.337864Z digest=sha256:d0a0fd170f52ff78b024d256b359710952164ed6454ef30cd88140cd95209174

Observation f51c0877-6a53-499d-a144-2ddfece8fcf0 · outbound

This paper cites MotionBERT: A unified perspective on learning human motion representations,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionBERT: A unified perspective on learning human motion representations,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.379484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.341870Z digest=sha256:0025b5edb226e2e21e57140b400641fb269a1b933e941306a4a6e908aa2088fa

Observation 90dbc6c8-3871-4133-bec1-3be5e3cbb31e · outbound

This paper cites TCPFormer: Learning temporal correlation with implicit pose proxy for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TCPFormer: Learning temporal correlation with implicit pose proxy for 3D human pose estimation,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.364275Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.345965Z digest=sha256:6263da6700ffb8cbd025d8d7bfd04edb7ed5f852b0113e82c82a2cec905dfb22

Observation 4b28a346-55fc-46cd-978e-798221157b3f · outbound

This paper cites P-STMO: Pre-trained spatial temporal many-to-one model for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers P-STMO: Pre-trained spatial temporal many-to-one model for 3D human pose estimation,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.347922Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.350184Z digest=sha256:2fcea08a2cd4d85b70e96065263bc36e1c0d9573c0ea08cb312e222e8a47d819

Observation 6ed72bc7-d23f-4b68-abb8-0746094895ac · outbound

This paper cites Exploiting temporal contexts with strided transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Exploiting temporal contexts with strided transformer for 3D human pose estimation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.332328Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.354381Z digest=sha256:cb05b1c9ef8917829ab14b73e4d201affb73b4a9e7f7d3605da2fa54664dbccd

Observation 72970066-8651-4f23-bb7a-435a8ef45175 · outbound

This paper cites Uplift and upsample: Efficient 3D human pose estimation with uplifting transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Uplift and upsample: Efficient 3D human pose estimation with uplifting transformers,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.315890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.358309Z digest=sha256:66387b43e63be9841966ec5362d949537b2498f0289a5d388c2d26dc31498eb0

Observation b57b8b25-c837-473a-bea7-09290c4d5b2d · outbound

This paper cites Hourglass tok- enizer for efficient transformer-based 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hourglass tok- enizer for efficient transformer-based 3D human pose estimation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.299990Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.362497Z digest=sha256:b0eb623d8cc4c1e1d84c2221ea930a19dce9588afe60e4f9e58709d649649d23

Observation f6e5953b-fcb9-4afc-abf3-0136e9c28b26 · outbound

This paper cites 3D human pose estimation in video with temporal convolutions and semi- supervised training,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation in video with temporal convolutions and semi- supervised training,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.284393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.366518Z digest=sha256:9290166fa22aa9c5dc4bcf4e62fe0c0f781b6f8970465c43cca2869e35cff0c6

Observation 6de2d2f0-1a0c-4b75-8362-f9aa670abefe · outbound

This paper cites Attention mechanism exploits temporal contexts: Real-time 3D human pose reconstruction,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Attention mechanism exploits temporal contexts: Real-time 3D human pose reconstruction,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.267817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.370443Z digest=sha256:9b76e16862686ceb6d146154fa81698fe61b1bd6ec2243797c9192fa6a5537de

Observation d72560e8-4122-4bef-be79-5d62196e3970 · outbound

This paper cites Hu- man3.6M: Large scale datasets and predictive methods for 3D human sensing in natural environments,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hu- man3.6M: Large scale datasets and predictive methods for 3D human sensing in natural environments,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.249315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.374526Z digest=sha256:1f93cb2c4777e3aba9f316c5b3226279cae0d4f01d50ecd380d3f4499ea5065e

Observation a5929187-bde4-4658-b9ba-79e6736a9455 · outbound

This paper cites DynamicViT: Efficient vision transformers with dynamic token sparsification,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DynamicViT: Efficient vision transformers with dynamic token sparsification,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.232965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.378458Z digest=sha256:696193fa4112d78b8a37674dcebc40285af372b231657bb7367a07cd82956bfb

Observation e3c76fb1-d654-40e8-8fb2-1751f3a7a9ca · outbound

This paper cites VTC-LFC: Vision transformer compression with low-frequency components,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers VTC-LFC: Vision transformer compression with low-frequency components,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.215978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.382535Z digest=sha256:ae18ee5e8af35a545f50bb90355168c2f967b4737b819422a0713777226a61e8

Observation 97173f43-0817-4807-a09e-a6a58e64eb08 · outbound

This paper cites MotionAGFormer: Enhancing 3D human pose estimation with a transformer-gcnformer network,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionAGFormer: Enhancing 3D human pose estimation with a transformer-gcnformer network,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.199602Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.386402Z digest=sha256:0d2ffef18a5926c4d4ff975cd54ebc98c0c3a62d92cc487e96c4a471e15731c8

Observation b6b40d83-3956-4630-8419-7d57b536cf02 · outbound

This paper cites Attention is all you need,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Attention is all you need,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.183013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.390306Z digest=sha256:0848aaea67b0e6825d8b6f747d6d3e7dcd29f00ae34eaf7801681a01d5c21d84

Observation cf3b16a6-684d-4883-b2c8-29b69449fdc8 · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers An image is worth 16x16 words: Transformers for image recognition at scale,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.394566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.394566Z digest=sha256:98e52974b8b3245540308453161331f566c26340a03b83b8efb4e7f8affa5637

Observation 5b8a6825-0064-4e7e-8788-c91ef4f6b236 · outbound

This paper cites Swin Transformer: Hierarchical vision transformer using shifted windows,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Swin Transformer: Hierarchical vision transformer using shifted windows,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.398516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.398516Z digest=sha256:e9e11450c62255674c0ab196b10a2cb6114e66137af123ee2f9e4fea99e87d34

Observation 930f046b-5ca2-4c3c-9c0c-665dac74af64 · outbound

This paper cites GSRFormer: Grounded situation recognition transformer with alternate semantic attention refinement,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GSRFormer: Grounded situation recognition transformer with alternate semantic attention refinement,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.144295Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.402652Z digest=sha256:6506d5dbbcf491e562669e1cf51061e3911b6ba41ad8b828a26e549c44465f5c

Observation e95de71a-0889-4338-b5aa-9c773d9e6a4e · outbound

This paper cites Implicit temporal modeling with learnable alignment for video recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Implicit temporal modeling with learnable alignment for video recognition,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.128383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.406606Z digest=sha256:1affb6ffb20a1c99d323f0168ebe0a2544c8acc1308db480809266c71fc0402e

Observation 1e795d72-8e81-41d3-aada-2b806054cf2e · outbound

This paper cites Adaptive multi-view and temporal fusing transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Adaptive multi-view and temporal fusing transformer for 3D human pose estimation,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.111463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.410612Z digest=sha256:7b86b2281e219869cb78ae955a2c8466a04051bba8712dc8bddcb9cc055262b4

Observation 373eb5fd-4fe5-4259-ad24-cc80b2184597 · outbound

This paper cites SVTformer: Spatial-view- temporal transformer for multi-view 3d human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers SVTformer: Spatial-view- temporal transformer for multi-view 3d human pose estimation,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.093596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.414565Z digest=sha256:468fe7404b4c36600c382635ad8558567414afdb2bbded111d368d43353e4c97

Observation 6f96e7d7-5cb6-4b93-97e5-da9dd003322d · outbound

This paper cites A simple yet effective baseline for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers A simple yet effective baseline for 3D human pose estimation,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.075721Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.418722Z digest=sha256:767ff96e6b4c11954efb4e4efb22ab25e4d3d288c5bb1269a698ab8c258ffd0c

Observation 14809c94-0d1a-44aa-bda2-b282dced5ba8 · outbound

This paper cites MobileHumanPose: Toward real- time 3D human pose estimation in mobile devices,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MobileHumanPose: Toward real- time 3D human pose estimation in mobile devices,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.055229Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.422985Z digest=sha256:170f1a01a7ace1f8a8b36a5f067760ec63902e2356b7bc75af2d1ecf3d81683b

Observation 60ebee9c-af8f-460b-93ca-b6eeef981744 · outbound

This paper cites DeciWatch: A simple baseline for 10x efficient 2D and 3D pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DeciWatch: A simple baseline for 10x efficient 2D and 3D pose estimation,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.032888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.427489Z digest=sha256:6ac85fd217a92d573ba8dc47f476b29509d33ac1263b516645f5511f9fc6f711

Observation 48fab954-634f-41c6-88e5-9ca629c6d8ba · outbound

This paper cites PoseFormerV2: Exploring frequency domain for efficient and robust 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PoseFormerV2: Exploring frequency domain for efficient and robust 3D human pose estimation,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.016054Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.431447Z digest=sha256:00b3843f4a9ddcb8d9a8736f1fa1f4e69cb337ecf147a71945eaee9826ae2671

Observation 07385e7a-d708-4b69-a36c-50010ee4bbc9 · outbound

This paper cites MixSynthFormer: A transformer encoder-like structure with mixed synthetic self-attention for efficient human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MixSynthFormer: A transformer encoder-like structure with mixed synthetic self-attention for efficient human pose estimation,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.991304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.435483Z digest=sha256:d4c90bed181f0601904f4359eb6a9dcc099b70003a91c2350ace36e2acbaa9f9

Observation 25bb93d7-3da1-4485-ba7d-1dd43d2da844 · outbound

This paper cites Learn- ing to reconstruct 3D human pose and shape via model-fitting in the loop,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Learn- ing to reconstruct 3D human pose and shape via model-fitting in the loop,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.975819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.439483Z digest=sha256:73859c8f5ab1b8c5cc07933fe0cf8b7c594cda19f82eadfa67c6c8a905fb69c0

Observation 96f5d0f2-9ef8-4e5c-8065-1bd28931b230 · outbound

This paper cites Exemplar fine-tuning for 3D human model fitting towards in-the-wild 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Exemplar fine-tuning for 3D human model fitting towards in-the-wild 3D human pose estimation,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.958926Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.443509Z digest=sha256:ad47cb9e8874c86588cba19534ac98fbac4566241cbe9d6ba8d57ad31b38c7af

Observation 397d71ba-eec4-45af-9869-de21c78643b3 · outbound

This paper cites PARE: Part attention regressor for 3D human body estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PARE: Part attention regressor for 3D human body estimation,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.943929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.447524Z digest=sha256:350725e6efff383280b21212ee05d084e70c9f3acda8104d5d8d092b58d3ef4e

Observation 1d922cbe-ffd0-43d0-84d8-29993f125cff · outbound

This paper cites TORE: Token reduction for efficient human mesh recovery with transformer,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TORE: Token reduction for efficient human mesh recovery with transformer,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.929654Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.451549Z digest=sha256:2461fe9faa28728812f8c71a950509296dfc97cec47713c051157ce7e74e489d

Observation 16825822-1de4-4f87-95de-7e5d28a52f73 · outbound

This paper cites Beyond attentive tokens: Incorporating token importance and diversity for efficient vision transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Beyond attentive tokens: Incorporating token importance and diversity for efficient vision transformers,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.914049Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.455632Z digest=sha256:3298ebe57d7adf0b921d6855af94c28884abe1eca4e0e1f47caa88797f3abe14

Observation 1f044c05-ba2c-4eed-a7c2-e00aa6a06667 · outbound

This paper cites SPViT: Enabling faster vision transformers via latency-aware soft token pruning,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers SPViT: Enabling faster vision transformers via latency-aware soft token pruning,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.897958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.460009Z digest=sha256:67544c1ad684eb32cb46adbe237978a5055c48b9fe65a266819139c6ef7c4492

Observation 1c94fcc8-0c33-43b1-be83-e2decafff9b9 · outbound

This paper cites Making vision transformers efficient from a token sparsification view,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Making vision transformers efficient from a token sparsification view,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.883238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.464202Z digest=sha256:17f1045c2c833e90338db10244a34f390ec0c505f7f0fa0f0f42fbed90ddf711

Observation 44989d90-63e7-4fe4-84ec-30e0756b8106 · outbound

This paper cites PPT: Token-pruned pose transformer for monocular and multi-view human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PPT: Token-pruned pose transformer for monocular and multi-view human pose estimation,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.868634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.468245Z digest=sha256:6983b3919504ad4cf767b46122f2ba51cd765153b7a4752aa298224623fcbf89

Observation 3221ffe7-b8ce-40ef-8b86-23724007d868 · outbound

This paper cites TCFormer: Visual recognition via token clustering transformer,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TCFormer: Visual recognition via token clustering transformer,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.853539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.472243Z digest=sha256:cf897d355838d87f4b06d683eb48e0d2b21dbcfe24d73dc5d50b0b8372c42205

Observation 31755350-e565-4318-9397-8375b1fff6be · outbound

This paper cites GTPT: Group-based token pruning transformer for efficient human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GTPT: Group-based token pruning transformer for efficient human pose estimation,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.839149Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.476398Z digest=sha256:e2416879e2af19728fe34cba6ecb46fd4f08fecec38d61adf58666d0c8968c9d

Observation 8add3375-a0b0-4fa5-8ff6-e363868ba09c · outbound

This paper cites Deep residual learning for image recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Deep residual learning for image recognition,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.480375Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.480375Z digest=sha256:6f19e439276266fbba49dee807b69601d7e3798ce826c48ee647c07dd0e29999

Observation 025de195-5465-4dc4-bbc1-a8eb55e1cd6d · outbound

This paper cites Very deep convolutional networks for large-scale image recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Very deep convolutional networks for large-scale image recognition,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.484330Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.484330Z digest=sha256:00033af6cce60adb86326ee0cef013f3e41f6b8fcf4986571e1c8869cc3dcfa7

Observation ed2c8055-c961-4e8a-b53f-bb351e8a0ebe · outbound

This paper cites Study on density peaks clustering based on k-nearest neighbors and principal component analysis,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Study on density peaks clustering based on k-nearest neighbors and principal component analysis,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.804949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.488372Z digest=sha256:9caef3cdf21188793fb1ac29277b1477b08a0e2a10cc4a2c55ffab318ca59e5b

Observation 9f431092-4a39-4cef-b5b3-79be4d17ca39 · outbound

This paper cites A-ViT: Adaptive tokens for efficient vision trans- former,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers A-ViT: Adaptive tokens for efficient vision trans- former,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.790394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.492654Z digest=sha256:efed6e299d5454684e25bd995d2dda37c915c7444a37fd2957cc7320408b0c03

Observation ddf73042-7a9d-4ec4-b425-5baf25628e11 · outbound

This paper cites Token pooling in vision transformers for image classification,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Token pooling in vision transformers for image classification,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.775728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.496580Z digest=sha256:5d87572685fadfe9ea8b6912e7d99d99d9a181bbef60b14526b7005ae2b98e88

Observation c14766e8-3162-44ee-b7b7-8662a0d84f71 · outbound

This paper cites Not all patches are what you need: Expediting vision transformers via token reorganizations,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Not all patches are what you need: Expediting vision transformers via token reorganizations,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.500530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.500530Z digest=sha256:03e36fd3bdef23ef2c2a59853137c57722ecb8eed181e0953323626d91d7b961

Observation 709eb1af-6c0c-465a-bcd1-e6402abdd3b1 · outbound

This paper cites DiffRate: Differentiable compression rate for efficient vision transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DiffRate: Differentiable compression rate for efficient vision transformers,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.750310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.504684Z digest=sha256:1624953bce64705407038ed69eb213abc1be56367d880bdb162715f8a6797a42

Observation cf2ea3d7-e078-4c4c-830b-dc40279e0c99 · outbound

This paper cites Multi-hypothesis represen- tation learning for transformer-based 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Multi-hypothesis represen- tation learning for transformer-based 3D human pose estimation,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.736258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.508638Z digest=sha256:e4cd323112be19476a521f05fc7e4459235ff61f40ee9f430121dc0000933c9b

Observation f6694fa0-cd82-48e2-ac50-0490df665126 · outbound

This paper cites Monocular 3D human pose estimation in the wild using improved CNN supervision,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Monocular 3D human pose estimation in the wild using improved CNN supervision,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.721982Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.512665Z digest=sha256:aa586035bf61eb8ca146bcfc726af8a304f75b52650baf348590e07cca8d095c

Observation 590cb668-6de6-4437-9ea1-fd361814d127 · outbound

This paper cites GraphMLP: A graph MLP-like architecture for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GraphMLP: A graph MLP-like architecture for 3D human pose estimation,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.707947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.516824Z digest=sha256:4c5cbdc592d64623280d9751a11ed9181a9b8555ad319c141a238a78e5d22d67

Observation 733b872b-2cc8-40a9-b763-72d2b1797d16 · outbound

This paper cites Locally connected network for monocular 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Locally connected network for monocular 3D human pose estimation,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.693301Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.521081Z digest=sha256:9d25310be9d148e3d17ea10f5b5c740bc621a3602a1e70bd3fd810d125cb66b7

Observation f9d0d24c-6b35-4d94-8a9a-8c8f73c5ee5a · outbound

This paper cites Monocular 3D pose estimation via pose grammar and data augmentation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Monocular 3D pose estimation via pose grammar and data augmentation,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.679446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.525429Z digest=sha256:19ba5c8e5be7b253cc6adfb8c704f7a06620d4e3840b088a75e9473812b5ff5f

Observation 01a8b894-ab54-46dd-a1a7-165d20417ddb · outbound

This paper cites Cascaded deep monocular 3D human pose estimation with evolutionary training data,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Cascaded deep monocular 3D human pose estimation with evolutionary training data,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.664535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.529400Z digest=sha256:6359ef1e12c7f7b2088a4bc253f2bdcc192d8dab8c5dbdefacc55b3294788afb

Observation e9f879f7-c10f-43a0-a4db-ad909c30732a · outbound

This paper cites Stacked hourglass networks for human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Stacked hourglass networks for human pose estimation,

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.648705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.533256Z digest=sha256:ee787cad9d3f0a187ab56db3247259f345d33e82baa02e5ba66005c8121ba00f

Observation 99557aab-28cd-44ee-b8f7-2ff27b9f5003 · outbound

This paper cites 3D human pose estimation with spatio-temporal criss-cross attention,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation with spatio-temporal criss-cross attention,

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.634297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.537351Z digest=sha256:40a7cc6d2320467f545f342790dea43918c660e65c40b27d2a653e9f29a938c0

Observation 3ecc00e2-7edd-4dd1-afa8-f9e5e502eaf1 · outbound

This paper cites KTPFormer: Kinematics and trajectory prior knowledge-enhanced transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers KTPFormer: Kinematics and trajectory prior knowledge-enhanced transformer for 3D human pose estimation,

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.619636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.541340Z digest=sha256:6122f90d777834d8b409f319f1f2dc99d77bf9073b3cf270b3f3cc72315be0fc

Observation b2512e1e-6097-4b80-852c-95f7ac736f26 · outbound

This paper cites Diffusion-based 3D human pose estimation with multi-hypothesis aggregation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Diffusion-based 3D human pose estimation with multi-hypothesis aggregation,

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.604436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.545237Z digest=sha256:9533d9ef7da6c88b1541b4f6e42ca4308d00d05dc57c59698df1375b958be436

Observation 9f1a2e9f-c54e-40f0-aa13-113e6938cc00 · outbound

This paper cites DiffPose: Toward more reliable 3D pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DiffPose: Toward more reliable 3D pose estimation,

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.588756Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T22:55:44.549338Z digest=sha256:80ac655f1cfd59bf3ba9ee32d680dd1d8231c2ee8a4fbd27184c24b3d1a038c2

Pith citing papers

No inbound Pith citation observations are available.